輸入「動漫女孩、美麗、傑作」並生成。
你已經知道結果會如何:塑膠感的皮膚、玻璃珠般的眼睛,以及看起來像貼紙的城市背景。這不是模型「無法呈現動漫風格」,而是提示詞過於空洞。動漫風格只是進入該類型的門票,並非具體的鏡頭清單。
本文並非二十個互不相關的模板。我們鎖定一個原創角色,僅改變其最終呈現風格。若你想學習可重複使用的 AI 動漫藝術風格提示詞,這才是更乾淨的學習方式。收集他人的提示詞語句,無法教會你哪個字詞真正拯救了畫面。
請記住這一點:角色定義她是誰;風格決定這張靜幀屬於哪種劇集類型;相機與光影則說明觀眾的視角位置。這三者缺一不可,否則模型將會憑空捏造出第四個女孩。
提示詞
- 17歲女孩,黑色直髮配一枚細紅色髮夾,身穿寬鬆灰色連帽衫,站在藍色時刻的空曠高架步道上,乾淨的細線稿,賽璐珞著色,頭髮邊緣光,遠處城市散景,電影感構圖,16:9比例,無浮水印,無文字
在選擇風格之前,先固定人物設定
許多動漫提示詞開頭會寫上工作室名稱或年代,但臉部仍然模糊不清。一旦更換模型,角色就會消散無蹤。
下方的每個範例都使用同一位女孩。請勿將其替換為有版權的主角。當你需要製作系列作品、縮圖或商業案時,你會感謝自己當初這麼做。
原創17歲女孩。及肩黑色直髮。左側別著一枚細紅色髮夾。深棕色眼睛,眼白乾淨,非巨型娃娃眼。身穿淺灰色寬鬆連帽衫,袖口較長,內搭白色T恤。深色工裝短褲。舊白色運動鞋,右腳鞋帶鬆開。身材纖細,未誇張化成網路迷因中的腰身。預設表情:疲倦、無動於衷,非擺拍姿勢。
三個真正能跨模型保持一致的細節:
- 一個可移動的物品。例如鬆開的鞋帶、歪斜的髮夾,或從口袋露出的交通卡。模型需要這樣的鉤子,否則每一幀都會變成不同的人。
- 讚美詞彙幾乎無效。「美麗」、「神聖面容」、「完美特徵」都是空洞的廢話。
- 保持時代背景一致。除非場景有解釋,否則穿著連帽衫的17歲女孩不應該同時身穿宮廷鎧甲。

提示詞
- 角色設定圖風格,原創少女,17歲,及肩黑色直髮,左側別著細紅色髮夾,深棕色眼睛,平靜睏倦的表情,寬鬆淺灰色連帽衫,白色內搭T恤,深色工裝短褲,右腳白色運動鞋鞋帶略微鬆開,身材纖細非性感化,純淨工作室背景淺灰色,均勻照明,乾淨動漫線稿,無知名角色,無商標
立即創作
四層結構勝過冗長句子
將 AI 提示詞(無論是否為動漫風格)想像成疊好的衣物,而非一篇論文。
| 層級 | 這樣寫 | 跳過此項 | 作用說明 |
|---|---|---|---|
| 1. 角色 | 髮型、一個標誌性物件、年齡、當下的臉部狀態 | 「美女」、「神顏」 | 確保她在下一次生成中保持一致 |
| 2. 完成度 | 線條粗細、上色風格、時代氛圍 | 僅使用「anime」(動漫)或「anime style」(動漫風格) | 電視動畫劇集 vs 電影海報 vs 同人誌頭像特寫 |
| 3. 場景 | 地點中的一個具體物件、時間、天氣 | 「城市」、「街道」、「美景」 | 讓背景看起來更具生活氣息 |
| 4. 細節 | 相機高度、距離、光源進入位置 | 「電影感」、「大片質感」 | 避免護照照片式的僵硬姿勢 |
第四層是初學者草稿常忽略的關鍵。主體居中、視線平視、正面使用柔光箱打光。這就是為什麼許多靜態圖片看起來像換裝娃娃的原因。
同一位女孩,四種色溫
保持角色設定卡不變,僅調整畫質風格與場景。若一次性更改所有元素,將無法判斷是哪項調整挽救了整體畫面。
1) 每週電視劇照風格:銳利線條、塊狀陰影
適用於虛擬形象、劇集封面及短影片縮圖。

硬邊賽璐珞陰影與有限色階比一般動漫風格更具表現力。它們迫使模型將陰影歸納為明確形狀,而非在臉頰上塗抹模糊的光暈。
提示詞
- 深炭色背景上的簡潔編輯資訊圖表,四張堆疊的半透明卡片僅以英文標註:Character / Finish / Place / Eye,每張卡片配有小型圖示(髮夾、鋼筆、自動販賣機、相機),極簡現代佈局,無段落文字,高階部落格標題插圖,16:9 比例
2) 戲劇氛圍:背景開始發揮作用
適用於海報、桌布及任何需要展現高級感的靜態圖片。

「她不在中間」這半句話,也是打破證件照構圖最快的方法。
提示詞
- 戲劇化動漫靜幀,細緻背景美術,柔和大氣透視,輕微顆粒感,乾淨的角色線條襯托繪製城市背景。雨後人行天橋,水窪反射霓虹藥局招牌,遠處鐵路線。視覺重心緩慢移向天空,她站在偏左位置,低頭注視濕潤欄杆。負面提示:塑膠感皮膚、純天空背景、過度光暈、美顏濾鏡
3) 1990年代錄影帶風格:讓畫面帶點雜訊與髒感
非常適合用於情緒板、音樂專輯封面,或是懷舊影片的首幀。人們往往害怕柔和感,導致每張臉孔看起來都像 2024 年的美容廣告般過度精緻。

Milur 風格與銳利的數位感格格不入。將顆粒感與 8k 解析度混在一起,會讓模型產生內部衝突。
提示詞
- 1990年代深夜動畫 OVA 靜幀,較柔和的類比色彩,輕微 VHS 模糊感,可見的膠片顆粒,手繪背景,非銳利數位風格 空曠的郊區月台,一台自動販賣機的燈光,燈泡周圍有飛蛾,夏季的濕悶感 腰部以上,側面角度,她對著連帽衫的袖口打哈欠 負面提示:8k 銳利度、毛孔級別的真实感、發光肌膚、現代智慧型手機、清晰的 UI
4) 同人誌頭像:減少線條,強化色塊
非常適合用於圖示、周邊商品和貼紙。

複雜的背景在 400 像素下會變得模糊不清。如果檔案需要用作頭像,請刪除巷弄背景。
提示詞
- [貼上角色卡] 數位同人插畫,輪廓線加粗,平坦的粉彩色塊,簡單的腮紅,小尺寸下仍清晰可辨 純奶油色背景,一道長陰影,無城市元素 臉部與肩膀特寫,視線越過鏡頭,閉嘴 負面提示:複雜巷弄、寫實髮絲混亂、重型盔甲、額外飾品
刪除的字詞要多於新增的字詞
效果不佳時,人們往往會下意識地堆砌更多提示詞。這通常是最昂貴的錯誤做法。
無效負載:傑作、最佳品質、超細緻、驚豔、電影感、8k、上帝光線、完美臉孔。這些詞在某些寫實攝影任務中可能無傷大雅,但在 AI 動漫風格提示詞中,它們往往會讓畫面變得過於光滑且虛假。
真正發揮作用的負面提示詞:
- 寫實皮膚、可見毛孔、油光高光 — 防止塑膠感臉孔及意外產生的真人風格
- 西方卡通、迪士尼比例 — 避免出現大头娃娃般的週末晨間動畫風格
- 空白背景、預設攝影棚灰色 — 除非你刻意想要這種頭像效果
- 多餘手指、黏連手部、多餘耳朵 — 一隻畫壞的手就會毀掉整張圖
- 浮水印、多餘文字、Logo — 部落格配图必備
The other failure is mixed loyalty. Negative box says realistic. Positive box asks for subsurface skin. The model flips a coin. Pick a side.
靜態圖穩定後,再使用 AI 製作動畫影片
在 Viyou 上,許多人不會止步於靜態圖。靜態圖只是第一幀。當你把這張雨後天橋的圖片輸入「圖生視頻」功能時,不要再次貼上完整的繪圖提示詞。視頻模型需要知道接下來三秒內什麼東西在動。
三種毀掉影片片段的做法:
- 「她轉身、揮手、奔跑,鏡頭環繞。」動作太多。臉部變形會最先發生。
- Dumping the entire still prompt into the video box. Long and hollow.
- 忘記加上「不要改變她的臉」。圖生視頻功能很喜歡重新修飾骨骼結構。
先讓三秒鐘的效果完美,再進行擴展。第一次嘗試就要求生成十秒影片,是積分快速耗盡的主要原因。
如果你的目標是從動漫靜態圖創作 AI 動畫影片,這就是完整路徑:先在圖像端鎖定角色身份,然後像撰寫鏡頭筆記那樣描述動作,而不是寫小說。
你可以實際改寫的簡短提示詞範本
替換括號內容。不要在同一輪生成中更換光源。
夜班,便利商店
[角色設定卡], 電視動畫截圖, 硬邊賽璐珞上色, 細線稿, 夜間便利商店, 冰櫃霧氣, 螢光燈光, 中景, 她 [一個小動作], 負面提示:油膩皮膚, 3D 渲染, 多餘手指
放學後的火車車窗
[角色設定卡], 劇場版動畫靜幀, 繪製感的黃昏天空, 火車車窗倒影, 坐在玻璃旁, 雨痕, 非中心構圖, 負面提示:美顏濾鏡, 空洞背景
夏日昆蟲
[角色設定卡], 1990 年代 OVA 靜幀, 顆粒感, 潮濕夜晚, 一盞街燈, 飛蛾, 腰部以上特寫, 她看著手機螢幕但不要渲染可讀文字, 負面提示:超銳利, 現代 UI 雜亂元素
不要要求模型在手機上書寫文字。它無法在畫面內正確拼寫。「亮起的螢幕」就足夠了。
先在文生圖(text-to-image)中生成靜態圖像。當臉部穩定後,再轉為圖生圖(image-to-image)或圖生視頻(image-to-video)。第一輪無需使用最厚重的模型。
FAQ
實務上,AI 提示詞中的動漫藝術風格是什麼?
它們是完成度指令:線條、陰影形狀、顆粒感、色調——而非情緒形容詞。「電視賽璐珞」、「劇場背景美術」、「90 年代 OVA」和「扁平同人風」是風格。「史詩感」則不是。
我需要為每個模型準備獨立的 AI 動漫提示詞區塊嗎?
不需要。保持角色設定卡穩定。當模型傾向過於寫實或過於西式時,調整完成度指令即可。場景和鏡頭可以保持不變。
我可以提及吉卜力、導演或受版權保護的角色嗎?
你可以生成圖片,但這是較弱的預設選項。版權問題複雜,且工作室名稱在不同檢查點(checkpoint)上的含義並不一致。「手繪背景、空氣透視法、一縷頭髮被風吹起」雖然輸入較慢,但更可靠。
為什麼切換模型時臉部會漂移?
因為身份特徵被寫成「漂亮」這類抽象詞,而非具體物件。請指定夾克、連帽衫顏色、蕾絲等細節。如果你有參考圖,請使用圖生圖,而不是依賴文字描述。
為什麼手部總是畫錯?
不要在一句話中同時要求兩隻複雜的手勢和複雜道具。讓一隻手插在口袋裡,另一隻放在咖啡罐上。或者將手部裁切出畫面。這是正常的製作選擇,並非作弊。
如果我只想用 AI 製作動畫視頻,這有幫助嗎?
有幫助,因為視頻繼承自靜態圖像。糟糕的動漫提示詞會變成頭髮亂動的糟糕片段。先修正靜態圖像,再編寫三秒的動作。
到此為止
動漫提示詞(Anime prompts)不是寫作比賽。篇幅越長並不代表越好。
讓單一角色具有辨識度。決定檔案風格要像週播電視動畫、劇院級靜幀、磨損的錄影帶,還是同人誌圖標。將光線與鏡頭設定放在最後處理。負面提示詞(negative prompt)僅列入你實際見過的災難案例。當靜態畫面成立後,讓頭髮與遠處的裙擺飄動三秒。
透過四種不同的溫度參數來生成同一位女孩,你會比保存另一段「神級」段落獲得更多收穫。真正的價值從來不在於寫下「anime style」這些字詞,而在於你是否願意描繪便利商店冷凍櫃冒出的霧氣。





