你喜爱的模型——一站汇聚,无限生成。

限时享受最高 27% 优惠!›
图像指南

照片转 Q 版 AI:提示词、模板与风格指南

O
Evelyn
2026 年 7 月 24 日 · 阅读时长 5 分钟
Photo to Chibi AI: Prompts, Templates & Style Guide

粘贴 prompt,用任意模型免费生成

普通卡通和地道 Chibi 之间的区别,几乎全在提示词上。除非你刻意引导,否则模型默认生成写实比例,因此用对 Chibi 风格提示词关键字——尤其是“super deformed”和“oversized head”——对输出质量的提升,远胜任何设置菜单。本指南将讲解 Chibi 的定义、如何写出能锁住比例的提示词,以及一套能让模型保留面部结构的照片转 Chibi 工作流程。

什么是 Chibi 画风

Q版角色有着夸张的比例:超大的头和眼睛、圆润的小身体、短短的四肢、小巧的鼻子,以及极简的细节。头部通常占角色总身高的三分之一到二分之一。这个比例是你的 prompt 必须传达的最重要的一点。

艺术家也把这种风格称为 super deformed,简称 SD。这个词源自日语「deforume」(风格化变形),而它本身又借自法语「déformer」。据 维基百科上关于该格式的历史,它源自20世纪80年代初一位学生投稿给万代模型爱好者杂志的插画,万代于1985年6月首次在扭蛋机中售卖 SD Gundam 扭蛋玩具。中文艺术社区使用对应的说法“Q版”,其中“Q”是“cute(可爱)”的谐音缩写。

Chibi 属于更广义的 kawaii(可爱)美学,它源自上世纪 70 年代日本女学生的亚文化,并随着三丽鸥对“萌”的商业化而发扬光大。正如 Hello Kitty 自身的历史表明,这个角色于 1975 年推出,最初印在一款搪胶零钱包上,并帮助定义了那种风格。Kawaii 视觉的核心——模仿新生儿比例的大头小身——正是 chibi prompt 必须重现的要素。

Q版 Prompt 拆解:一个简单的公式

每一个靠谱的 chibi prompt 都会填满五个要素:

主体: 角色是谁,加上比例提示。例如:「一个头大身小的 Q 版女孩」。

风格修饰: 视觉风格。例如:「可爱动漫风、超级变形」。

背景: 保持简洁,让角色成为主角。例如:"纯色柔和粉色背景。"

灯光: 柔和均匀的光线契合这种风格。示例:"柔和的影棚灯光"。

质感: 最终图像的表面质感。例如:2D 用「高细节、干净的线条」,3D 用「光泽 3D 乙烯基玩具质感」。

组装起来,这个实操示例读作:

一个头大身小的 Q 版女孩,闪亮的大眼睛,可爱动漫风,超级变形,纯淡粉色背景,柔和的影棚光线,高细节,干净的线条

Chibi girl with oversized round head and tiny body generated from the five-slot prompt formula, kawaii style, pastel pink background

各个插槽相互独立。替换成品插槽,同一角色就变成 3D 手办;替换背景插槽,它就变成贴纸。正是这种模块化让公式胜过死记整段 prompt。

必备的 Chibi 提示词关键词与修饰词

这些术语反复出现在模型文档和社区实践中,因为它们对应着模型训练时所依据的概念:

  • 卡哇伊: 将输出锁定为日系可爱风:圆脸、大眼、娇小身形。
  • 超变形(Q 版): 最强的比例触发词。它会让模型夸大头部、缩小身体,而不是把普通动漫角色直接画小。
  • chibi: 搭配「super deformed」一起使用,让 prompt 进一步强化比例上的暗示。
  • Q 版: 当风格目标来自中国游戏美术或国漫周边时,这个值得加上——在这些语境里 Q版 是标准说法。
  • 大头小身: 为忽略风格简写的模型提供明确的比例描述。
  • 夸张而富有神采的大眼睛: 眼睛大小对可爱感的影响,超过任何其他面部特征。
  • 3D 搪胶玩具质感: 将输出从插画切换为收藏级手办渲染。
  • 柔和色调背景: 让配色保持在可爱风范围内,避免画面杂乱。
  • 柔和光线: 避免容易显得写实的生硬阴影。
  • 高细节: 锐化线条和表面纹理,同时不会增添写实的人体结构。

关于主体有一点要注意:不要在 prompt 中指名受版权保护的角色。一个 2026 年 3 月 Debevoise 简报 提醒,让 AI 生成特定的受版权保护角色可能会增加侵权风险,而且 华纳兄弟探索公司 2025 年针对 Midjourney 的诉讼 引用了那些 prompt 里根本没提到角色名的生成结果。改用特征来描述:「一个穿红色背带裤的 Q版 水管工」仍有风险,因为通用关键词组合可能收敛到受保护的角色;而「一个绿松石色头发、拿着扳手的 Q版 机修工」则不会。OpenArt 的 版权安全检查 可以在你分享或出售作品前,扫描输出内容,排查潜在的知识产权冲突。

2D 与 3D Q版 prompt 风格

公式中的成品风格环节将 chibi 分为几种截然不同的样式,每种都有各自的关键词集。

2D 扁平 Q 版

这就是经典的贴纸和表情包风格:轮廓粗犷、色块平涂、没有渐变。关键词包括“cel-shaded”(赛璐璐风)、“flat color”(平涂色)、“clean vector line art”(干净矢量线稿)、“sticker aesthetic”(贴纸美学)和“white background”(白色背景)。适用于聊天贴纸、Twitch 表情和文具风插画等需要在小尺寸下依然清晰可辨的场景。

Q版男孩,超大头部与短粗四肢,赛璐璐上色,平涂色彩,干净的矢量线稿,贴纸风格,白色背景,可爱风

2D flat chibi boy sticker with cel-shaded flat color and white background

3D 玩具风 Q 版

这一变体会把角色生成为实体收藏品。关键词包括「3D render」「vinyl toy finish」「glossy surface」「soft studio lighting」,以及「product photography」或「action figure in blister pack」等构图提示。吸塑包装的构图是个强触发词,因为模型会将其与玩具摄影联系起来。

Q版宇航员3D渲染,光泽乙烯基玩具质感,超大圆形头盔,小巧身躯,展示于吸塑包装中,产品摄影,柔和影棚灯光,粉彩背景

3D chibi astronaut figure with glossy vinyl toy finish displayed in a blister pack

风格化 3D 动画与柔和绘本风 Q 版形象

Two softer variants sit between flat 2D and hard toy generations. For the stylized 3D animation look, use "stylized 3D character, soft rounded features, big expressive eyes, cinematic soft lighting, subsurface skin glow." For the soft hand-painted storybook look, use "watercolor cel-shaded, soft painterly textures, warm natural lighting, gentle color palette." Both keep chibi proportions but trade the plastic sheen for warmth, which suits storybook illustration and YouTube thumbnails aimed at family audiences.

Side-by-side comparison of stylized 3D animation chibi and watercolor storybook chibi in the same pose

常见的 Q 版提示词错误(及修正方法)

Q 版效果不佳的情况大多源于三种失误,每一种都能追溯到缺失或矛盾的关键词。

比例夸张得不够。 模型生成了一个普通的动漫角色。原因:对某些模型来说,仅凭「chibi」这个信号太弱了。解决方法:加上「super deformed, oversized head, tiny body, 2 heads tall」,并删除任何全身写实类提示,比如「full figure portrait」。

眼睛太小或太锐利。 这张脸看起来像成人动漫,而不是可爱风。原因:没有明确指定眼睛方向,模型便默认套用了它的基础风格。解决办法:加上 “huge round sparkling eyes, tiny nose, simplified facial features”。

写实细节破坏了卡通感。 能看到明显的皮肤毛孔、根根分明的手指、织物纹理。原因:"photorealistic"、"8k photo" 或 "detailed skin" 之类的词从复用的 prompt 里混了进来。解决方法:删掉写实类关键词,加上 "smooth simplified shapes, minimal detail",并把写实类词汇移到负面 prompt 里。

冲突的关键词往往会导致修复失败。「写实风 Q 版」是在要求模型同时满足两种互不相容的效果;只选一个。

打造干净 Q 版画面的反向 prompt

负向 prompt 用来告诉模型要排除哪些元素,对于 Q 版创作来说它已经完成了一半的工作。以下是标准排除清单:

写实比例、写实解剖、扭曲的面部、多余肢体、多余手指、身体过长、头部过小、照片级写实皮肤、文字、水印、签名

具体在哪里输入取决于工具。包括 OpenArt 在内的 Stable Diffusion 界面都提供了单独的负面 prompt 输入框。Midjourney 则使用行内的 --no 参数,例如 --no realistic proportions, text。ChatGPT 和 Gemini 支持自然语言:可以在 prompt 中写上「避免不真实的比例、扭曲的面部、多余的肢体,以及任何文字或水印」这样一句话。

“文字瑕疵”之所以榜上有名,是因为风格化生成可能会在背景里冒出多余的字符。排除文字能让贴纸集和肖像画保持干净;若你想要刻意添加文字,之后在编辑器里加即可。

人脸保留:将真实照片变成 Q 版形象

使用图生图功能可以更好地保留特定人物的面部特征。该工作流以你的照片作为结构起点,而非随机噪点。OpenArt 的 图像生成器 直接支持这一工作流:上传照片,用上面的公式写一段 Q 版 prompt,然后生成即可。

参考图能为模型提供更多面部结构、发型、脸型和表情信息,让它更好地还原到 chibi 版本中。

若需重复使用同一个人物,请通过以下方式保存 角色构建器。它能从一张参考图构建出持久稳定的角色,并支持各种类型的角色,不只是人类。保存的角色会存放在你的素材库中,可通过以下方式加入到未来的 prompt 里 @Character 标签,帮助你在保持身份一致的同时更换服装和姿势。

跨 AI 工具的 Chibi 提示词

这套公式和关键词能通用于所有主流生成器,但它们周围的语法却各不相同。别急着照搬教程,先确认当前的模型名称——不少主流工具在 2025 年和 2026 年都更换了默认模型。下面来看同一个 Q 版 prompt 如何针对不同工具进行调整:

工具 适合 Chibi 风格的模型 风格语法 负面 prompt
Midjourney Niji 7(动漫风格调优,2026 年 1 月发布);默认 V8.1 --niji 7, --sref [URL], --oref [URL], --ar 9:16 内嵌 --no
ChatGPT GPT-4o 原生图像生成(自 2025 年 3 月起为默认模型) 仅需自然语言 自然语言(“避免……”)
Gemini Gemini 2.5 Flash Image;Gemini 3 图像模型 仅需自然语言 自然语言
DALL-E DALL·E 3 不再作为 ChatGPT 默认模型,可通过专属的 DALL·E GPT 使用 自然语言 自然语言
Stable Diffusion SDXL、SD 3.5、FLUX 检查点 (chibi:1.4) 权重, <lora:name:0.8> 标签 独立的负向提示字段

Midjourney 的 Niji 系列是唯一专为动漫和东方美学调校的模型,因此是制作 2D Q 版形象最强的单模型选择。ChatGPT 和 Gemini 则用对话式微调替代参数控制;你只需回复「把头画大一点」就能迭代,而不用去调权重。

Stable Diffusion 通过 prompt 权重、社区 Q 版 LoRA 和 ControlNet 提供最强的控制力,代价是使用复杂。与其押注单一引擎, OpenArt 汇聚了 100+ 个模型,包括 Nano Banana、GPT image、Seedream、Grok Imagine、Wan 2.7 Image 等,你可以用同一条 chibi prompt 在多个模型间运行,选出效果最好的那一个。这也正是为什么在大多数创意工作中,多模型工作流优于死守单一模型的原因。

按用途分类的 Chibi 提示词模板(复制即用)

下面每个模板都可直接粘贴使用;只需把描述性特征替换成你自己的主体即可。

单人肖像,标准的头像或个人资料图转换

一位留着波浪棕发、戴眼镜的年轻女子的 Q 版肖像,头大身小,闪亮的大眼睛,可爱动漫风,超级变形,纯淡蓝色背景,柔和光线,高细节

Chibi girl with oversized round head and tiny body generated from the five-slot prompt formula, kawaii style, pastel pink background

情侣,用于周年纪念礼物和双人主页头像

两个 chibi 角色手牵手,一个是短黑发的男生,一个是金色马尾的女生,都是大头小身子,配着同样夸张而灵动的大眼睛,kawaii 风格,超级变形,柔和粉彩渐变背景,柔光,高细节

Chibi girl with oversized round head and tiny body generated from the five-slot prompt formula, kawaii style, pastel pink background

合影,适用于团队头像与全家福

四个 chibi 好友并排站成一排,每人都有超大的头、小小的身体,以及各具特色的发型和服装,kawaii 动漫风格,超级变形,简约粉彩背景,柔和均匀的光线,高细节,面部无重叠

Chibi girl with oversized round head and tiny body generated from the five-slot prompt formula, kawaii style, pastel pink background

贴纸拼贴,用于表情包和可打印的贴纸表

同一个粉色双丸子头女孩的六个 Q 版形象贴纸表,展现不同情绪:开心、哭泣、生气、困倦、惊讶、大笑,平涂色彩,赛璐璐上色,每个角色周围有厚厚的白色贴纸描边,手绘涂鸦点缀,白色背景

Chibi girl with oversized round head and tiny body generated from the five-slot prompt formula, kawaii style, pastel pink background

YouTube 缩略图制作工具

面部在什么场景下最见效: vidIQ 对 2026 年发布的 500 个爆款缩略图的研究 发现有 69% 使用了真人面孔,在表现最突出的头部内容中更是高达 80%。不过面孔并非万能杠杆;Hooksnap 的 2026 年点击率基准分析 发现除了音乐类和部分教育类之外,在几乎所有细分领域,富有表现力的面部缩略图都优于无脸缩略图,因此请把具体的提升幅度看作因领域而异,而非一个固定数字:

Q版 YouTuber 张着嘴一脸兴奋地指向发光的文字区域,超大的脑袋占据画面左侧三分之一,眼睛又大又生动,浓烈的赛璐璐渲染风格,鲜艳饱和的背景配以放射状速度线,16:9 构图,高细节

Chibi girl with oversized round head and tiny body generated from the five-slot prompt formula, kawaii style, pastel pink background

让 Q 版角色跨次生成保持一致

想保持一致性,请使用参考图、已保存的角色或 LoRA 训练。Midjourney 官方文档也指出,seed 在不同的 prompt 会话之间可能表现得难以预测,并不适合用来锁定某种风格、角色或外貌。seed 只会复现完全相同的设置;一旦改动 prompt,角色也会随之改变。

真正有效的工具:

  • 风格与角色参考: 在 Midjourney 中, --sref 锁定艺术风格,而 --oref (Omni Reference,V7 及更高版本)可在新 prompt 之间锁定角色。
  • 角色设定图: 生成一张多姿势参考图("chibi character turnaround, front view, side view, back view, expression chart"),并将其作为参考图用于后续每次生成。
  • LoRA 训练: 如果要制作可复用的系列作品或周边商品,不妨训练一个自定义模型。OpenArt 的 LoRA 训练支持 4 到 128 张参考图,5 到 15 分钟即可完成,涵盖风格、角色、面部和物体等类型,并会永久保存模型,方便你通过标签随时复用。
  • 角色生成器: 当你只有一张理想参考图时最快捷的方式,具体见上文的面部保留部分。

对于要在数十项素材中打造 Q 版吉祥物的对客工作室来说,LoRA 加已保存角色是生产级的黄金组合:LoRA 锁定艺术风格,角色标签锁定身份。

为社交媒体调整 Q 版插画格式

直接按目标比例生成,而不是事后裁剪,因为 Q 版构图以头部为中心,草率裁剪会把头切掉。以下是官方文档中的平台规格:

  • Instagram Stories 和 Reels: 9:16 比例,Stories 推荐 1080 x 1920 像素。在 prompt 中加入"9:16 vertical composition, character centered in lower two-thirds",让头部避开个人资料 UI 叠加层。
  • Pinterest 标准 Pin: 2:3 比例,1000 x 1500 像素。搭配柔和背景的竖版 Q 版肖像无需调整即可契合该格式。
  • YouTube 缩略图: 16:9,广告缩略图最低 1280 x 640,创作者上传现推荐使用 3840 x 2160。先生成宽幅,再放大。

贴纸表需要单独的排版处理:拼贴模板中的白色贴纸描边可兼作按需印刷导出时的裁切线。

如何在 OpenArt 中生成 Q 版插画(分步教程)

完整的照片转 Q 版流程都在 OpenArt 的 图像生成器 只需五步:

  1. 上传一张参考照片或输入一段文字 prompt。
    一张光线均匀、正面清晰的照片能为模型提供最多的面部信息,从而更好地保留相似度。
  2. 套用公式和关键词。
    填满全部五个部分:带比例暗示的主体、风格修饰("kawaii, super deformed")、背景、光照和成品效果。从上文的 2D、3D 玩具或风格化动画词组中挑选你的成品效果关键词。
  3. 切换到图生图模式以保留面部。
    使用参考照片,让相似度优先于风格转换。
  4. 添加负面 prompt,然后生成。
    把负面 prompt 部分的排除清单粘贴到专用字段,然后运行生成。
  5. 导出或优化。
    用局部重绘修好一只手或一只眼睛,无需重新生成整张图,然后在导出用于打印或缩略图前放大到 4K。

更佳效果的小贴士:

  • 用两三个不同的模型运行同一个 prompt;Q 版生成的质量因模型而异,差别比措辞的影响更大。
  • 每条 prompt 生成多个变体供你挑选,而不是死磕单张作品。
  • 参考照片要保持简洁;杂乱的背景会渗入风格化结果中。
  • 结束会话前,用 Character Builder 保存你打算复用的任何角色。

高级套餐支持商用。你生成的一切内容,包括贴纸包和训练好的模型,都归你所有,可作为周边商品出售或用于客户项目交付,无需支付版税或署名。请查看 最新定价页面 了解套餐详情,因为 credits 和定价档位会随时间变化。

常见问题

最好用的 Q 版风格 prompt 关键词有哪些?
"Super deformed"、"kawaii"、"大头"、"小身体"和"夸张的大眼睛"是核心的比例触发词,再加上像"cel-shaded"(2D)或"vinyl toy finish"(3D)这样的质感描述词。

我应该如何构建 Q 版 prompt?
五个部分:主体、风格修饰、背景、光照、成品效果。本文中的每个模板都遵循这一顺序。

哪款 AI 工具最适合做 Q 版画?
Midjourney 的 Niji 7 是唯一针对二次元调优的模型,Stable Diffusion 通过 LoRA 和权重提供最深度的控制,而 OpenArt 让你用一条 prompt 跑遍 100+ 个模型,无需绑定单一引擎。

如何在不丢失面部特征的情况下把照片变成 Q 版?
使用图生图模式,将照片作为参考,然后在此基础上应用 Q 版 prompt。纯文本 prompt 无法复现特定的某个人。

2D、3D 和风格化动画 Q 版有什么区别?
2D 平面风格采用赛璐璐渲染和纯色,适合做贴纸;3D 玩具风格呈现光泽感的乙烯基手办质感;风格化动画 Q 版保留 Q 版比例并搭配柔和的电影级 3D 光照,而绘本变体则换用水彩质感。

我应该使用哪些负面 prompt?
排除写实比例、扭曲的脸、多余的肢体、多余的手指、写实皮肤,以及文字或水印瑕疵。

如何在多张图像中保持同一个 Q 版角色?
将角色保存到永久角色库,或用 4 到 128 张参考图训练一个 LoRA。参考图和已保存的角色能在 prompt 改变后依然锁定角色身份。

如何为情侣或群体调整 prompt?
给每个人赋予独特且具名的特征(发型、服装、表情),说明所有角色共享大头比例,并将人数控制在四到五个以内,以避免面部错误。

为什么我的 Q 版角色还是像普通动漫角色?
比例信号太弱。请添加 "super deformed, 2 heads tall",并去掉 prompt 中残留的写实相关描述。

为什么会出现多余的肢体或错乱的文字?
两者都是常见的生成瑕疵,都应放进你的负面 prompt:"extra limbs, extra fingers, text, watermark"。

创作无极限

加入数百万创作者的行列,用 OpenArt 生成图像、视频、角色和故事——全都在一个平台上完成。

免费开始使用 →