你刷朋友圈时,有没有见过这样的图——把自己变成吉卜力动画里的角色,或是做成精致的Q版手办,又或是穿越到电影海报里?这些令人惊艳的AI图片,很可能就是用 ChatGPT-4o 生成的。

很多人觉得“AI生图就是随便说句话的事”,结果自己一试,出来的图跟想象的差了十万八千里。其实问题不在于模型,而在于你和AI之间,差了一份“说清楚”的能力。本文就带你系统掌握 ChatGPT-4o 的提示词技巧,从“随手一试”进阶到“精准出图”。


一、ChatGPT-4o 生图:有什么不一样?

ChatGPT-4o 的“o”代表“omni”(全能),它最大的特点是原生多模态——文字、图像、声音的理解和生成是打通的,不需要像以前那样在背后拼接多个模型。这意味着:

  • 理解更精准:你能用日常语言描述画面,它不会轻易“跑偏”。

  • 风格转换极强:上传一张照片,输入“转换成吉卜力风格”,几分钟就能出图。

  • 文字渲染提升:以前AI图里的文字基本是“天书”,现在 ChatGPT-4o 已经能生成中文,虽然偶尔还有错字。

免费 vs 付费:免费用户每天可生成 2-5 张图片,Plus 会员(每月20美元)基本不受限制。


二、提示词到底该怎么写?先搞懂基本结构

新手最容易犯的错,就是扔一句大白话给AI:“一个女孩在海边”。这句话不是错,是太“空”——海边什么样?女孩长什么样?什么画风?AI全得自己猜,结果大概率不是你要的。

一个实用的提示词公式:

主体 → 细节 → 环境/背景 → 风格 → 光影 → 构图/镜头

拿“一个女孩在海边”改造一下:

一个短发女孩,穿米色针织衫,坐在海边礁石上,侧脸看向远处,黄昏暖光,胶片质感,浅景深,半身构图。

拆开看:主体是“短发女孩”,细节是“米色针织衫”“侧脸看向远处”,环境是“海边礁石”,风格是“胶片质感”,光影是“黄昏暖光”,构图是“半身”“浅景深”。每一块都在收窄AI的“猜测范围”。

还有一个关键:顺序就是权重。大多数文生图工具里,越靠前的词权重越高。核心主体一定要往前放,别把“这是个女孩”埋在十来个画质词后面。


三、进阶技巧:让AI“听懂”你的要求

1. 正向词 + 负向词,双管齐下

很多人只知道写“我要什么”,却不知道还能写“我不要什么”。

  • 正向词(Positive Prompt):描述你想要的画面。

  • 负向词(Negative Prompt):描述你不想要的东西。比如“多余的手指、畸形的手、扭曲的脸、低分辨率、杂乱背景”——能有效压制AI出图时的“翻车”问题。

2. 细分维度,逐一定制

提示词可以从多个维度“精雕细琢”,每个维度的不同描述,都会带来完全不同的画面:

维度粗糙描述精细描述
主体“一只狗”“一只蓝眼睛的西伯利亚雪橇犬,毛茸茸的白色皮毛”
风格“一座城堡”“一座中世纪城堡,水墨画风格,留白意境”
光照“一片森林”“晨曦中的森林,雾气缭绕,丁达尔效应”
构图“一个女孩”“女孩面部特写,对称构图,浅景深,直视镜头”

每一个词都像是给AI画师的精确指令,越具体,画面越接近你的想象。


四、直接抄作业:5类实用提示词示例

1. 风格转换类(一键变身)

最简单的一类——上传一张照片,输入风格指令即可。

text

请将这张照片转换成吉卜力风格。

注意:直接说“吉卜力”有时会触发版权限制,可以用“吉卜力工作室风格”或“参考这张图的风格来绘制”。

热门风格替换词:像素风格、迪士尼风格、辛普森风格、史努比风格、蜡笔小新风格。

2. Q版形象/手办类

把真人变成3D Q版玩偶或手办,最近特别火:

text

创建一个可爱的3D Q版卡通形象,基于上传的照片。将面部和姿势转化为柔软、简化的玩具造型,硅胶质感,柔和色彩,白色背景,产品摄影风格。

还可以指定用途:“生成3D Q版汽车摆件,带黄色弹簧底座”。

3. 超现实创意类

这类提示词考验“脑洞”,效果往往最惊艳:

微型立体场景(移轴摄影效果):

text

微型立体场景呈现,运用移轴摄影的技法,呈现出Q版「孙悟空三打白骨精」场景。

毛绒emoji:

text

将一个平面emoji转化为柔软、立体、毛茸茸的可爱物体,浓密毛发覆盖,柔和的阴影,居中悬浮于浅灰色背景,摄影棚级灯光。

传送门穿越(需上传照片):

text

照片中角色的3D Q版形象穿过传送门,牵着观众的手。传送门外是现实世界(书房、显示器),传送门内是角色所在的世界。第三人称视角,3:2比例。
4. 带文字的海报/漫画类

ChatGPT-4o 已经能生成带中文的图片:

text

把以下内容制作成漫画,使用繁体中文。

目前中文字体偶尔会有错字,英文更稳定。

5. 产品/广告摄影类

把任何物体变成特定材质的“产品图”:

木制建筑模型(以埃菲尔铁塔为例):

text

create architectural model: minimalist wooden architectural scale model, object: Eiffel Tower, material: light beige wood, base: square wooden platform with cork surface, soft ambient lighting, neutral backdrop, eye-level angle, high quality render.


五、常见“翻车”与破解

问题原因破解方法
生成失败,提示“违反内容政策”风格名触发了版权限制(如“宫崎骏”)改用“吉卜力工作室风格”或“参考风格图片”来绘制
画面不是想要的提示词太笼统按“主体→细节→环境→风格→光影→构图”逐一补充
中文字歪歪扭扭AI对中文渲染仍有局限先写英文,或用更清晰的字体描述
生成时间太长高峰期限流保持页面不退出,耐心等待

结语:AI不会读心,但你可以“说清楚”

AI文生图的本质,是一场用文字指挥视觉创作的游戏。模型不会读心,它只能根据你给的文字去“猜”你脑子里的画面。你给的信息越精确,它猜得越准。

下次使用 ChatGPT-4o 时,不妨多花30秒,把你的提示词从“一个女孩”升级为“一个短发女孩,坐在海边礁石上,黄昏暖光,胶片质感”。你会发现,AI的“画技”其实一直都在线,只是你还没有学会怎么“指挥”它而已。

Logo

有“AI”的1024 = 2048,欢迎大家加入2048 AI社区

更多推荐