文字之外,图片和视频是更高带宽的表达。AI 让普通人也能做出封面图、配图和短视频。关键同样是:把你要的画面讲清楚,并接受这是一个要多次迭代的过程,而不是一句话出片。
- 把「画面」讲清楚:主体、场景、风格、构图、色调、用途。
- 用「保留 X,改变 Y」迭代,并会用逆向提示词把好图变成起点。
- 理解视频是「脚本→分镜→画面→配音→剪辑」的流水线。
- 按任务选工具、用免费额度控成本,视频作为进阶。
把「画面」讲清楚
图像和视频生成同样吃上下文。描述要包含:主体、场景、风格、构图、色调、用途。越具体,AI 越不容易给你一张「好看但不对」的图。先说清楚这张图用在哪(公众号封面 / 海报 / 头像),尺寸和重点自然就定了。
和写文章一样,AI 是辅助、不是全自动:图片可以文生图、风格迁移、批量出图,但要不要用、用哪张,仍由你决定;平台也会打击纯靠 AI 的低质内容。
六个要素讲清楚:主体、场景、风格、构图、色调、用途。先定用途,尺寸和重点就跟着定了。
迭代而不是一次成图
第一版往往不对,这很正常。用「保留 X,改变 Y」的方式逐步逼近,而不是每次都重写整段描述:保留构图、只调色调;保留风格、只换主体。
对生成结果做截图标注,把要改的地方直接圈出来指给它,比抽象地说「再好看点」有效得多——这和 AI 编程里的「截图标注」是同一个动作。
逆向提示词:拿好图反推 prompt
如果你看到一张很喜欢、却不知道怎么做出来的图,可以用「逆向提示词」:把这张成品丢给 AI,让它反推「当初大概用什么 prompt、什么要求,才能生成这样的结果」。
就好像别人端上一道好菜,你不知道怎么做、用了什么食材,就让 AI 把「菜谱」写出来,以后照着做。拿到反推的 prompt 后,再在它的基础上改主体、改文字,比从零硬试快得多。
视频是一条流水线:脚本→分镜→画面→配音→剪辑
视频不是一句话出片,而是一条链:先有脚本,再拆分镜,然后生成画面、配音,最后剪辑成片。每个环节用对工具——画面用即梦或可灵生成,剪辑用剪映——别指望一个工具从头包到尾。
做视频对标一定要去视频平台找(抖音、视频号、YouTube),不要去图文平台找感觉,两者完全是两回事。重点看近 7 天的高赞视频前 3 秒怎么开头、中间什么节奏、结尾怎么引导。
选对工具,控好成本
不同任务用不同工具:图片用即梦,视频用即梦 Seedance 或可灵,剪辑用剪映。先用免费额度体验,确认顺手再考虑付费(即梦 Seedance 基础会员约 69 元/月)。
多模态生成往往按次或按时长计费,先把图文表达跑通,视频作为进阶,避免一上来就反复重试、空转烧掉额度。
用 AI 做一张能用的公众号封面图,从描述到迭代定稿。
- 1
先定用途和尺寸
想清楚用在哪(公众号封面,横版 16:9),重点和留白就定了。
- 2
把画面讲清楚
写明主体、场景、风格、构图、色调,越具体命中率越高。
- 3
用逆向提示词找起点
找一张你喜欢的同类封面,让 AI 反推它大概的 prompt,作为你的起点。
- 4
用「保留 X 改 Y」迭代
第一版不对,只改一处(比如换背景色),保留构图和人物等对的部分。
- 5
截图标注定稿
把要改的地方在图上圈出来反馈,比抽象说「再好看点」有效。
实战示例
错误示例
帮我画一张好看的封面图。
正确示例
做一张公众号封面(横版 16:9),主体是一个人在笔记本前学习,极简扁平风,主色青绿,留出右上角放标题,整体干净不花哨。
主体、场景、风格、构图、色调、用途都给到,命中率才高。
错误示例
(凭空想象描述,反复试了十几版都不对)
正确示例
找一张我喜欢的同类封面,让 AI 反推它大概用什么 prompt,再在这个基础上改主体和文字。
逆向提示词把别人的好结果变成你的起点,比从零硬试快得多。
错误示例
(不满意就整段重写描述,反复推翻)
正确示例
保留这版的构图和人物,只把背景换成浅米色、再增加一点暖光。
用「保留 X 改 Y」迭代,比每次推翻重来快得多。
即梦 AI
有免费额度;Seedance 基础会员约 69 元/月用途:图片生成;视频用其 Seedance
先用免费额度体验
可灵 AI
有免费额度,按次/按时长计费用途:AI 视频生成
视频作为进阶,注意别空转烧额度
剪映
基础免费用途:视频剪辑与字幕
把生成的画面剪成成片
Nano Banana
有免费额度用途:图像生成与编辑的备选
按需在图像工具间选用
常见误区
- 只说「好看」「高级」,不给主体、风格、用途,结果全靠运气。
- 每次不满意就整段重写,推翻之前对的部分,原地打转。
- 从零硬试,不会用逆向提示词把一张好图变成起点。
- 忽略用途和尺寸,生成的图放进实际场景比例不对。
- 做视频对标却跑去图文平台找感觉,方向完全不对。
- 一上来追求视频大片,反复重试烧光额度也没产出可用成品。
为什么我生成的图总是「好看但不对」?
多半是描述太空。补上主体、场景、风格、构图、色调、用途六个要素,AI 才不靠运气。
怎么快速达到某张图的效果?
用逆向提示词:把那张你喜欢的图丢给 AI,让它反推大概的 prompt,作为起点,再在上面改主体和文字。
不满意要不要整段重写?
不要。用「保留 X、只改 Y」逐步逼近,推翻重来会把之前对的部分也丢掉,原地打转。
一开始就做视频划算吗?
先把图文加封面跑通。视频是脚本→分镜→画面→剪辑的流水线,且按次或按时长计费,作为进阶更稳,避免一上来烧光额度。
本章小结
- 图像视频同样吃上下文:主体、场景、风格、构图、色调、用途讲清楚。
- 用「保留 X 改 Y」逐步迭代,截图标注比抽象的「再好看点」有效。
- 逆向提示词:拿一张好图让 AI 反推 prompt,当你的起点。
- 视频是「脚本→分镜→画面→配音→剪辑」的流水线,对标去视频平台找。
- 按任务选工具(即梦/可灵/剪映),先用免费额度。
- 先跑通图文加封面,视频作为进阶,别空转烧额度。
- 多模态
- 文字、图像、音频、视频等多种形态的生成与理解,让表达不止于文字。
- 迭代式生成
- 用「保留某部分、只改某部分」的方式逐步逼近目标,而非一次成图。
- 逆向提示词
- 把现成的好图丢给 AI,让它反推出当初的 prompt,作为你的创作起点。
- 用途先行
- 先确定图/视频用在哪,再决定尺寸、构图和重点,命中率更高。
- 视频流水线
- 视频不是一句话出片,而是脚本→分镜→画面→配音→剪辑的链条,每环用对工具。
- 按量计费
- 多模态生成常按次或按时长计费,注意别反复重试空转烧额度。