Sora 2 提示词指南:Sora 2 怎么用、prompt 怎么写(2026)
Sora 2 能把一段大白话变成带运镜、对白和音效的成片,但“平庸出片”和“电影感出片”之间的差距,几乎全写在 prompt 里。这篇攻略的每张截图都来自两支实测视频:Noble Goose 的 Sora 2 提示词教程在 Sora 里从简单到进阶连写三条 prompt;Artlist 的工作流视频则把 OpenAI 官方的 Sora 2 Prompting Guide 喂给 ChatGPT,最后用 Artlist 生成器里的 Sora 2 Pro 出片。你会学到好 prompt 通用的三段式公式——场景意图、分镜构成、光影与基调;学会用时间戳或 cut(分镜切分)逐秒指挥镜头,搞清对白和音效该写在哪个位置;还会学到怎么让 ChatGPT 替你把带时间码的 prompt 写出来。后半部分走完整生成流程:粘贴 prompt、选 Sora 2 Pro、设 16:9、12 秒、1080p,为图生视频准备参考图,再判断出的片子行不行。请对瑕疵有心理预期——同一条 prompt 永远不会出两条一样的片子,源视频里的最终镜头也是改了好几轮才落地。照下面 16 步走一遍,视频里的每条 prompt 和每个结果你都能自己复刻。
来源与致谢
本教程的截图来自 Noble Goose 的公开演示视频。每个步骤都链接到视频中的对应时间点,方便你对照学习。
Noble Goose ↗写提示词:三段式公式
- 1
开头写场景意图,而不是只写主体
好的 Sora 2 prompt 都以一到三句场景意图开头——你是在给摄影指导讲戏,不是在填搜索框。教程里的示范先点风格,再给主体和场景:“High-quality 2D anime film style, cinematic realism. A samurai woman with long white hair walks slowly along a coastal path beside the ocean... creating a calm yet powerful atmosphere.”风格、人物、地点、氛围按这个顺序交代清楚,后面再指挥镜头时 Sora 才有完整的底子。

场景意图先行:三句话写清风格、主体、场景和氛围。视频 2:07 处 - 2
用时间戳指挥开场这一拍
分镜构成就是你指挥镜头的地方。Sora 2 支持时间戳控制,一段 “[00:00-00:03] The woman continues walking slowly forward along the path. The camera follows smoothly behind her at waist height” 把前三秒的内容规定得死死的——风吹起红色斗篷、花瓣从脚边飘过都写了出来。Sora 生成免费版 10 秒、Pro 版 12 秒,把总时长切成三到四拍来安排。

开头三秒,逐行写清楚。视频 2:44 处 - 3
每个时间段配一种运镜
时间戳接着写,运镜一段一换。下一拍写着 “[00:03-00:06] The camera transitions to a low side angle as she slows her pace”——低角度侧面跟随,手抚过木栅栏,落叶从路上翻滚而过。一个时间戳就是一个镜头:景别、机位、调度全写在方括号里,Sora 就不会把整条片子拖成一个呆板的长镜头。

一个时间戳一个镜头决策——这里是低角度侧拍。视频 2:46 处 - 4
对白写进它被说出口的那一拍
台词要放进它发生的时间戳里。教程第三拍写着 “[00:06-00:09] The camera moves closer into a medium shot... She whispers quietly, 'I'll return someday'”——这句耳语以蓝色高亮,正好落在中景推近的位置。把台词放在你想听到它的时刻,Sora 会把口型和语气同步到那一刻,而不是自己乱猜。

对白写在 00:06-00:09 这一拍里,而不是堆在 prompt 开头。视频 2:54 处 - 5
换用 cut 写法,音效放进它所在的 cut
Sora 2 也支持 cut 写法——Cut 1、Cut 2、Cut 3,切分点由模型自己掌握。音效遵循同样的落位规则:教程把 “a distant ship horn sounds once, deep and resonant” 直接写进 Cut 2、紧挨着海浪拍岸,因为声音就该在这一刻出现。环境音留给最后的光影基调段;具体的音效跟着画面走。

Cut 2 同时装下了浪花和那一声船笛。视频 6:06 处 - 6
结尾补一段光影与基调
每条 prompt 都用一段话收尾,定死整条片子的观感:光线、色调、氛围、情绪。教程的收尾是 “The lighting is warm and cinematic, with late-afternoon sunlight glinting off the ocean surface. The sound of distant waves and wind completes the tranquil, reflective feeling of the scene”——把前面的镜头缝在一起,顺便把背景声也定了。golden hour、soft shadows 这类词就在这里发挥价值。

最后一段定调色,也定背景声。视频 4:28 处
让 ChatGPT 替你写:先喂官方提示指南
- 7
从 OpenAI 官方 Sora 2 提示指南起步
这些规则不用背。OpenAI 在 cookbook 站点发布了官方的 Sora 2 Prompting Guide,讲的正是同一套东西:精确的主体、机位设置、光影与调色、动作节拍、基调与情绪。Artlist 视频里的每条 prompt 都以它为底——而且它当作 ChatGPT 的训练材料来用效果更好,见下一步。

让 ChatGPT 替你读完官方指南。视频 2:16 处 - 8
一句话把指南喂给 ChatGPT
把 cookbook 链接粘进 ChatGPT,加一句 “analyze this page ... and use it to build prompts for sora 2”。模型读完官方指南、提炼出关键模式,之后写出的 prompt 就是 Sora 自己的词汇体系——分镜脚本式节拍、每个镜头一个明确主体、API 参数写在正文之外。这是一次性的设置,之后每条片子都能复用。

一句话,把 ChatGPT 变成 Sora 2 提示词写手。视频 2:32 处 - 9
像导演一样下需求,别当打字员
接下来用大白话描述你想要的片子:“Create a 12 second Sora 2 prompt that will result in a super cinematic scene of a man flying over a field, similar to these photos. It should start with the man walking in the field and then start hovering and finally fly.”。参考图能免费补充大量上下文,ChatGPT 还会主动提供加料选项,比如拆成 ride-stop-stand 三段、便于单独剪辑的 3-shot storyboard 版本。

ChatGPT 懂格式之后,三句话的需求就够用。视频 3:20 处 - 10
拿回一份可以手动修改的时间码 prompt
交回来的是一份拍摄文档:开头是 “duration: 12s, aspect_ratio: 2.39:1, style: ultra-cinematic photoreal, dusk palette”,接着是锁定你参考照片的人物设定,然后是带时间码的节拍——0.0-2.5s 建立行走的建立镜头,2.5-3.5s 过渡悬停,3.5-11.5s 飞行,细到镜头焦段。任何一拍都可以手动改:故事是你拍板的,ChatGPT 只是替你把术语敲出来。

时长、调色、人物锁定、每一拍,全部预先结构化。视频 3:44 处
开始生成:从输入框到成片
- 11
粘进生成器,选 Sora 2 Pro、12 秒、1080p
教程用的生成器是 Artlist——它同时托管 Sora 2 和 Sora 2 Pro,旁边还有 Veo、Kling 等模型。把 prompt 粘进去,模型选 Sora 2 Pro,再设 16:9、12 秒、1080p,点 Generate。这几项设置和 prompt 开头一一对应,时间码才能落在你规划的帧上。OpenAI 自家的 Sora 应用里也是同样一套“粘贴-配置-生成”流程。

Sora 2 Pro 已选中,12 秒 1080p,随时可以生成。视频 4:32 处 - 12
先做一张参考图,再玩图生视频
图生视频比纯文字更可控,因为模型会从静帧继承人物、服装和画风。在同一个工具面板的图片标签里先生成一张,再用一句指令精修:“place this character on a futuristic motorcycle, riding through a dystopian barren land, motion blur to emphasize speed, full body, wide shot”。这张改好的静帧,就是你的 prompt 要指挥的第一帧。

参考静帧就是半个 prompt——人物和画风白送。视频 6:24 处 - 13
图生视频的节拍,写静帧“之后”的事
从图片开始 prompt,动词要换。不用再描述画面里有什么——静帧已经说明了一切——要写的是接下来发生什么:“[00:00-00:03] The woman gently shifts her weight, then begins walking a few slow steps toward the fence. The camera holds roughly the same composition, tracking slightly forward.”。开场这一拍让主体从静止进入运动,同时构图保持不动。

从静到动:第一拍让她走起来。视频 8:51 处
看结果,然后精修
- 14
对照你写的节拍来验片
成片就是需求逐拍兑现:男人走过黄昏的麦田,悬停,最后贴着麦浪低飞,镜头一路跟随。验自己的片子也用同一套方法——每个时间戳交出它该有的镜头了吗?即便是这条完成度的 prompt,源视频里也重新生成了好几轮,所以第一次出片请当成草稿,而不是失败。

飞行这一拍兑现了:黄昏,贴着麦浪低飞。视频 4:40 处 - 15
Sora 2 能演对白戏,不止能出空镜
同一套公式还能“演戏”。源视频的对白 demo——两个人、一盏落地灯的公寓、一句 “You think an apology fixes everything?”——展示了 Sora 2 在单条镜头里同时处理对话、情绪和调度。按时间戳和 cut 示例的方法写清谁在说、这句话是什么情绪,场景就会照着演。

对白、调度、氛围,来自一条结构化 prompt。视频 1:36 处 - 16
用 shot-by-shot remix 请求精修
结果接近但不满意时,在同一个对话里接着改:“I need a 12 second sora 2 sequence of this character, riding a futuristic grungy motorcycle... natural motion blur, tracking shot with natural camera shake”。ChatGPT 会主动给出 shot-by-shot remix 版本,而你给的具体意见——再快点、停稳一点、镜头环绕——都会融进下一条 prompt。同一条 prompt 永远不会出两条一样的片子,所以先重新生成,再考虑重写。

用精准的 remix 请求缩小差距,而不是整条重写。视频 6:40 处

