Sora 2 提示词指南:Sora 2 怎么用、prompt 怎么写(2026)

Sora 2 能把一段大白话变成带运镜、对白和音效的成片,但“平庸出片”和“电影感出片”之间的差距,几乎全写在 prompt 里。这篇攻略的每张截图都来自两支实测视频:Noble Goose 的 Sora 2 提示词教程在 Sora 里从简单到进阶连写三条 prompt;Artlist 的工作流视频则把 OpenAI 官方的 Sora 2 Prompting Guide 喂给 ChatGPT,最后用 Artlist 生成器里的 Sora 2 Pro 出片。你会学到好 prompt 通用的三段式公式——场景意图、分镜构成、光影与基调;学会用时间戳或 cut(分镜切分)逐秒指挥镜头,搞清对白和音效该写在哪个位置;还会学到怎么让 ChatGPT 替你把带时间码的 prompt 写出来。后半部分走完整生成流程:粘贴 prompt、选 Sora 2 Pro、设 16:9、12 秒、1080p,为图生视频准备参考图,再判断出的片子行不行。请对瑕疵有心理预期——同一条 prompt 永远不会出两条一样的片子,源视频里的最终镜头也是改了好几轮才落地。照下面 16 步走一遍,视频里的每条 prompt 和每个结果你都能自己复刻。

来源与致谢

本教程的截图来自 Noble Goose 的公开演示视频。每个步骤都链接到视频中的对应时间点,方便你对照学习。

Noble Goose ↗

写提示词:三段式公式

  1. 1

    开头写场景意图,而不是只写主体

    好的 Sora 2 prompt 都以一到三句场景意图开头——你是在给摄影指导讲戏,不是在填搜索框。教程里的示范先点风格,再给主体和场景:“High-quality 2D anime film style, cinematic realism. A samurai woman with long white hair walks slowly along a coastal path beside the ocean... creating a calm yet powerful atmosphere.”风格、人物、地点、氛围按这个顺序交代清楚,后面再指挥镜头时 Sora 才有完整的底子。

    Sora 2 提示词窗口卡片,展示 2D 动漫武士沿海岸小径行走的场景意图,风格与场景短语以蓝色高亮
    场景意图先行:三句话写清风格、主体、场景和氛围。视频 2:07 处
  2. 2

    用时间戳指挥开场这一拍

    分镜构成就是你指挥镜头的地方。Sora 2 支持时间戳控制,一段 “[00:00-00:03] The woman continues walking slowly forward along the path. The camera follows smoothly behind her at waist height” 把前三秒的内容规定得死死的——风吹起红色斗篷、花瓣从脚边飘过都写了出来。Sora 生成免费版 10 秒、Pro 版 12 秒,把总时长切成三到四拍来安排。

    时间轴 prompt 卡片,展示 Sora 2 镜头 00:00 到 00:03 的开场节拍,摄像机在腰部高度跟随武士
    开头三秒,逐行写清楚。视频 2:44 处
  3. 3

    每个时间段配一种运镜

    时间戳接着写,运镜一段一换。下一拍写着 “[00:03-00:06] The camera transitions to a low side angle as she slows her pace”——低角度侧面跟随,手抚过木栅栏,落叶从路上翻滚而过。一个时间戳就是一个镜头:景别、机位、调度全写在方括号里,Sora 就不会把整条片子拖成一个呆板的长镜头。

    Sora 2 提示词卡片,00:03 到 00:06 段落指示在木栅栏旁切换为低角度侧面运镜
    一个时间戳一个镜头决策——这里是低角度侧拍。视频 2:46 处
  4. 4

    对白写进它被说出口的那一拍

    台词要放进它发生的时间戳里。教程第三拍写着 “[00:06-00:09] The camera moves closer into a medium shot... She whispers quietly, 'I'll return someday'”——这句耳语以蓝色高亮,正好落在中景推近的位置。把台词放在你想听到它的时刻,Sora 会把口型和语气同步到那一刻,而不是自己乱猜。

    提示词窗口卡片,00:06 到 00:09 中景镜头,耳语台词 I'll return someday 作为 prompt 内对白高亮显示
    对白写在 00:06-00:09 这一拍里,而不是堆在 prompt 开头。视频 2:54 处
  5. 5

    换用 cut 写法,音效放进它所在的 cut

    Sora 2 也支持 cut 写法——Cut 1、Cut 2、Cut 3,切分点由模型自己掌握。音效遵循同样的落位规则:教程把 “a distant ship horn sounds once, deep and resonant” 直接写进 Cut 2、紧挨着海浪拍岸,因为声音就该在这一刻出现。环境音留给最后的光影基调段;具体的音效跟着画面走。

    Sora 2 cut 式提示词的 Cut 2 段落,指示镜头下摇拍向拍岸的浪花,同时远处传来一声低沉的船笛
    Cut 2 同时装下了浪花和那一声船笛。视频 6:06 处
  6. 6

    结尾补一段光影与基调

    每条 prompt 都用一段话收尾,定死整条片子的观感:光线、色调、氛围、情绪。教程的收尾是 “The lighting is warm and cinematic, with late-afternoon sunlight glinting off the ocean surface. The sound of distant waves and wind completes the tranquil, reflective feeling of the scene”——把前面的镜头缝在一起,顺便把背景声也定了。golden hour、soft shadows 这类词就在这里发挥价值。

    Sora 2 提示词的收尾光影基调段落,写着 warm and cinematic,午后阳光在海面上闪烁
    最后一段定调色,也定背景声。视频 4:28 处

让 ChatGPT 替你写:先喂官方提示指南

  1. 7

    从 OpenAI 官方 Sora 2 提示指南起步

    这些规则不用背。OpenAI 在 cookbook 站点发布了官方的 Sora 2 Prompting Guide,讲的正是同一套东西:精确的主体、机位设置、光影与调色、动作节拍、基调与情绪。Artlist 视频里的每条 prompt 都以它为底——而且它当作 ChatGPT 的训练材料来用效果更好,见下一步。

    ChatGPT 回复确认已阅读官方 Sora 2 Prompting Guide,并把其中的关键模式整理成可直接复制的提示词模板
    让 ChatGPT 替你读完官方指南。视频 2:16 处
  2. 8

    一句话把指南喂给 ChatGPT

    把 cookbook 链接粘进 ChatGPT,加一句 “analyze this page ... and use it to build prompts for sora 2”。模型读完官方指南、提炼出关键模式,之后写出的 prompt 就是 Sora 自己的词汇体系——分镜脚本式节拍、每个镜头一个明确主体、API 参数写在正文之外。这是一次性的设置,之后每条片子都能复用。

    ChatGPT 输入框,输入的指令是分析 OpenAI cookbook 的 sora2 prompting 页面并用它来写 Sora 2 提示词
    一句话,把 ChatGPT 变成 Sora 2 提示词写手。视频 2:32 处
  3. 9

    像导演一样下需求,别当打字员

    接下来用大白话描述你想要的片子:“Create a 12 second Sora 2 prompt that will result in a super cinematic scene of a man flying over a field, similar to these photos. It should start with the man walking in the field and then start hovering and finally fly.”。参考图能免费补充大量上下文,ChatGPT 还会主动提供加料选项,比如拆成 ride-stop-stand 三段、便于单独剪辑的 3-shot storyboard 版本。

    ChatGPT 对话线程,上方提示可以生成 3-shot storyboard 版本,下方正在输入 12 秒飞越田野 Sora 2 提示词的需求
    ChatGPT 懂格式之后,三句话的需求就够用。视频 3:20 处
  4. 10

    拿回一份可以手动修改的时间码 prompt

    交回来的是一份拍摄文档:开头是 “duration: 12s, aspect_ratio: 2.39:1, style: ultra-cinematic photoreal, dusk palette”,接着是锁定你参考照片的人物设定,然后是带时间码的节拍——0.0-2.5s 建立行走的建立镜头,2.5-3.5s 过渡悬停,3.5-11.5s 飞行,细到镜头焦段。任何一拍都可以手动改:故事是你拍板的,ChatGPT 只是替你把术语敲出来。

    标题为 Artlist Prompts 的 Google Docs 文档,展示 12 秒 Sora 2 提示词的完整时间码节拍,从建立行走到最终拉升
    时长、调色、人物锁定、每一拍,全部预先结构化。视频 3:44 处

开始生成:从输入框到成片

  1. 11

    粘进生成器,选 Sora 2 Pro、12 秒、1080p

    教程用的生成器是 Artlist——它同时托管 Sora 2 和 Sora 2 Pro,旁边还有 Veo、Kling 等模型。把 prompt 粘进去,模型选 Sora 2 Pro,再设 16:9、12 秒、1080p,点 Generate。这几项设置和 prompt 开头一一对应,时间码才能落在你规划的帧上。OpenAI 自家的 Sora 应用里也是同样一套“粘贴-配置-生成”流程。

    Artlist 文生视频生成器,已载入黄昏田野的 Sora 2 提示词,模型选 Sora 2 Pro,参数为 16:9、12 秒、1080p
    Sora 2 Pro 已选中,12 秒 1080p,随时可以生成。视频 4:32 处
  2. 12

    先做一张参考图,再玩图生视频

    图生视频比纯文字更可控,因为模型会从静帧继承人物、服装和画风。在同一个工具面板的图片标签里先生成一张,再用一句指令精修:“place this character on a futuristic motorcycle, riding through a dystopian barren land, motion blur to emphasize speed, full body, wide shot”。这张改好的静帧,就是你的 prompt 要指挥的第一帧。

    Artlist 图生图编辑器,指令为把角色放到一辆未来风格的摩托车上,使用 Nano Banana 模型
    参考静帧就是半个 prompt——人物和画风白送。视频 6:24 处
  3. 13

    图生视频的节拍,写静帧“之后”的事

    从图片开始 prompt,动词要换。不用再描述画面里有什么——静帧已经说明了一切——要写的是接下来发生什么:“[00:00-00:03] The woman gently shifts her weight, then begins walking a few slow steps toward the fence. The camera holds roughly the same composition, tracking slightly forward.”。开场这一拍让主体从静止进入运动,同时构图保持不动。

    Sora 2 图生视频提示词卡片,开场 00:00 到 00:03 节拍 the woman gently shifts her weight 以蓝色高亮
    从静到动:第一拍让她走起来。视频 8:51 处

看结果,然后精修

  1. 14

    对照你写的节拍来验片

    成片就是需求逐拍兑现:男人走过黄昏的麦田,悬停,最后贴着麦浪低飞,镜头一路跟随。验自己的片子也用同一套方法——每个时间戳交出它该有的镜头了吗?即便是这条完成度的 prompt,源视频里也重新生成了好几轮,所以第一次出片请当成草稿,而不是失败。

    Sora 2 生成的画面,年轻男子在黄昏的麦田上空低飞,领带向后飘起
    飞行这一拍兑现了:黄昏,贴着麦浪低飞。视频 4:40 处
  2. 15

    Sora 2 能演对白戏,不止能出空镜

    同一套公式还能“演戏”。源视频的对白 demo——两个人、一盏落地灯的公寓、一句 “You think an apology fixes everything?”——展示了 Sora 2 在单条镜头里同时处理对话、情绪和调度。按时间戳和 cut 示例的方法写清谁在说、这句话是什么情绪,场景就会照着演。

    Sora 2 生成的夜景,女子抱臂站在灯光明亮的公寓里,身旁坐着一个男人,窗外是城市灯火
    对白、调度、氛围,来自一条结构化 prompt。视频 1:36 处
  3. 16

    用 shot-by-shot remix 请求精修

    结果接近但不满意时,在同一个对话里接着改:“I need a 12 second sora 2 sequence of this character, riding a futuristic grungy motorcycle... natural motion blur, tracking shot with natural camera shake”。ChatGPT 会主动给出 shot-by-shot remix 版本,而你给的具体意见——再快点、停稳一点、镜头环绕——都会融进下一条 prompt。同一条 prompt 永远不会出两条一样的片子,所以先重新生成,再考虑重写。

    ChatGPT 后续回复,建议生成 shot-by-shot remix 版本,上方是带两张参考缩略图的 12 秒 Sora 2 摩托车序列需求
    用精准的 remix 请求缩小差距,而不是整条重写。视频 6:40 处

常见问题

继续探索