由 OpenAI 出品官方网站

Sora 2 提示词

OpenAI 的视频模型——把台词写进场景里,生成的片段自带说出的对白、匹配的声音和可信的物理。

video

关于 Sora 2

Sora 2 是 OpenAI 的视频生成模型,招牌能力是「出片即成品」:对白与声音和画面同步生成。角色会说出你写的台词,环境声与场景匹配,整段内容以完整场景的姿态交付,而不是等着后期配音的默片素材。

音频之下,是对物理常识的扎实把握。物体的坠落、弹跳、溅落、碰撞大体遵循真实世界的规律——投篮不中会砸筐弹出,而不是穿框而过。这种日常层面的可信度,让 Sora 的片段即使前提荒诞也显得合理,这正是短喜剧和对话场景成为它主场的原因。

Sora 读提示词更像读剧本而非读标签,所以场景怎么写基本决定了结果。清晰的场景设定、少量角色、几句带引号的台词,每一次都胜过成段的形容词堆砌。下方画廊收录了经过验证的 Sora 提示词及真实输出——复制一个已经跑通的场景结构,再改成你自己的。

如何写好 Sora 2 提示词

  1. 1把提示词写成微型剧本:先场景,再人物,再发生什么,最后是台词。Sora 奖励场景逻辑,而不是关键词堆砌。
  2. 2台词放引号里,并绑定到具体描述的角色——咖啡师耸耸肩:「燕麦奶又没了。」有归属的台词才能让声音贴住脸。
  3. 3对话要短——最多两个说话人、两三句往来。冗长的你来我往会把同步和连贯性拉到极限。
  4. 4用因果关系撬动它的物理感:「他猛拽桌布,杯子晃了晃但没倒」。写清起因和结果,中间过程交给模型补全。
  5. 5明确定调——「面无表情的办公室喜剧」「手持纪录片」「深夜电视购物」。一个命名的类型片风格,能一次性对齐表演、节奏和声音。
  6. 6对白之外也要描述声场:房间底噪、背景交谈、远处警笛。不写音频提示得到的是平庸默认值,指挥过的音频才成就场景。

常见问题

Sora 2 最擅长什么?

带同步对白与声音、物理表现可信的完整场景。它最出彩的是简短的对话或喜剧瞬间:角色开口说话,物体像真实物体一样运动,音频交付时已与画面对齐。

怎样写好 Sora 2 提示词?

写微型剧本,别写标签清单:交代场景,引入一两个角色,给他们几句带引号的短台词,再点明基调。本页的验证提示词展示了这套写法——复制一条,换成你自己的场景。

Sora 2 能生成带同步音频的对白吗?

能——同步对白与声音正是它的头牌能力。带引号且注明角色的台词,会以同步的语音说出,环境声也与场景匹配。把说话人控制在一到两个,同步效果最紧。

在哪里可以试用这些 Sora 提示词?

Sora 可通过 OpenAI 的 Sora 应用与官网使用,开发者可走 OpenAI API 接入。从本页复制任意提示词粘贴过去,把角色或台词改成你的创意即可。