关于 Sora 2
Sora 2 是 OpenAI 的视频生成模型,招牌能力是「出片即成品」:对白与声音和画面同步生成。角色会说出你写的台词,环境声与场景匹配,整段内容以完整场景的姿态交付,而不是等着后期配音的默片素材。
音频之下,是对物理常识的扎实把握。物体的坠落、弹跳、溅落、碰撞大体遵循真实世界的规律——投篮不中会砸筐弹出,而不是穿框而过。这种日常层面的可信度,让 Sora 的片段即使前提荒诞也显得合理,这正是短喜剧和对话场景成为它主场的原因。
Sora 读提示词更像读剧本而非读标签,所以场景怎么写基本决定了结果。清晰的场景设定、少量角色、几句带引号的台词,每一次都胜过成段的形容词堆砌。下方画廊收录了经过验证的 Sora 提示词及真实输出——复制一个已经跑通的场景结构,再改成你自己的。
如何写好 Sora 2 提示词
- 1把提示词写成微型剧本:先场景,再人物,再发生什么,最后是台词。Sora 奖励场景逻辑,而不是关键词堆砌。
- 2台词放引号里,并绑定到具体描述的角色——咖啡师耸耸肩:「燕麦奶又没了。」有归属的台词才能让声音贴住脸。
- 3对话要短——最多两个说话人、两三句往来。冗长的你来我往会把同步和连贯性拉到极限。
- 4用因果关系撬动它的物理感:「他猛拽桌布,杯子晃了晃但没倒」。写清起因和结果,中间过程交给模型补全。
- 5明确定调——「面无表情的办公室喜剧」「手持纪录片」「深夜电视购物」。一个命名的类型片风格,能一次性对齐表演、节奏和声音。
- 6对白之外也要描述声场:房间底噪、背景交谈、远处警笛。不写音频提示得到的是平庸默认值,指挥过的音频才成就场景。
常见问题
Sora 2 最擅长什么?
带同步对白与声音、物理表现可信的完整场景。它最出彩的是简短的对话或喜剧瞬间:角色开口说话,物体像真实物体一样运动,音频交付时已与画面对齐。
怎样写好 Sora 2 提示词?
写微型剧本,别写标签清单:交代场景,引入一两个角色,给他们几句带引号的短台词,再点明基调。本页的验证提示词展示了这套写法——复制一条,换成你自己的场景。
Sora 2 能生成带同步音频的对白吗?
能——同步对白与声音正是它的头牌能力。带引号且注明角色的台词,会以同步的语音说出,环境声也与场景匹配。把说话人控制在一到两个,同步效果最紧。
在哪里可以试用这些 Sora 提示词?
Sora 可通过 OpenAI 的 Sora 应用与官网使用,开发者可走 OpenAI API 接入。从本页复制任意提示词粘贴过去,把角色或台词改成你的创意即可。
相关模型
GPT Image 2
OpenAI's top-ranked image model — it plans the layout, reasons, and self-checks before it draws, nailing complex multi-part instructions.
OpenAI TTS
OpenAI's steerable text-to-speech voices.
MiniMax H3
MiniMax H3 is a powerful multimodal video generation model that creates up to 15-second 2K videos with native stereo sound from text, image, video, and audio inputs.
Seedance 2.0
ByteDance's #1-ranked video model — multi-shot direction with native lip-sync and spatial audio.