集成多模态描述:[镜头1] 手持手机拍摄,画面来自商用飞机乘客座位,透过窗户在白天拍摄,下方是厚厚云层。轻微颠簸,真实的机舱环境音,起初完全是普通的业余 footage:机翼、云层、机身轻微晃动。从00:00.000到00:03.500,一切正常,毫无异常。00:03.500时,下方远处的云层开始以令人不安的方式隆起并裂开。00:05.000时,一根巨大的暗色触手,比摩天大楼还粗,缓缓从云层中升起,向飞机方向延伸。拍摄者的声音颤抖着,[英语,惊恐] 天哪——那是什么?!。00:07.500时,触手突然加速冲向飞机。00:09.000时,它猛烈撞穿机身、冲入客舱,引发碎片飞溅、狂风灌入、乘客尖叫、结构撕裂。但触手并未继续攻击,而是露出末端——竟抓着一个巨大的纸质外卖袋。从00:10.000到00:14.500,镜头在受损客舱中剧烈晃动,触手笨拙地将袋子伸进过道深处,像外卖骑手在完成配送。云层中传来一个平静、就事论事的声音:[英语,淡定] DoorDash,Kevin的外卖?。反差应完全冷面、出人意料,事先没有任何喜剧音乐或视觉提示。 整体音景:真实的飞机客舱噪音、闷响的引擎轰鸣、轻微颠簸、乘客恐慌逐渐升级、猛烈撞击、金属撕裂、狂风呼啸、尖叫声、碎片碰撞声、拍摄者急促的呼吸声,随后是来自舱外那句荒诞而淡定的配送台词。 非剧情音乐:无
本片段由 MiniMax 的 MiniMax H3 生成,页面上的提示词就是生成它的原始文本。
示例由 MiniMax H3 生成,参数:9:5 · 0:15 · Horror · Cinematic · Mysterious。沿用这些参数可获得最接近的效果。
先原样复制提示词,只改主体、保留镜头/运动/光影描述。视频模型对措辞很敏感,多试几次为佳。
当然可以。提示词最适合作为起点——替换场景、调整节奏词或宽高比,适配你的项目。