由 ByteDance 出品

Seedance 2.0 提示词

字节跳动的多镜头视频模型——像写分镜一样写提示词,角色开口自带对嘴,声音自带空间感。

video
格式:16:9 横屏,15 秒,照片级写实真人,电影感生活方式时尚短片。 角色一致性: 使用上传的角色设定图作为主角色参考。在每个镜头中,保持女孩的脸、面部比例、长卷棕色头发、发型、发夹、金色耳环、身体比例、酒红色细条纹修身衬衫、深色阔腿牛仔裤和白色运动鞋完全一致。不要改变她的服装、发型、年龄或外貌。 镜头 1 — 0:00–0:05 温暖午后阳光下的舒适质朴咖啡馆。女孩自然地走进来,背着一个小肩包。镜头从她身后以腰部高度跟随,她走路时长卷棕色头发轻轻摆动。她走向阳光照射的窗边一张小木桌。 镜头:平滑手持跟拍,自然运动,浅景深。 镜头 2 — 0:05–0:10 她舒适地坐下,一条腿搭在另一条腿上,拿起一个简单的白色陶瓷咖啡杯,轻松地啜饮一口。切到亲密特写:她的金色耳环、环绕杯子的手指、酒红色条纹衬衫和飘动的头发。 镜头:轻微推近,真实手持微动,温暖阳光洒在她的脸和头发上。 镜头 3 — 0:10–0:15 侧面镜头,她平静地望向咖啡馆窗户。她注意到外面有什么,露出一个自然的小微笑,然后起身走向门口。最后一个镜头从她身后跟随,她走进温暖的日光中,头发自然摆动。 视觉风格 柔和女性化的生活方式美学,舒适欧洲咖啡馆氛围,温暖的米色和棕色环境,自然阳光,真实皮肤质感,细致发丝,轻微胶片颗粒,真实自然的表情,低调时尚编辑感。 重要:不要夸张摆姿势,不要慢动作,不要美颜滤镜效果,不要更换服装,不要改变脸,不要额外配饰,不要卡通/CGI 外观。保持表演自然轻松。 16:9 横屏 • 15 秒 • 照片级写实 • 电影感 • 自然镜头运动
创建一个30秒的超写实虚构家庭录像,主角是一位20多岁后期的韩国成年男性,在首尔一个较老的住宅区度过一个愉快的下午。 角色: 一位虚构的20多岁后期韩国成年男性,中长深色头发随意扎成低马尾,自然的男性面部特征,真实的皮肤质感,性格友善且富有表现力。在整个视频中保持他的外貌一致。 服装: 他穿着一套大胆时尚的夏季服装,包括一件鲜艳的红色修身T恤、高腰宽松白色牛仔短裤、干净的休闲运动鞋、一条简单的手链、小巧低调的耳环和一个小巧的斜挎包。这套服装年轻、色彩鲜明且时尚,适合温暖的夏日。 场景1——出门 他从一栋较老的首尔公寓楼中走出,手里拿着一个小型可重复使用的购物袋。他关上身后的门,注意到镜头,自然地微笑了一下,然后沿着安静的住宅小巷走去。 场景2——社区面包店 他走进一家小小的社区面包店,浏览糕点展示柜,挑选了一份小烘焙点心。他用硬币向店主付款,道谢后走回外面。 场景3——友好相遇 当他穿过狭窄的小巷时,突然看到他的成年男性朋友从对面走来。他们微笑,热情地互相问候,并快速友好地拥抱了一下。他们聊了几句,笑了笑,然后挥手告别,继续朝相反的方向走去。 场景4——水果摊 他在路边一个小水果摊前停下,挑选了一个桃子。他付钱给摊贩,把桃子放进购物袋,继续往前走。 场景5——日常社区瞬间 他走在树下,一边吃着他的糕点。一辆自行车从附近经过,他自然地让到一旁。他环顾安静的房屋,微笑着,镜头从短距离跟拍他。 场景6——结尾 他走到小巷尽头,转向镜头,愉快地挥手。 他自然地微笑,说:“拜拜!” 然后他转过身,提着袋子和桃子沿着住宅街道走远。镜头留在他身后,直到他消失在拐角处。 镜头风格: 真实的2000年代早期消费级MiniDV家庭录像质感。手持摄像机抖动、不完美的构图、自动对焦反复拉风箱、自动曝光波动、柔和的数字细节、轻微数字噪点、轻微压缩伪影、真实的运动模糊以及偶尔笨拙的变焦。 应该感觉像是朋友或家人拍摄的真实记录,而不是专业制作。 音频: 只有自然的社区声音:脚步声、自行车、远处交通、面包店活动、随意交谈、鸟鸣、孩子们玩耍和轻风。 没有音乐,没有旁白,没有字幕,没有文字叠加,没有美颜滤镜,没有性化摆姿,没有CGI外观,没有电影感灯光,也没有精致的商业摄影。
part A: [整体设定] 9:16竖屏,15秒连续长镜头。中国南方乡村,闷热的夏日下午。村道旁一家乡村理发店正在把门口晒太阳的理发平台挪进树荫,一辆旧黄色叉车托着整套理发摊缓慢移动。现场荒诞,但村民起初表现得习以为常。 [环境与氛围] 参考场景参考图  ChatGPT 图像 2026年9月30日 23_24_14 狭窄水泥村道,一侧是水泥与红土混合的空地,另一侧是两三层贴白瓷砖的自建房。理发店墙面有褪色的“便民理发”字样,卷帘门半开,门边挂毛巾,屋檐下停着电动三轮车。 画面右侧一棵老榕树伸出低枝,地面树影斑驳。背景有菜地、矮砖墙、电线杆和交错电线。墙根放着扫帚、塑料桶与几个空花盆,场地使用痕迹真实,不刻意做成破败废墟。 树叶轻轻摇动,蝉鸣持续。偶尔有电动车、摩托车或农用三轮车从村道经过,短暂遮挡视线。 [拍摄质感] 摄影者坐在村道对面停着的家用车里,举手机透过前挡风玻璃拍摄。仪表盘与挡风玻璃下缘始终留在画面底部。摄影者只轻微转动手机,使用小幅、笨拙的数码推拉,不把车内边缘完全裁掉。 普通手机视频画质,轻微手抖、压缩噪点、变焦发软、对焦延迟;从阳光拍到树荫时曝光略有波动。像村民随手拍下的现场,无电影调色、无慢动作、无剪辑。 [人物锁定] 女主为预设成年东亚女性   ,面部、发型和身材严格沿用人物参考图。穿着   、黑色尖头高跟鞋,戴纤细项链。她是理发师,站在顾客右后方,动作熟练,表情认真,不提前暗示笑点。 顾客为约50岁的中国乡村男性,身材偏壮,皮肤晒黑,面部有自然皱纹,披褪色蓝白碎花理发围布,脚穿深色凉鞋。他戴着贴合自然的短黑棕色假发,开场只呈现普通短发,不能提前露出光头。 司机为约45岁的中国男性,短发,穿旧灰色短袖、深色工装裤和布鞋。 树旁三名中老年村民坐塑料凳等候:一名大叔穿白背心、拿蒲扇;一名大婶穿花布短袖;另一名大叔穿深色短袖,拿透明带盖茶杯。人物数量与衣着固定。 [空间与道具] 叉车驾驶室在画面左侧,门架向右,两根货叉托着约三米宽、两米深的加固木平台。平台离地约一米,与货叉架固定连接,后缘和两侧设低护栏。 理发椅底座固定在平台中央。女主右侧的窄工具架固定不动,放着电推剪、毛巾和工具凹槽。后方木框镜子牢固安装。女主右手持剪刀、左手持梳子。 右上方榕树低枝有一个清楚可见的小分叉。叉车左后轮即将经过的位置有浅坑,从开场就存在。排队村民在行进范围以外。 [0—4秒] 手机从全景慢慢推近。女主用梳子抬起顾客鬓角的少量头发,剪下发梢。顾客放松坐着,双脚放在脚踏上。白背心大叔慢慢摇蒲扇,花衣大婶和旁人低声聊天。一辆电动车从右向左驶过,短暂遮住平台下部。 [4—7秒] 司机回头看树荫,朝女主抬手示意,然后缓慢倒车。女主停止剪切,剪刀离开顾客头部,等待平台移动。叉车与平台整体向画面左侧挪动,榕树阴影扫过她的肩膀和顾客围布。手机稍拉远,露出车轮与浅坑。 [7—10秒] 叉车左后轮压入浅坑又爬出,整车短促颠簸一次。女主立即合拢剪刀,右手举离顾客,左手连同梳子一起扶住椅背。顾客抓紧扶手,凉鞋里的脚趾收紧。电推剪在工具架上滑动几厘米,碰到挡边后停住。拿茶杯的大叔停止喝茶,抬头看。 [10—13秒] 司机刹停,平台晃动消退。手机笨拙推近,焦点短暂模糊后恢复。女主先看顾客,再确认脚下站稳;顾客皱眉向司机瞪了一眼。白背心大叔笑了一声,蒲扇停在胸前。 [13—15秒] 一阵风从画面左侧吹向右上方。围布边缘先鼓起,女主发丝跟着偏向右侧,榕树枝叶摇动。顾客头顶假发前缘被轻轻掀起,整片头发开始松动。女主目光移向他的头顶,梳子停在半空,嘴唇微微张开。 结束帧:叉车已停,平台平稳;女主右手剪刀闭合,左手梳子悬停;假发前缘刚掀起,尚未离开头顶。 [现场声音] 蝉鸣、树叶声、叉车柴油怠速、倒车提示、轮胎碾土、平台轻响和路过电动车声。村民说带南方乡音的普通话,内容含混,不承担剧情解释。无音乐、旁白、字幕和喜剧音效。 [质量与负面约束] 先车轮压坑,再平台颠簸,再人物反应。货叉、平台、椅子与工具架连接真实。风向统一,假发本段不能提前飞走。 禁止欧美乡村建筑、美国路牌、西班牙苔藓及欧美人物;禁止换脸换装、肢体增减、剪刀接触皮肤、平台漂浮、人物跌落、叉车翻倒、假发复制、镜中多出人物。禁止切镜、航拍与镜头穿出挡风玻璃。 part B: [续写起点] 使用第一段结束帧 9月30日(1) ,接续同一次车内手机拍摄,不重复颠簸。 旧黄色叉车已停在浅坑后方,加固平台离地约一米。女主位于理发椅右后方,右手持闭合剪刀并远离顾客,左手握梳子悬停。顾客坐在椅上,双手抓着扶手,短黑棕色假发的前缘刚被风掀起。 风持续从画面左侧吹向右上方,榕树低枝及小分叉位置不变。 [环境与拍摄质感] 9:16竖屏,15秒连续长镜头。中国南方乡村夏日下午,水泥村道、白瓷砖自建房、半开卷帘门、“便民理发”旧字样、菜地、矮砖墙、电线杆和停着的电动三轮车全部保持一致。 摄影者仍坐在对面家用车内,透过前挡风玻璃拍摄,仪表盘和玻璃下缘始终可见。小幅数码变焦、跟拍慢半拍、短暂发软、普通压缩噪点。光线闷热平淡,蝉鸣持续,无电影调色、无切镜、无慢动作。 [人物与道具锁定] 女主沿用预设成年东亚角色 ,穿着 、黑色尖头高跟鞋、纤细项链与长发不变。表情由惊讶转为忍笑,再尽量恢复认真。 同一位约50岁的晒黑壮实男性顾客,蓝白碎花围布、深色凉鞋;同一位灰短袖司机;同三名排队村民:蒲扇大叔、花衣大婶、茶杯大叔。 假发只有一顶,短黑棕色,内部有柔软网底。脱离后,顾客显露光滑头顶,头侧可保留少量稀疏短发。镜中形象必须同步变化。 平台、固定理发椅、工具架、镜子、两根货叉及低护栏的位置连续。 [0—3秒] 风掀起假发前缘,整顶假发脱离顾客头顶,露出柔软内网,向右上方翻滚一圈。手机稍慢半拍向上追踪,仍保留车内下缘。 假发沿清楚可见的轨迹飞出约一米,内网挂住榕树低枝的小分叉,摇晃两下后悬住。顾客先缩脖子,再抬眼向上看;女主梳子仍停在半空,视线跟着假发移动。 [3—6秒] 手机稍拉远,把假发与平台上的人物一起收入。女主、顾客和三名村民先后抬头看向同一根树枝。 顾客抬手摸到光头,手掌停住,随后看向镜子。镜中同步显示他裸露的头顶。女主看一眼树枝,再看他头顶,嘴角绷紧。蒲扇大叔用扇子遮住嘴,肩膀开始抖动;花衣大婶侧过脸笑,茶杯大叔把杯子放低。 [6—9秒] 女主先把闭合剪刀放进工具凹槽,再放下梳子,两件工具都有完整放置动作。随后她轻按顾客肩膀,让他留在椅上。 顾客一手扶扶手,另一手指向假发,转头看司机。司机顺着手指抬头,认真看了看树枝高度,轻轻点头,低头握住升降操纵杆。 [9—12秒] 司机只操作升降,叉车轮胎保持静止。液压声响起,货叉带着整个平台平稳升高约三十厘米。女主一手扶椅背,另一手握侧护栏。 顾客保持坐姿,右臂向上伸,五指张开,逐渐接近假发。下面三名村民仰头等待,蒲扇大叔干脆把扇子放到腿上。手机小幅调整,保证树枝、顾客手指和平台升高的关系可读。 [12—15秒] 顾客指尖即将碰到假发,一阵风使枝梢向外摆动,假发移远十几厘米。他伸直手臂仍差一点,只能僵住。 女主看他的指尖,再看假发,抿住嘴转开脸,肩膀轻轻一抖。摄影者在车内笑出声,手机跟着晃动。 一辆装着空菜筐的农用三轮车从左向右经过,短暂挡住平台下部;上方仍看见顾客伸手够假发、女主扶椅背、榕树枝轻摆。视频自然结束。 [现场声音] 蝉鸣、树叶摩擦、叉车怠速、升降液压声和村道车辆声。村民笑声由轻到明显,摄影者笑声靠近手机、更加清楚。假发没有夸张飞行音效,反转没有配乐、旁白或字幕。 [质量与负面约束] 假发必须从头顶脱离、经过空气、接触树枝,再被内网挂住。不能瞬移、复制、自行飞翔或变成动物。顾客头顶和镜中反射保持一致。 人物看到假发飞走后才反应;工具放下后女主才能空手扶椅背。平台、椅子和所有固定物一起上升,叉车不能边升高边突然行驶。 禁止欧美场景与人物、换脸换装、手掌穿模、多余手臂、假发自动回头、顾客站上椅子、人物跌落、机械翻倒或凭空爆炸。全程保持乡村日常感与克制的尴尬喜剧表演。
创作一部电影级高质量3D动画短片,故事发生在一片阳光明媚的美丽森林草地上,主角是两个可爱的拟人化动物角色:一只体型小巧、毛茸茸的棕色海狸状生物,拥有大大的富有表现力的眼睛、一小撮头发、柔软圆润的身体,以及一个深色毛茸茸的大猩猩状伙伴。 场景1——宁静的开端: 电影级广角镜头,两只可爱的小动物一起坐在明亮森林中茂密的绿草地上。棕色小动物开心地吃着香蕉,深色的大猩猩状角色在旁边看着它。温暖的金色阳光透过树木洒下,柔和的景深,漂浮的尘埃微粒,美丽多彩的环境。 场景2——搞笑反应: 切换到棕色角色面部的极度特写。它的表情突然从开心变为怀疑和烦躁。使用夸张的卡通面部动画、富有表现力的眼睛、细微的头部动作、细致柔软的毛发、电影级浅景深。 场景3——情绪化的大猩猩: 大猩猩状角色的极度特写,拥有巨大的富有表现力的眼睛。泪水开始从它脸上流下,呈现出夸张却又可爱的情绪反应。它的眼睛映出周围的森林和阳光。让这一刻既搞笑又可爱,同时富有情感表现力。 场景4——争吵: 两只角色坐在草地上的中广角镜头。棕色动物变得愤怒,脸颊变红,而大猩猩则做出戏剧性的反应。夸张的面部表情和肢体语言,俏皮的喜剧感,流畅的角色动画。 场景5——木棒: 一根大木棍/木棒进入画面的特写。棕色角色坚定地抓住它,而大猩猩则显得震惊。使用喜剧动作电影风格的镜头推进和戏剧性节奏。 场景6——追逐/打斗: 动态广角镜头,两个角色在草地上奔跑并嬉戏打斗。棕色动物挥舞着木棒,而大猩猩则躲闪并做出戏剧性反应。快速但流畅的镜头运动,喜剧化的动作编排,富有表现力的面部,飞溅的草屑,电影级运动模糊。 场景7——混乱后的平静: 棕色角色的特写,它直视镜头,带着可爱又略带调皮的表情。它的表情逐渐变成开心的微笑。温暖的阳光在它的毛发周围形成美丽的发光轮廓光。 场景8——发现水果: 大树附近的广角镜头。小动物发现了一堆色彩鲜艳的新鲜水果,并开心地在旁边坐下。苹果、桃子、葡萄和其他色彩缤纷的水果充满前景。柔和的阳光和梦幻般的森林背景。 场景9——英雄水果镜头: 可爱的棕色角色坐在色彩缤纷的水果中的电影级特写,它直接对着镜头微笑。明亮的蓝天、茂密的绿树、鲜艳的水果色彩、柔和的金色阳光、高度细致逼真的毛发、精致的动画电影质感。 场景10——盛大终章: 史诗般的电影级广角镜头,一大群可爱的森林动物聚集在一个巨大的彩色水果展示周围。兔子、小型哺乳动物、熊和其他可爱动物在欢乐的节日氛围中一起庆祝。色彩斑斓的烟花在森林上空的天空中绽放。画面中央包含一条节庆风格的红色竖幅,上面写有中国风格的庆祝文字。所有人都看起来开心又兴奋。 视觉风格: 高级电影级3D动画,可爱的角色设计,逼真柔软的毛发,富有表现力的超大眼睛,皮克斯品质感,鲜艳色彩,温暖自然阳光,全局光照,真实阴影,浅景深,细致环境,流畅的面部动画,夸张的喜剧表情,精致的电影级渲染。 镜头: 使用电影级建立镜头、极度特写、中景镜头、跟踪镜头、缓慢推镜、动态动作镜头运动和流畅转场。在每个场景中保持角色外观一致。
15秒连续视频提示词 0至3秒(钩子) 视觉:极端微距镜头,一颗新鲜的红草莓静置于白色大理石板上。突然,草莓开始悬浮并在半空中快速旋转。 动作:草莓爆裂成一个旋转的漩涡,由鲜艳的红色果肉颗粒、液态巧克力飞沫和细腻的糖粉云雾组成。 声音:高速卡通风格的嗖嗖声逐渐增强为一声洪亮的爆破音效,底层铺以快速、轻快的原声吉他扫弦。 3至6秒(转变) 视觉:快速动态镜头围绕旋转漩涡环绕拍摄,悬浮的食材在慢动作中瞬间聚合凝结。 动作:液态巧克力在半空中包裹住果肉颗粒,瞬间转化为一个多层、光泽诱人的精致草莓巧克力挞,金色拉丝糖环绕其周围。 声音:令人满足的魔法变身铃音融入清脆的巧克力外壳碎裂音效。 6至9秒(角色台词) 视觉:中景镜头,俏皮的糕点师朝镜头眨眼,单手轻松接住刚刚变身完成的精致甜点,置于光滑的板岩盘上。 动作:她将盘子举向镜头,露出灿烂而富有感染力的笑容,以轻快的活力自然地说出台词。 声音:欢快的拍手流行节拍,配合温暖、开朗的旁白:“玩转你的食物!” 9至12秒(微距揭示) 视觉:超特写切片镜头,一把金色叉子轻轻切开挞顶部的巧克力层,露出内部浓郁的草莓奶油夹层。 动作:糖釉在明亮的影棚灯光下闪闪发光,微小碎屑轻柔地落在板岩盘上。 声音:超细腻的清脆咔嚓音效,随后是一声欢快的铜管号角点缀。 12至15秒(品牌收尾) 视觉:居中主镜头,完成的草莓巧克力挞静置于板岩盘上,周围散落着新鲜草莓和拉丝糖线。 动作:一条俏皮的柔和黄色图形波浪轻轻扫过屏幕底部,淡淡的蒸汽/香气从甜点上升腾缭绕。 声音:充满活力的音乐落在干净利落的最终底鼓节拍上,伴随悠长的原声铃音。
一部电影感十足的3D皮克斯风格动画短片,主角是一位美丽的年轻女子,她有着长长的波浪状栗棕色秀发、大而闪亮的蓝绿色眼睛、柔软红润的脸颊和温柔的笑容,身穿奶油色无袖上衣,外搭米色围裙,胸前印有文字“@Logolumos”。她身处一间明亮、阳光充足的现代厨房,厨房内有温暖的木质橱柜、大理石台面、摆放着植物的窗户,以及金色黄昏阳光洒入。照片级真实光照、浅景深、超精细纹理、高端3D动画质量。 镜头序列: 她将一颗棕色鸡蛋打入一个玻璃碗中,碗里已盛有数个蛋黄。 她将白砂糖倒入蛋黄上。 她同时将量杯中的金黄色油和玻璃壶中的白色牛奶倒入碗中。 她用金属筛网将白色面粉筛入湿性混合物中。 她在面粉堆上撒上深色可可粉。 她用打蛋器将所有材料搅拌成浓稠、有光泽的深色巧克力面糊。 她将融化的黄油刷在长方形金属烤盘上。 她用刮刀将浓稠的巧克力面糊倒入烤盘中。 她将烤盘滑入预热好的烤箱中。 她带着略显担忧的表情看了看手腕上的手表,等待期间。 烤箱内,蛋糕在发光的热气中膨胀并烘烤。 她戴上隔热手套打开烤箱,取出烘烤完美的深色巧克力蛋糕。 她在冷却架上自豪地展示做好的圆形巧克力蛋糕,对着镜头微笑。 温暖、诱人、舒适的烹饪氛围,流畅的镜头运动,专业食品广告级品质,8K,高度精细。
图片1 莎伦的真实面容——她五官的唯一来源,100%匹配,零漂移:柔和圆润的鹅蛋脸,温暖浅米色肌肤,带细碎雀斑和美人痣,绿色眼睛,浓密平直羽状眉,小巧端正的鼻子,饱满粉唇,小巧银色水滴耳环。 以上传的参考视频 视频1 作为时间节奏、镜头运动、身体动作、姿态、面部表情节奏、互动、转场节奏、像素特效、换装特效、构图以及整体编排的绝对母版。 用图片2 替换原视频中的女性,作为唯一替换人物身份。 从现在起,仅称她为女性角色 图片1。 关键参考优先级: 参考视频控制: 精确动作 精确节奏 精确镜头运动 身体编排 姿态变化 头部运动 手部动作 面部表情节奏 与另一名男性的互动 转场节奏 换装时机 像素特效 数字换装特效 构图 速度变化 穿越像素的运动 整体视觉节奏 女性角色控制: 身份 @图片2 面部 发型 头型 肤色 身体比例 性别呈现 原视频中的女性不是身份参考。 她仅控制动作。 生成的视频必须尽可能紧密地跟随参考视频,但整段序列中,女性必须完全替换为同一女性角色 @图片1。 ================================================== 绝对身份锁定 整个视频中只有一个替换身份: 同一女性角色。 她的身份必须在每一帧中保持完全稳定。 这包括: 普通帧 快速运动帧 运动模糊 转场帧 像素变换帧 换装帧 部分遮挡帧 特写 侧面角度 极端角度 其他人从她面前穿过的帧 永远不要恢复原视频女性的身份。 永远不要露出原视频女性的脸。 永远不要露出原视频女性的身体。 永远不要将参考视频中的女性与参考图片中的女性混合。 永远不要创建临时的女性版本。 永远不要从男性变到女性再变回来。 即使变换只持续几帧,那些帧中仍然必须是同一女性角色。@图片2 ================================================== 最重要的换装规则 服装发生变换。 人不变。 每一个像素变换、数字分解、服装替换、颜色变化、纹理变化或服装转场,仅作用于服装。 底下的女性角色在物理上保持完全一致。 正确的视觉逻辑: 同一女性角色穿着服装A → 像素特效在服装上开始 → 服装分解为/穿过数字像素 → 同一女性角色 @图片1 仍在底下 → 服装B在同一身体上形成 → 同一女性角色 @图片2 继续动作 永远不要: 女性角色 → 像素 → 原视频女性 → 服装变化 → 女性角色回来。 像素特效绝不能充当身份转换的过渡。 ================================================== 像素特效行为 尽可能忠实地还原参考视频中的像素特效。 匹配: 方向 密度 速度 大小 时机 分解行为 数字碎片化 重组 与身体的互动 与另一名男性的互动 服装变化的瞬间 像素应感觉融入物理场景中。 当另一名女性穿过像素场时,精确保留原始互动。 她的身体应以与参考视频相同的方式,可见地穿过/被像素部分遮挡。 不要将其替换为: 烟雾 魔法 与参考无关的粒子 光束 传送门 通用溶解 身体变形 保留源视频中独特的像素换装特效。 ================================================== 像素转场期间的面部锁定 女性角色的面部 @图片2 被永久锁定。 如果像素穿过面部或暂时遮挡部分面部,面部的可见部分必须保持同一身份。 当像素散去时,底下必须是完全相同的脸。 永远不要用原视频女性的特征重建被遮挡的面部区域。 每次变换之前、之中和之后,面部都是同一个人。 ================================================== 换装期间的身体锁定 持续保持女性角色的身体比例稳定。 服装适应她的 @图片2 身体。 不要重塑她的身体以匹配源视频中的女性。 保持: 女性肩宽 躯干比例 腰部比例 手臂 腿部 身高 姿态 手的大小 整体轮廓 原视频女性的身体仅作为动作参考。 女性角色在保持自身物理特征的同时完成动作。@图片1 ================================================== 动作匹配 尽可能紧密地跟随参考视频 @视频1 的动作。 不要重新诠释编排。 匹配: 精确身体方向 精确转身 精确头部运动 精确节奏 精确停顿 精确行走动作 精确手部位置 精确互动 精确加速 精确减速 精确穿越像素特效的运动 角色替换应感觉像是同一段素材由不同演员拍摄。 不要发明新的手势。 不要简化原始表演。 不要改变节奏。 ================================================== 面部表情 复制原视频女性的面部表情节奏和情绪节拍,同时保持替换女性身份 @图片2 匹配: 视线方向 眉毛运动 微笑 态度 反应
使用角色设定图作为视觉参考,创建一段15秒快节奏、流畅的奢华时尚大片视频。 始终保持同一位女性、面部、深棕色头发、毛皮外套、红色短款上衣、破洞牛仔、链条、妆容和整体造型一致。保留她俏皮、自信、略带淘气的个性。 视频应有一种时尚嫌疑犯照混合俏皮“因美被通缉”广告大片的感觉。 0–3秒 — 嫌疑犯照 以身高标尺前一张利落的全身嫌疑犯照构图开场。 她直视镜头。 快速流畅推近 → 她俏皮地眨一下眼 → 立刻切到她举着“WANTED FOR BEAUTY”牌子。 她带着态度慢慢把牌子朝镜头倾斜。 3–6秒 — 美妆细节 进入快速但流畅的美妆蒙太奇: 眨眼 → 亮泽双唇 → 红色美甲 → 棒棒糖 → 毛皮外套质感 → 链条细节 → 太阳镜 → 俏皮微笑。 使用流畅的快速变焦和无缝甩镜转场。 每个镜头都应非常短,大约0.3–0.6秒,但转场应保持流畅且精致。 6–9秒 — 俏皮捣蛋鬼 回到全身嫌疑犯照。 她随意向一侧倾斜,同时保持自信站姿。 镜头快速流畅地绕她环绕 → 她戴上太阳镜 → 从太阳镜上方直视镜头 → 露出淘气的微笑。 加入微妙的相机闪光爆闪,仿佛狗仔摄影师正围着她。 9–12秒 — 快速时尚蒙太奇 快速展示: 毛皮大衣 → 红色上衣 → 腰带和链条 → 破洞牛仔裤 → 棒棒糖 → 双唇 → 眼睛 → 太阳镜。 在每个细节之间使用流畅连续的镜头运动,并配合快速时尚剪辑。 报纸页面短暂飞过画面,形成转场。 12–15秒 — 最终镜头 回到嫌疑犯照设置。 她朝镜头举着牌子。 牌子上现在写着: “WANTED FOR BEING TOO BEAUTIFUL” 她挑起一边眉毛并微笑。 镜头快速朝她的脸推近。 一张报纸突然扫过镜头。 切至黑屏。 运动与剪辑 快节奏但流畅。 使用: 0.3–0.6秒切镜 流畅快速变焦 无缝甩镜转场 受控镜头环绕 快速推近和拉远 微妙速度斜坡 时尚大片运动模糊 狗仔闪光效果 流动报纸转场 卡拍剪辑 不要让它变慢、梦幻、抖动或混乱。 镜头应始终感觉受控且流畅,同时剪辑保持快速。 整体感觉:俏皮捣蛋鬼 + 奢华时尚广告大片 + 电影感嫌疑犯照 + 光面杂志大片。
使用角色设定图作为视觉参考。在整个视频中保持新娘的面部、发型、婚纱、身体比例和配饰完全一致。16:9 横屏。 0–3 秒 — 逃跑 一场教堂婚礼正在进行,新娘突然冲过巨大的教堂大门,飞奔下台阶,手里还拿着捧花。她的表情坚定但滑稽地兴奋。头纱和婚纱在身后狂野飞舞。镜头在她前方快速后退跟拍。背景中出现几位困惑的婚礼宾客,意识到发生了什么。 3–5 秒 — 上车 她发现路边停着一辆亮红色的1950年代复古汽车。她一边跑一边踢掉一只白色婚鞋,然后扑向驾驶座车门。快速甩镜跟随她的动作。 5–8 秒 — 疾驰而去 她跳进车里,猛关车门,发动引擎,以荒唐的速度飞驰而去。轮胎尖叫,冒出一小团烟雾,她长长的白色头纱被关上的车门夹住,戏剧性地在车后飘扬。捧花落在副驾驶座上。 8–11 秒 — 混乱 快速喜剧式车内切换镜头: 新娘紧握方向盘大笑 → 头纱在脸上狂甩 → 捧花在副驾驶座上弹跳 → 另一只婚鞋飞在空中 → 婚礼宾客无助地追赶着消失的汽车。 11–15 秒 — 她自由了 动态侧面跟拍镜头,红色汽车在阳光明媚的复古公路上飞驰。新娘单手开车,完全无忧无虑。她看向后视镜,看到教堂在远处消失,咧嘴一笑,然后吹出一个巨大的粉色泡泡糖泡泡。 最后一帧: 红色汽车加速驶向地平线,头纱在车后飞扬。 风格:快节奏肢体喜剧、俏皮叛逆的能量、1950年代美国风情、饱和红色复古汽车、奶油白色婚纱、温暖金色阳光、电影感复古胶片颗粒、略带绘画感的写实、真实运动、充满活力的镜头运动、甩镜、快速剪辑、夸张但可信的喜剧。 重要:无慢动作、无悲伤情绪、无戏剧性浪漫、无对白、无文字、无额外新娘、无面部变化、无服装变化、无扭曲的手、无变形。
使用提供的角色图像作为严格的身份和造型参考。在整个视频中保持完全相同的女性、面部、头发、身体比例、妆容、服装和配饰。照片级写实真人实拍,不是动画或3D。 0–3秒 复古梳妆台的极度特写。她一边看着小镜子,一边慢慢涂上亮泽的粉色口红。温暖昏暗的卧室灯光,柔和的胶片颗粒,微妙的镜头运动。她的水钻粉色翻盖手机放在化妆品旁边。 屏幕上短暂出现文字:“我只是想低调一点……” 3–6秒 与节拍同步的快速时尚剪辑: ——她亮泽的粉色指甲轻敲翻盖手机 ——戴上珍珠耳环 ——从梳妆台上拿起太阳镜 ——她的口红和眼睛的快速特写 ——她啪地合上翻盖手机。 文字闪现:“哎呀。” 6–10秒 镜头拉远,她从梳妆台前站起,露出完整造型。她戴上超大粉色太阳镜,拿起小手提包,在镜子里检查自己,然后露出最微小而自信的微笑。 流畅的镜头运动,像真正的时尚广告。 10–13秒 她以毫不费力的自信穿过卧室,从镜头旁走过。轻微慢动作,复古闪光摄影效果,柔和运动模糊,真实的布料飘动和自然的身体动作。镜头微妙地跟拍她。 13–15秒 她突然停下,转身面向镜头。特写。她微微低下太阳镜,露出一个心照不宣的浅浅坏笑,然后画面定格,像1990年代时尚杂志封面。 大型粉色编辑风格排版: “ICONIC, ACTUALLY.” 视觉风格:90年代末/2000年代初时尚编辑大片,复古好莱坞魅力,粉色与黑色配色,亮泽美妆广告,胶片颗粒,微妙瑕疵,闪光摄影,真实的皮肤和头发,电影级景深,俏皮但精致,快节奏编辑剪辑。不要夸张表演,不要俗气摆拍,不要卡通感,不要随意的服装/面部变化。
15秒,超电影级赛博朋克Boss战,AAA游戏电影预告片品质,IMAX 70mm,虚幻引擎5写实风格,黑暗科幻动作。经典香港功夫片动作编排融合鬼泣式连招动作:从第一帧到最后一帧不间断战斗,无停顿,无慢动作,无站立摆姿。极限速度,残暴近身格斗,不间断连锁连招,挑空上勾拳,空中连击,猛砸,闪避反击,钢丝武打空中移动,真实打击重量感,每次重击2-3帧命中定格微冻结,凌厉的速度变速。0–1秒 地铁车厢内 超低机位,急速推进。武者瞬间爆发,脚下地板凹陷,蓝色雷电炸开,身体化作残影冲出,第一秒即与怪物接战。1–2秒 90°荷兰角,侧面高速跟拍。武者瞬移至绿色怪物面前,连续三记重拳击中胸腹,肌肉受力变形,怪物被打得连连后退,武者贴身追击,绝不停步。2–3秒 极端俯拍,突然切换仰拍。怪物挥拳反击,武者侧身闪避,瞬间消失,出现在怪物背后,一记重肘轰中脊背,无缝接上扫腿。3–4秒 超广角低机位,猛烈甩镜。怪物被击飞撞碎车厢座椅,金属支架弯曲,玻璃爆裂,碎片四散,武者凌空飞身追上,毫无间隔。4–5秒 三机位快速交叉剪辑。怪物从残骸中暴起,抓住武者将其砸向车厢侧壁,金属壁板凹陷,整节车厢震动;武者借力反弹,瞬间反手格挡,立刻还击。5–6秒 180°环绕运镜,极低仰拍。武者蹬墙反弹,空中扭身,一记雷霆飞膝击中怪物下颚,绿色毒雾爆散,怪物被挑离地面。6–7秒 极端俯拍,超高速追踪。武者空中连续追打浮空的怪物,拳脚连环,六道蓝绿残影高速交错,拳脚碰撞产生冲击波,怪物像沙包般被打得在车厢内弹飞。7–8秒 荷兰角,贴身手持摄影。武者闪过怪物利爪,连续左右勾拳,接一记凶猛上勾拳,怪物头部猛然后仰,武者随即跃起追击。8–9秒 车厢尽头超长焦,急速变焦。怪物释放绿色能量冲击波,武者贴地高速滑行从冲击波下方穿过,沿途地板被撕裂,滑行中直接蹬地弹起,反击不断。9–10秒 360°高速环绕,突然切换仰拍。武者跃起瞬移至怪物头顶,一记雷霆下劈腿将怪物砸向地面,地板严重凹陷,武者落地即接连环重拳。10–11秒 超近景与极端俯拍交替。怪物挣扎反击,双方拳拳相撞,拳头、肌肉、衣物产生明显的冲击变形,格挡、拆招、反击一气呵成。11–12秒 45°荷兰角,急速倒退跟拍。武者被绿色能量轰飞,连续撞穿座椅与扶手,落地翻滚,单手撑地瞬间反弹,毫不停顿地冲回战场。12–13秒 地板高度超低机位,迎面高速摄影。武者全身雷电爆发,瞬间突破音障,以极限速度冲向怪物,身后形成多重蓝色残影。13–14秒 正面特写,侧面超高速摄影,俯拍交叉剪辑。雷霆重拳击中怪物胸口,冲击使其躯干剧烈后弯,蓝色雷电与绿色能量猛烈爆炸,武者连续追击两拳一腿。14–15秒 超广角固定镜头,瞬间拉远。怪物被轰飞撞向车厢尽头,金属门板扭曲,玻璃粉碎,强烈冲击波席卷整节车厢,武者在飞散的碎片与雷光之中落地。全局要求:战斗从0:00到15:00不间断持续,每一次命中都直接衔接下一次攻击,每一次闪避都化为反击,每一次落地都成为另一次进攻。拳头、肘、膝和腿在解剖结构上始终与肩、髋和步法相连,具有真实重量感和受击时可见的肌肉变形。武者身上有蓝色闪电,怪物身上有绿色毒性能量,每次碰撞都有火花、碎片和玻璃碎渣。面部和服装保持稳定一致。无慢动作,无等待,无站立摆姿,无对白,无字幕,无水印,无多余肢体,无解剖结构崩坏。
主体与角色:一位神秘而美丽的年轻东亚女性,站在一座破败的古老神社中,四周是无穷无尽的血红色彼岸花,头顶是阴暗暴风雨的天空。她身穿一件优雅的黑色哥特式传统风格长裙,带有红色点缀,长袖飘逸,深色面料随她的身体自然流动。她的表情冷漠、忧郁而令人着迷——悲伤、孤独与沉静自信的混合。保持原始角色外观、面部、发型、服装设计和电影氛围。⸻ 动作与编排:15秒 intense 电影感舞蹈表演。这位女性表演一种强有力的融合:暗黑当代舞、哥特编舞和凌厉的嘻哈灵感动作。她的动作优雅却充满爆发力:* 突然的肩部顿挫 * 锐利的手臂波浪 * 戏剧性的身体分离 * 如仪式舞蹈般快速的手势 * 强有力的旋转 * 飘逸的袖摆动作 * 低蹲动作 * 配合节奏的突然定格 她的长袖和头发以真实物理效果跟随每一个动作。这支舞感觉像一个孤独的幽灵在被遗忘的世界中进行最后的仪式。她从静止进入爆发性的动作,表达悲伤、愤怒与接受。⸻ 镜头指导:竖屏电影感视频 9:16 使用动态电影风格镜头语言:0-3秒 * 以缓慢的电影感推镜从广角镜头开始。* 女性一动不动地站在彼岸花田中央。* 风吹动她的头发和裙子。* 雨滴落下。3-6秒 * 突然的节拍重击。* 镜头快速环绕她。* 她开始凌厉的舞蹈动作。* 快速的肩部顿挫和手臂动作。* 红色彼岸花在她周围剧烈摇晃。6-10秒 * 动态手持镜头跟随她的动作。* 低角度镜头展现力量与优雅。* 快速电影感剪辑:* 她眼睛的特写 * 手部特写 * 流动的黑色织物 * 踏过潮湿地面的脚步 10-13秒 * 她完成一个强有力的旋转。* 镜头随她旋转。* 头发和袖子形成圆周运动。* 雾气如超自然力量般在她周围盘旋。13-15秒 * 音乐突然放缓。* 她停止动作。* 镜头拉远。* 她变成一个孤独的剪影,被无尽的红花包围。* 一片红色彼岸花花瓣落在镜头前。⸻ 环境与灯光:黑暗废弃的日式风格神社废墟。大雨、潮湿的石地、浓雾。冷蓝色电影感灯光与来自彼岸花的深红色高光混合。氛围是:* 美丽 * 悲剧 * 神秘 * 超自然 * 优雅恐怖 环境本身回应她的舞蹈:* 花朵随她的动作摇摆 * 雾气跟随她的运动 * 雨水随脚步飞溅 * 阴影在墙上微妙移动 ⸻ 镜头风格:IMAX电影摄影。动态镜头运动:* 环绕镜头 * 低角度跟踪镜头 * 快速推轨运动 * 流畅手持真实感 * 戏剧性特写 * 慢动作时刻 高质量电影舞蹈片美学。真实人体运动、自然身体物理、细致织物运动。⸻ 视觉风格:受《寂静岭f》启发的氛围。暗黑日式哥特奇幻。电影感写实主义。冷蓝与血红配色。超写实皮肤质感。35mm胶片颗粒。高对比度灯光。忧郁、情绪化、令人难忘的美。⸻ 负面提示词:静态图像、无聊动作、僵硬身体、机器人式舞蹈、糟糕解剖、扭曲面部、多余肢体、不真实物理、卡通风格、过度视觉效果、明亮色彩、现代夜店、休闲街头服饰、喜剧表情、低质量、帧插值伪影、水印、文字、标志。
制作一段15秒的超真实2000年代初期索尼MiniDV家庭录像。 主体:年轻韩国女性,自然美貌,真实肤质,淡妆,深色长发松散扎起。宽松淡紫色旧T恤,灰色宽松居家裤,白袜,细银项链。全程保持完全一致的身份、面容、发型、身材比例和外观。 场景:阳光明媚的夏日清晨,首尔老旧小公寓阳台——水泥墙、金属栏杆、晾衣绳、彩色晾晒衣物、塑料洗衣篮、盆栽植物、邻近楼宇和远处屋顶。明亮而略带朦胧的阳光。 风格:真实个人化2000年代初期MiniDV影像,轻微手持晃动,构图不完美,细微自动对焦/曝光调整,褪色色彩,柔和对比度,DV压缩痕迹和轻度数字噪点。全程画面平滑连续运动:无卡顿、抖动、跳帧、重复帧、定格动画、过度动态模糊、变速、低帧率观感、防抖处理或电影感运镜。 00–03秒:她把洗衣篮端上阳台,放下篮子,将第一件衬衫夹上晾衣绳。 03–06秒:她平静地继续晾挂几件衣物,镜头自然跟随她的双手。 06–09秒:她展开并晾起一条白色床单;床单短暂充满画面,随后在微风中轻轻飘动。 09–12秒:她后退一步,拉平一件晾歪的衣袖。身后可见邻近公寓楼和夏日蓝天。 12–15秒:她坐在一把小塑料椅上,喝水,望向远处屋顶,带着一丝放松的浅笑。镜头缓缓飘向风中摆动的衣物,画面结束。 音频:仅自然环境声——鸟鸣、远处车流、隐约的公寓人声、布料窸窣声、晾衣夹声、篮子声响、空调嗡鸣和轻柔风声。无音乐、无旁白、无附加音效。 目标:一段被遗忘的2000年代初期普通家庭录像——温暖、日常、私密、毫无摆拍。怀旧感来自首尔日常生活的真实气息和MiniDV的质朴画质,而非降低帧率。
一位年轻的韩国女孩在热闹的韩国时尚市场购物。 在整个视频中,始终保持同一个韩国女孩、同一张脸、同一发型、同一套服装、同一身体比例以及同一个黑色手提包。每个镜头之间都要保持强烈的人物和视觉一致性。 场景1——0-2秒: 韩国女孩穿过热闹的韩国市场,在一个服装摊位前停下。她在一排挂满漂亮连衣裙的大型衣架上翻看。画面中要有色彩缤纷的韩国招牌、拥挤的购物人群、温暖的室内灯光,以及真实的韩国市场氛围。使用流畅的中景侧面跟拍镜头。 场景2——2-4秒: 她从衣架上精心挑选了一条连衣裙,用手仔细触摸面料和细节。先对手部和连衣裙进行电影感特写,然后切到她面部表情的细微特写,展现积极反应。 场景3——4-6秒: 她将选中的连衣裙贴在身上,在店内的大镜子前查看效果。清晰展示镜中倒影。使用流畅的中景镜头,浅景深,动作自然真实。 场景4——6-8秒: 她决定购买这条连衣裙。韩国店员将裙子整齐折叠,放入干净的购物袋中。对包装过程、手部、裙子和购物袋进行特写拍摄。 场景5——8-10秒: 女孩一只手提着购物袋,肩上挎着黑色手提包,离开服装摊位。她自然地穿过热闹的韩国市场。使用正面/侧面的流畅跟拍镜头。 场景6——10-12秒: 她来到一部向下的自动扶梯前。她踏上正在向下运行的电扶梯,提着购物袋开始下行。必须清楚显示是电扶梯,而不是普通楼梯。使用后侧四分之三跟拍镜头,跟随她向下移动。 场景7——12-14秒: 在乘坐扶梯下行时,对女孩进行电影感特写,她微微抬头环顾市场四周。她的头发随着动作自然飘动。扶梯在她身后和身旁清晰可见。 场景8——14-15秒: 从后方拍摄广角镜头,她到达下行扶梯底部,提着购物袋走入拥挤的韩国市场人群中。以流畅的电影感淡出结束。 视觉风格:照片级真实感,电影感的韩国时尚市场氛围,温暖柔和的光线,真实的皮肤质感,自然的面部表情,浅景深,细腻的胶片颗粒感,真实的人群流动,流畅的镜头运动,高端商业广告质感,高细节,4K画质。 重要提示:在每个镜头中保持同一个女孩的身份和外观一致。从市场到扶梯的过渡必须感觉连续且真实。扶梯必须是自动向下运行的电扶梯,而不是静止的楼梯。
制作一段15秒的超写实个人家庭录像,画面中的女性与参考图中完全一致。在整个视频中,保持她的外貌、五官、发型、身材比例和身份完全统一。 场景:夏夜,一条安静的街边居民区。温暖的街灯照亮路面,周围有昏暗的树木、路边小店、停放的车辆,偶尔有远处驶来的车灯。环境显得普通,略带瑕疵。 服装:她穿着一件简单的白色休闲连衣裙,自然宽松,布料有真实的动态感。 动作:她随意地站在或坐在路边,手里拿着一份日常小零食。吃着吃着,一小块碎屑意外掉到她手上。她注意到了,试图用手指去接住,然后看向镜头,自然地笑了。她用纸巾擦了擦手,摇摇头,小声嘟囔了一句:“这也太糟糕了。”过了一会儿,又一小块碎屑掉到她手上。她直视镜头,带着无奈的小小笑容说:“我还在吃呢。” 视觉风格:像一段随手拍的2000年代初家庭录像。手持DV摄像机,构图不完美,轻微对焦失误,柔和数字噪点,轻微动态模糊,轻微镜头瑕疵,街灯下曝光不均,真实低光颗粒感。没有电影感构图,也没有精致商业广告感。 音频:自然的夜间街边环境声——远处车流、经过的摩托车、虫鸣、微风、偶尔的脚步声、零食包装袋的窸窣声,以及安静而自然的笑声。没有音乐、字幕或电影化音效。 表演要克制、笨拙、自然、真实,像人。整段视频应像一段意外录下的傻气夜间瞬间,而不是有脚本的表演。
风格:超写实电影感旅行vlog,自然手持镜头,充满活力的日本市场,真实日本街头氛围,逼真的人群流动,温暖日光,自然面部表情,流畅运镜,4K画质,16:9画幅。 场景1:三个女孩走进一个热闹的传统日本市场。红灯笼、彩色店铺招牌、小吃摊和人群环绕着她们。镜头从背后跟拍她们走进市场,表情兴奋又好奇。 场景2:女孩们逛着市场,观看传统日本店铺和招牌。一个女孩指向某个有趣的东西,其他人微笑着看向同一方向。镜头在她们周围自然移动。 场景3:她们在一个日本街头小吃摊前停下,兴奋地挑选不同的小吃。展示彩色食物的特写镜头、摊位上升腾的蒸汽,以及她们开心的反应。 场景4:女孩们一边喝着饮料一边聊天,穿过热闹的市场。她们自然地笑着,镜头平稳地跟拍她们,背景捕捉到充满活力的市场景象。 场景5:她们走进一家小纪念品店,浏览可爱的日本纪念品。一个女孩拿起一件有趣的物品给朋友们看,大家都笑了起来。 场景6:最后,女孩们开心地离开市场,回头望向色彩缤纷的街道。一个女孩朝市场挥手,镜头缓缓拉远,形成宽幅电影感画面。 镜头:流畅的手持旅行vlog运镜,广角定场镜头、中景、特写,自然动态模糊,轻微镜头抖动,真实自动对焦,电影感跟拍镜头。 氛围:快乐、冒险、友好、青春,真实的日本旅行体验。 负面提示:无文字叠加,无字幕,无水印,无扭曲面部,无多余手指,无不自然身体动作,无重复人物,无面部变化,无卡通感。
15秒逼真巨龙变身提示词 制作一段15秒的超逼真电影级奇幻片段,场景为一名20多岁的成年女性在茂密神秘森林深处的清澈河流旁,与一只小玩具龙玩耍。场景与角色:一名20多岁的美丽成年女性,自然外貌,逼真皮肤质感,长发飘逸,穿着简约大地色系休闲服装。她坐在森林浅溪旁光滑的岩石上,双手捧着一只细节丰富的小玩具龙,神态俏皮。环境完全真实且沉浸:茂密的绿色植被、布满青苔的岩石、柔和阳光透过树木洒落、漂浮的尘埃颗粒、逼真的水流动态以及自然的空间景深。0–4秒:以电影级中景开场,女性坐在河边,自然微笑,把玩着手中的小龙。她轻轻将玩具在空中移动,仿佛让它飞翔。使用轻微手持镜头运动与逼真的环境音效。阳光在她发丝与水面形成柔和的高光。4–7秒:她缓缓将玩具龙放入浅溪中,短暂将其完全浸入水下。玩具接触水面时,周围产生细微而逼真的涟漪与小波浪。女性好奇地注视着。7–11秒——变身:水面突然开始散发微妙的神秘能量光芒。小龙在水面下开始膨胀。其身体迅速增大,同时保持逼真的解剖结构与物理运动。鳞片自然地在身体表面形成,双翼展开,利爪伸出,长尾在水中扫动。变身过程应具有物理可信度与照片级真实感,而非卡通风格。随着生物从小玩具成长为庞大威严的巨龙,水花自然飞溅。11–15秒:巨龙从河中震撼升起,高耸于女性之上。水流从其巨大的鳞片与双翼上倾泻而下。它展开巨大的翅膀,发出一声强劲而逼真的咆哮,回荡在森林之中。女性后退一步,神情真挚惊叹,反应自然可信。以宽幅电影镜头收尾,将女性、巨龙、河流与周围森林同框呈现,营造出令人震撼的尺度感。视觉风格:超写实真人电影级奇幻,好莱坞水准视觉特效,物理精确的水体模拟,逼真的龙类解剖结构,精细的独立鳞片,自然的皮肤与毛发质感,体积光,真实阴影,空间景深,轻微胶片颗粒,高动态范围,逼真动态模糊,全画幅电影摄影机质感,35mm镜头,适当浅景深,自然调色,高度精细的环境,角色与生物无缝一致。重要要求:全程保持女性的外貌、发型、服装与面部特征一致。变身过程中保持龙的设计一致。变身必须平滑连续,实际变身过程中不得有剪切。避免卡通美学、动漫风格、CGI塑料质感、夸张面部表情、不自然身体动作、闪烁、形变伪影、多余肢体、畸形解剖或突兀场景切换。

关于 Seedance 2.0

Seedance 2.0 是字节跳动的视频生成模型,最本质的特点是它以「镜头序列」而非「单个片段」来思考。多数模型只能输出一个连续镜头,Seedance 却能在一次生成里让主体贯穿多个镜头——远景交代、切近景、再切反应——角色台词自带原生对嘴,声场还带空间定位。

这让它成为「讲一个小故事」时的首选:两个角色的一段对话、切三个机位的产品揭幕、一句必须「像真说出来」而不是配音贴上去的台词。业界评测普遍将它列入当前最强的视频模型之列,而它的杀手锏正是这种导演式的分镜控制力。

但多镜头能力是双刃剑——提示词写得含糊,模型要替你做的决定就太多,剪辑点会散掉。写成明确分镜清单、台词有标记的提示词,才是连贯序列与支离破碎之间的分水岭。下方画廊收录了经过验证的 Seedance 提示词及真实输出,你可以直接从一个已经跑通的结构开始。

如何写好 Seedance 2.0 提示词

  1. 1把提示词写成编号分镜清单——「镜头1:远景交代…… 镜头2:切特写……」。Seedance 对明确的序列结构的服从度,远高于一大段连写。
  2. 2每个镜头行里都重复角色的辨识特征(服装、发型、体型)。跨镜头保持同一个人,靠的就是描述词的一致性。
  3. 3台词要明确标记并注明说话人:那个女人说:「天亮就出发。」带引号、有归属的台词才会触发精准对嘴。
  4. 4指挥空间音频——写清声音从哪来:「脚步声从画外左侧逼近,人群嘈杂声在她身后」。方位提示让混音有三维感。
  5. 5每个镜头只承担一个任务:交代、揭示或反应。往一个镜头里塞两个叙事节拍,是剪辑混乱最常见的原因。
  6. 6控制角色数量——一到两个说话角色为宜。每多一个说话人,跨镜头的连贯性和对嘴负担都会成倍增加。

常见问题

Seedance 2.0 最擅长什么?

一次生成完成多镜头叙事:在不同机位间切换、角色保持一致的序列,台词自带原生对嘴,空间音频让声音落在场景里。如果你的创意需要不止一个镜头才能成立,Seedance 就是为此而生的。

怎样为 Seedance 2.0 写多镜头提示词?

把提示词组织成明确的分镜清单——每个镜头编号、只赋予一个目的,并在每个镜头里重复角色描述,跨切换才能保持身份一致。本页的验证提示词展示了这套写法,复制一条,换成你自己的故事节拍即可。

Seedance 2.0 支持对嘴和台词吗?

支持——对嘴是原生能力。把台词放进引号并注明是哪个角色说的,生成的语音会与口型匹配。它还渲染空间音频,所以描述声音的来源方位是值得的。

在哪里可以使用这些 Seedance 提示词?

Seedance 可通过字节跳动的即梦 AI(Dreamina)创作平台使用,开发者可走火山引擎 API 接入。从本页复制任意提示词粘贴过去,把分镜清单改成你自己的场景即可。