你是一名专业的 AI 电影导演和 Seedance 2.5 视频提示词工程师。创建一段 10 秒真人电影质感的女子乐队 live performance。整支视频必须像真实摄影机在同一时空内拍到的一场连续发生的现场表演,而不是静态图拼接、独立人物轮流展示或简单 lip sync 测试。
【主体 + 参考】
主体:一支带有 K-pop 舞台掌控感、夏日广告活力、现代流行节奏感与真实乐队能量的四人女子乐队 live performance。她们在同一个仓库式改造舞台上同步表演,主唱演唱,其他成员真实演奏。全片绝对不是四张单独人像的轮播,也不是四段互不相干的独立特写,而是一个完整存在的乐队空间。10 秒全程只有主唱获得独立主镜头,其余三位成员始终真实存在于空间中,作为背景层次、乐队完整性和节奏真实感来源,但不抢夺视觉中心。
@[Image 1](image_1) 作为舞台与环境唯一绝对参考:裸露灰色混凝土墙面、后墙暗红氛围光块、顶部钢结构桁架、白色体积光束穿透雾气、中央银色多镲片鼓组、左右黑色蒙布吉他音箱柜与立式备用吉他架、中央人声话筒立杆、地面多组效果器踏板矩阵。严格保留场地布局比例、器材相对位置、灯位高度、投射角度与雾气基础密度,不改变建筑几何结构,不新增或删减灯具,不把舞台改造成其他风格空间。
@[Image 2](image_2) 作为主唱面部、身份、发色、妆容与服装绝对参考:鲜红色中分顺直长发、金属鼻梁夹、烟粉色晕染眼影配黑色上扬眼线、自然肤色、黑色亮面机车皮革夹克、多枚宝石戒指。她是全部 10 秒唯一视觉主角,全部镜头都围绕她建立。
@[Image 3](image_3) 作为二号吉他手面部与身份绝对参考:粉调渐变高马尾配银色金属圆珠发圈、金属鼻梁夹、耳骨多枚耳钉、银色粗链条项饰层叠佩戴、多枚戒指、黑色皮衣外套内搭白色卫衣。她只作为背景乐队成员存在,不获得独立主镜头。
@[Image 4](image_4) 作为鼓手面部与身份绝对参考:红棕色顺直长发中分、深红哑光唇妆、金色小号圈式耳环、肤色白皙带自然高光。她是后方节奏锚点,只作为背景鼓手存在,不切入独立主镜头。
@[Image 5](image_5) 作为台左吉他手的发型、体态与服装唯一参考,绝对不用于面部信息。该成员全程佩戴不透明独角兽面具:哑光米白色硬壳材质,完整覆盖前额至下颌与两颊,任何镜头、任何角度、任何光线下都不可暴露真实五官。仅提取深棕色顺直中长发、肩颈比例、黑色漆皮蓬袖机车外套廓形、黑色蕾丝内搭与暖金色饰品位置。她也只作为背景乐队成员存在。
【@[Audio 1](audio_1) — ABSOLUTE FINAL AUDIO / RUSSIAN LANGUAGE PRIORITY】
@[Audio 1](audio_1) 是单独上传的、已经完成的、真实存在的俄语歌曲片段,也是最终视频必须直接使用的原始完整音轨。它不是风格参考,不是 guide track,不是供模型模仿的范本,不是让模型“生成类似效果”的参考音频。
CRITICAL RULE:
FINAL VIDEO AUDIO = THE EXACT ORIGINAL UPLOADED @[Audio 1](audio_1) FILE.
这意味着:
最终视频中的声音必须直接来自上传的 @[Audio 1](audio_1) 本身,而不是由模型重新生成、重新演唱、重新配音、重新合成或重新模仿的版本。必须保留该文件中的原始人声、原始音色、原始咬字、原始俄语发音、原始旋律、原始节奏、原始配器、原始混音、原始响度关系、原始动态、原始空间感、原始声像与原始时长。
绝对禁止:
— 重新演唱;
— voice cloning;
— AI 重新配音;
— 替换 vocal;
— 替换伴奏;
— remix;
— remaster;
— stem separation;
— 重新平衡人声与伴奏;
— EQ;
— compression;
— normalization;
— denoise;
— pitch shift;
— speed change;
— time stretch;
— crop;
— fade in / fade out;
— 添加现场欢呼、掌声、环境声、额外 SFX、额外人声、额外 double vocal、额外 echo、额外 ad-lib;
— 添加“更像现场”的房间混响;
— 添加任何音轨中本来不存在的音频元素。
最终听感必须与上传文件完全相同,不是“差不多”,不是“同风格”,不是“更干净版”,而是原文件本身。
该片段时长固定为 10 秒。视频必须从 @[Audio 1](audio_1) 第一个实际采样点开始,到最后一个实际采样点结束,严格一一对齐。
歌词顺序只在本节书写一次,作为唯一规范歌词顺序:
1. «Забирай этот вкус с собой»
2. «Сочный арбуз и чистый кайф»
3. «Солнце горит, лето кипит»
4. «Дирол прямо сейчас тебя освежит»
如果上传音频中某些词存在更口语化、更连读、更压缩的演唱处理,例如轻微吞音、少量连写、词尾弱化、singular/plural 差异、或者“освежит”在实际演唱中听起来更短、更贴合节奏,那么始终以 @[Audio 1](audio_1) 中真实听到的发音为准,而不是机械照抄文字。
如果音轨尾部存在短促的无实义 vocal tail、节奏性呼气、哼唱尾音或极短辅助 vocal,画面只同步音频中真正存在的部分,不得自行补充、延长、二次重复或人为美化。
ONE-WAY AUDIO PLAYBACK / NO REPETITION:
整个 10 秒音轨必须像一条只向前播放一次的连续时间轴。每个词、每个音节、每个音素都只能在其真实时间点被表演一次。禁止回退、回唱、复读、补唱、重复尾字、循环音节、结巴式重复、回声式重复、因为切镜而重新起句、因为强调而额外重复某个词、因为动作过猛而把同一单词表演两次。若音频中某个词只出现一次,画面中的口型也只能出现一次。
这是明确的 RUSSIAN NATIVE LIP SYNC TASK。
主唱的嘴部 articulation 必须被 @[Audio 1](audio_1) 的真实俄语发音逐音节驱动:
— 元音张口幅度;
— 辅音阻塞;
— 双唇闭合;
— 圆唇;
— 牙唇接触;
— 下颌升降;
— 句尾收口;
— 重音位置;
— 换气位置;
— 词与词之间的衔接;
都必须来自真实音频。
不能使用英语式 singing mouth shapes。
不能使用 generic singing lip sync。
不能只跟拍点张嘴。
不能只在一句开头和结尾大概同步、中间模糊带过。
不能因为镜头切换就重置句子。
不能因为身体动作活跃就牺牲口型准确性。
如果任何视觉设定、近似秒数或镜头结构与音频真实时间轴发生冲突:
永远以 @[Audio 1](audio_1) 为准。
【SUBJECT_HIERARCHY(信息冲突时按此裁决)】
@[Image 2](image_2) = 主唱绝对面部身份与唯一视觉核心。
@[Image 3](image_3) = 二号吉他手背景成员。
@[Image 4](image_4) = 鼓手背景成员。
@[Image 5](image_5) = 面具吉他手背景成员,真实面部完全作废。
@[Image 1](image_1) = 舞台环境、器材布局、灯位与雾气密度绝对参考。
@[Audio 1](audio_1) = 最终原始音轨,也是歌词、俄语发音、lip sync、旋律、节奏、配器与表演能量的唯一绝对来源。
AUDIO TIMING + ORIGINAL SOUND + RUSSIAN ARTICULATION
优先级高于所有镜头动作、头发动作、灯光表现、镜头切换与近似时间。
四人发色(正红、粉调渐变、红棕、深棕)不得互相串染。四人的位置、朝向与器材归属保持稳定,不得混淆成员身份。
【核心导演目标】
这不是老版本那种“前段受控、后段突然进入重型 scream 爆发”的结构。新的 10 秒音轨是一段连续、明亮、轻快、鲜活、朗朗上口、具有夏日广告感与 K-pop 节奏感的俄语歌曲片段。视觉处理必须与这种明亮流动的 pop energy 对应。
整体气质:
— 鲜活;
— 时尚;
— 有舞台感;
— 有乐队真实感;
— 有夏日轻快广告气息;
— 有节奏推动力;
— 不阴郁;
— 不压抑;
— 不搞恐怖;
— 不搞重型金属爆发;
— 不加入旧版本的口语停顿与重型 breakdown;
— 不制造音轨中根本不存在的 scream / growl / Nu-Metal 转折。
10 秒的能量弧线应理解为:
开场立即进入歌词与节奏;
中段保持顺滑推进与连续吸引力;
最后一句到达最强的商业 hook 高点;
然后在音轨真实结束处干净收尾。
摄影机、灯光、雾气、表演动作都要跟着这条连续 pop 时间线工作,而不是误以为中间会有 genre switch。
主唱必须像一个真正正在 performing 的乐队 frontwoman,而不是站桩做嘴型测试。她必须带着自信、轻盈、掌控力与一点俏皮感去唱这段歌,同时嘴型依然精确、可读、逐音节同步。
其他三位成员始终存在于同一空间里,持续演奏,提供真实 band atmosphere。她们的存在要让人相信这确实是一支四人女子乐队的 live performance,但镜头绝不离开主唱去单独讲别人的故事。
【人物表演与物理动作】
主唱(@[Image 2](image_2)):
她是全片唯一视觉主角。视频第一帧时就已经必须对齐 @[Audio 1](audio_1) 第一个实际可听音节。不得在视频开头出现等待、准备、额外吸气、摆姿势、倒数或晚一拍开口。
她的整体表演状态:
— 自信;
— 鲜活;
— 有控场感;
— 略带 playful pop star energy;
— 不浮夸;
— 不假笑摆拍;
— 不僵硬;
— 不只是静止唱歌。
她双手主要扶握中央话筒架。抓握可以随节拍自然调整。肩部、锁骨、颈部、上半身和头部随着音乐有真实律动。红色长发会因为自然头部动作、轻微转身与节拍带动产生真实摆动,再按重力回落。表演要活,但不能活到把嘴完全遮住。
嘴型必须高度可读:
— 每个词开始时的开口;
— 词中辅音与元音变化;
— 闭唇;
— 圆唇;
— 下颌抬降;
— 词尾收口;
都必须来源于真实俄语人声。
她可以:
— 偶尔短暂看向镜头;
— 在某些节拍点轻微抬下颌;
— 在某句进入时带一次自然前倾;
— 在最后一句 hook 里稍微增加发声力度与身体推动感;
— 在句与句连接处有极短、自然的换气;
但这些都不能破坏 lipsync。
她不可以:
— 做重型 scream;
— 做旧版那种猛烈甩头;
— 用夸张口型假装唱高音;
— 因为动作大就吞掉歌词;
— 把一个词表演两次;
— 把本来一拍内的短词拉长成两拍。
最后一句可以成为整段表演最高点:手部抓握更有力、身体更前一点、眼神更明确、发丝摆动更明显一点、镜头更靠近一点,但仍然是 pop-commercial push,而不是 metal breakdown。
二号吉他手(@[Image 3](image_3)):
她始终真实演奏,身体有节奏性前倾和回弹,拨弦手腕与高马尾摆动对应音轨节拍。她只能作为背景乐队成员存在,不进入独立主镜头,不抢夺视觉焦点。
鼓手(@[Image 4](image_4)):
她始终真实击打鼓组,鼓棒的抬起、接触和回弹与实际节拍对应,是后方节拍锚点。她可以被看到,但不能成为镜头主语。
独角兽面具吉他手(@[Image 5](image_5)):
她始终真实演奏,吉他和身体有自然惯性与小幅摇摆。面具绝对不透明,不暴露真实面部。她也只作为背景存在。
四位成员的动作不需要机械完全同步,允许自然生理延迟,但关键拨弦、鼓击与表演推进要服从 @[Audio 1](audio_1) 的真实节拍逻辑。
【时间线 / 分镜】
全片 10 秒,4 个镜头。以下秒数只用于定义镜头区间的大致结构;真实开口、闭口、换气、词边界与句尾结束必须服从 @[Audio 1](audio_1) 实际时间轴。全部镜头都只服务主唱。切镜后绝不重启当前歌词。
0.0–2.4s
【镜头一・中广景建立主唱・约24mm・低机位仰拍】
从舞台前方略低机位拍向中央话筒位,但不要做那种平均展示四人的完整横向大广角。主唱在第一帧就已经准确唱出第1项歌词,并从音频第一个真实音节开始同步。
她位于视觉中心,双手扶住话筒架,身体带有顺着节拍的轻微律动。摄影机有真实手持呼吸感,并做很轻的节奏性前移,建立“live camera 正在进入她的表演空间”的感觉。背景中三位成员都在真实演奏,空间完整可感,但不会分散注意力。
这一镜头要完成三个任务:
1. 立即建立主唱是唯一视觉重心;
2. 立即建立这是一段真实正在演唱的俄语歌曲,而非摆拍;
3. 立即让观众相信现场空间真实存在。
光束和雾气此时已经活着:白色体积光束在雾气中可见,暗红后墙为环境提供舞台层次。光线活跃但不暴力,镜头不做突兀急冲。嘴部必须从一开始就清楚可读。
2.4–4.9s
【镜头二・主唱中近景・约35mm・正面偏左15度】
硬切进入主唱中近景,切镜后继续同一条音频时间轴,不重新起句。此镜头主要承接第2项歌词。镜头更贴近主唱的面部、嘴部、肩颈与话筒关系,使 lip sync 清晰可读。
摄影机在她前方偏左约15度位置,随她的自然动作做小幅跟随,有一点真实操作者修正。她可以短暂看向镜头,像在直接把这句 hook 送给观众。红发随着轻微转头扫过肩线,不能遮住唇形。
光柱可短暂扫过鼻梁夹、耳饰和皮革夹克,在金属和亮面皮革上形成短促真实反光。背景成员保持虚化但仍在演奏,从而延续真实 band space。这个镜头要让人清楚看见快速俄语词句仍然被准确唱出来,而不是模糊糊过去。
4.9–7.4s
【镜头三・主唱更贴近的半身近景・约50mm】
镜头进一步贴近主唱,保留胸口以上、话筒架、手部、肩颈、嘴部与面部表情。此镜头主要服务第3项歌词。
这是全片最需要看清楚 articulation 的镜头之一。嘴唇不能被话筒、头发、雾气或运动模糊持续挡住。主唱继续准确演唱,不省略、不加速、不复读任何词。摄影机做一次受控而顺滑的靠近,产生轻微惯性回稳,让观众感到表演正在升温,但仍保持流畅、轻快和商业感。
主唱的表演能量在这里自然上升:手部抓握略有力度、肩部推进更明显一点、眼神更集中一点、上半身更积极一点,但仍然是 pop-frontwoman 的推进,而不是重型音乐的爆发。
7.4–10.0s
【镜头四・主唱动态收尾・约28–35mm・节奏性横向与前后运动】
最后镜头仍只拍主唱,可略微拉开到半身或中近景,让话筒架和部分舞台空间重新进入画面。此镜头主要完成第4项歌词,并在最后收束到原始音频的真实终点。
这是全段最明亮、最有推动力的 hook 高点。主唱可以更有力地抓握话筒架,身体顺重拍有一次更清晰的前倾与回弹,红发出现一次较大但仍然受控的真实摆动。摄影机随节拍做一次更明确但流畅的前推,再自然回稳。光束可在这个时刻更明显地扫过她,雾气被动作与空气扰动轻微搅动,增强 performance climax 的临场感。
如果音轨尾部有极短非词汇 vocal tail、呼气或节奏性尾音,只同步音频中真实存在的部分,不自行延长。最后一个实际音节结束时,嘴部与发声动作必须同步结束。不得提前闭口,也不得在音频已经结束后继续“唱”。在 @[Audio 1](audio_1) 最后一个实际采样点处 HARD CUT,不做淡出,不添加结尾镜头,不虚构尾巴。
【场景 / 环境】
场景严格继承 @[Image 1](image_1):改造仓库式舞台,裸露灰色混凝土墙面可见浇筑纹理与轻微磨损痕迹;顶部外露钢结构桁架;后墙暗红氛围光块;冷白色摇头灯光束穿透雾气形成明显体积光;中央银色多镲片鼓组;左右吉他音箱柜;立式备用吉他架;中央话筒立杆;地面效果器踏板矩阵与连接线。
舞台不是无菌影棚,也不是脏乱地下室,而是有风格、有层次、有现场呼吸感的 industrial performance space。所有空间元素持续存在,但它们只服务于主唱所在的真实 live 环境,不反客为主。
【空间关系与连续性】
话筒固定舞台中央。
鼓组固定其后。
二号吉他手固定在台右区域。
独角兽面具吉他手固定在台左区域。
全部镜头中,四人相对站位、乐器朝向、器材位置与相互距离保持连续一致,不突然跳位。
摄影机始终位于台前观众一侧,不穿越到舞台后方,不从不合理的上帝视角俯视。空间的成立依靠主唱镜头中的背景层次、景深与构图,而不是依靠切去拍别人的独立镜头。
【构图】
四个镜头全部围绕主唱建立:
— 镜头一:中广景建立,主唱是明确中心;
— 镜头二:中近景,主唱面部与嘴部更清晰;
— 镜头三:更贴近的半身近景,强化 articulation;
— 镜头四:动态收尾,仍以主唱为唯一主角。
绝不平均分配构图给其他成员。
绝不让背景成员在画面中变成新的主体。
绝不为了“丰富”而打断主唱的连续表演。
【摄影语言】
全片摄影机像一个真正站在台前、离主唱很近的 live-performance second camera:
— 有轻微手持呼吸感;
— 有节奏性靠近;
— 有真实操作者的小修正;
— 有随节拍形成的惯性回弹;
— 有跟随人物动作的自然响应。
但它不是:
— 失控乱晃;
— 无动机甩镜;
— 炫技式数字运镜;
— MV 式疯狂快切;
— 重型金属现场那种猛烈撞击感。
镜头能量随音轨连续推进:
开场已鲜活,
中段流畅推进,
最后一句到达最强的商业 hook 推动力。
不发生 genre switch。
不人为制造冲击断层。
不把最后一句拍成重型 breakdown。
当光束扫过主唱或镜头前方时,可有短促自然过曝,随后立即回稳。所有摄影动作都要服务于三个优先级:
1. 主唱是唯一视觉重心;
2. 嘴部 articulation 必须可读;
3. 与原始音轨的连续时间轴保持完全一致。
【前景与实体转场】
所有前景层次都来自舞台已有实体:
— 话筒立杆;
— 发丝;
— 雾气层;
— 背景器材边缘;
— 体积光束。
镜头切换不依赖数字特效、白闪、glitch 或速度线。空间变化由镜头位置变化、主唱身体运动、光束扫动与雾气流动共同完成。绝不通过切去别人来实现“转场”。
【镜头 / 对焦 / 光学效果】
主要使用 24mm、35mm、50mm、28–35mm 这一组焦段。
景深整体浅至中等。
主唱面部与嘴部必须始终足够清晰,以便直接判断俄语 lip sync 是否准确。
不能因为浅景深让嘴持续失焦。
不能让话筒长时间遮挡唇部。
不能让运动模糊吞掉关键发音。
对焦必须是物理合理的连续过程,不瞬间乱跳。允许自然镜头光晕、雾气散射、focus breathing 与运动模糊,但它们必须来自真实光学和真实运动,而不是后期特效堆叠。
【曝光 / 光线】
主光源为顶部冷白色摇头灯光束。
辅助环境光为后墙暗红氛围光块。
整体曝光保持真实高对比舞台逻辑,不做影棚式平均提亮。
第一优先任务始终是:
确保主唱的脸、嘴唇、下颌、眼睛、鼻梁夹、红发和手部在整段 10 秒内始终可读。
高光可以在光柱扫过时短暂溢出。
暗部保留真实阴影。
背景成员与器材可以更暗、更退后,但不能消失。
金属饰品与皮革材质在光束扫过时产生短促真实高光。
暗红环境光不能把主唱肤色整体染脏。
【色彩】
冷白光束:#E8EDF2
暗红环境光:#6B1F26
混凝土灰:#3A3A3D
雾气灰白:#C9CDD1
鼓组冷银:#B8BCC0
效果器琥珀点缀:#D98A3D
主唱鲜红发色是全片最强视觉撞色重点。
整体色彩必须保持时尚、鲜活、具有舞台感与商业感。
【图像质感】
整体为写实现场演出质感,带轻微颗粒、雾气造成的柔和漫射与真实镜头呼吸感。避免过度锐化、塑料皮肤和假 CG 感。
自然运动模糊主要来自:
— 红发摆动;
— 身体律动;
— 手部抓握;
— 背景乐手演奏;
但关键口型必须始终可读。
质感方向是:
真实、电影化、时尚、轻快、有现场存在感,
而不是粗暴、脏乱或故意 lo-fi。
【声音 / RUSSIAN VOCAL SYNC】
再次强调:
最终视频必须直接保留并使用上传的 @[Audio 1](audio_1) 原文件。只生成画面,不重新生成任何声音。
AUDIO CHRONOLOGY IS LOCKED:
音轨从 0.0 秒到 10.0 秒连续、单向、原速播放一次。不能回退、循环、重新开始某句、重复刚刚结束的词、因为切镜而把上一句重来一遍。切镜只能改变画面,不能改变声音时间轴。
RUSSIAN LIP SYNC = ABSOLUTE PRIORITY:
主唱的开口时间、闭口时间、每个词的起始、每个词的结束、每个音节、双唇闭合、圆唇、下颌位置、辅音阻塞、元音变化、重音与换气都必须来自原始人声。从第一个实际可听音节同步到最后一个实际可听音节。
如果首词被切入点截在中间,只同步实际听见的部分,不补唱词头。
如果某句很快,也必须跟随真实速度完成全部口型,不减少嘴型数量。
如果某个尾音很短,也必须短而准确,不拉长美化。
如果视觉动作与 lip sync 冲突,永远牺牲动作,保口型。
背景成员只做与音轨同步的演奏动作,不得向最终声音增加新的鼓、吉他或环境声。
【剪辑与转场】
全片只有 4 个镜头。
全部镜头都只拍主唱。
不切去其他成员独立表演。
不增加无意义插镜。
不使用数字转场。
不使用白闪。
不使用 glitch。
不使用速度线。
不使用无动机随机甩镜。
每一次切换都服务于同一件事:
更好地观看主唱在一条连续不间断的 10 秒俄语音轨上完成完整表演,同时 lipsync 始终准确、可读、不断线。
【物理规律】
所有发丝、服装、乐器、饰品、雾气、光束与材质逻辑都要遵守真实物理:
— 发丝有重量与空气阻力;
— 雾气响应人物动作和空气流动;
— 鼓棒与镲片有真实回弹;
— 吉他随身体动作产生自然惯性;
— 连接线自然摆动;
— 皮革与金属反光与真实光位一致;
— 独角兽面具是刚性、不透明硬壳,不变形、不透光。
【质量与连续性】
主唱面部身份、红发、鼻梁夹、眼妆、皮革夹克与戒指在 4 个镜头和整段 10 秒中保持严格一致。她始终是唯一视觉核心。
背景三位成员的身份、发色、服装、站位和器材归属保持一致。
舞台布局、灯位、光束数量、雾气基础密度、器材位置、相对距离与空间朝向保持完全连续。
不得出现人物瞬移、器材跳位、光线系统突然变化、雾气无原因断裂或人物身份混淆。
MOST IMPORTANT:
RUSSIAN LIP SYNC MUST REMAIN ACCURATE ACROSS ALL FOUR SHOTS.
镜头切换不能重置 lipsync。
切镜不能使刚结束的单词再出现一次。
切镜不能导致句子重新起头。
每个镜头都必须继续 @[Audio 1](audio_1) 当前真实时间点。
【禁止】
不得切去其他成员的独立主镜头。
不得平均分配四人镜头。
不得让其他成员“假唱”主唱歌词。
不得让主唱只是其中一个人,她必须从头到尾是唯一视觉中心。
不得改变 @[Audio 1](audio_1)。
不得重新生成、替换、重唱、翻译、改写、remix、remaster、裁切、变速、变调、拉伸、压缩、归一化、降噪或重新混音。
不得添加观众、掌声、房间混响、额外人声、额外鼓吉他、SFX 或环境声。
不得使用英语式口型。
不得使用 generic singing mouth animation。
不得只跟拍点张嘴。
不得出现口型提前、滞后、逐渐漂移、切镜后重启、单词复读、音节循环、尾字回放、结巴、双重口型、回声式复唱或音轨中不存在的 ad-lib。
不得虚构 scream、growl、Nu-Metal breakdown、口语停顿、突然 genre switch 或原始音轨中不存在的能量断层。
不得用头发、话筒、雾气或运动模糊长期遮挡关键发音。
不得生成歌词字幕、品牌名称或其他可辨读文字。
不得暴露独角兽面具成员真实面部。
不得无动机抖动、白闪、数字 glitch、速度线、人物瞬移、器材跳位或光雾系统突变。
【FINAL ABSOLUTE PRIORITY】
USE THE EXACT UPLOADED @[Audio 1](audio_1) AS THE FINAL UNCHANGED SOUNDTRACK.
GENERATE VISUALS ONLY.
The audio is a finished 10-second Russian song clip, not a style reference. Preserve the exact original vocal, pronunciation, timbre, melody, arrangement, mix, dynamics, stereo image, loudness relationships, processing, speed and duration. Do not regenerate, imitate, enhance, remix, remaster, normalize, denoise, crop, stretch or add any sound.
Follow only the single canonical lyric order defined once in this prompt. ONE-WAY PLAYBACK ONLY: every word, syllable and phoneme may be performed once at its actual timestamp. Never repeat a word, replay a phrase ending, loop a syllable, restart after a cut, add a stutter, echo, ad-lib or second articulation absent from the file.
Native Russian lip articulation must stay synchronized from the first actual audible sample to the last actual sample. Real audio chronology and exact original sound override camera movement, head movement, hair movement, shot changes and all approximate timings.
这 10 秒始终只属于主唱:
她沿着原始音轨连续向前演唱,
每个俄语词只表演一次,
最终声音必须与上传文件完全相同,
画面则完整、真实、鲜活、电影化地服务这段原始表演。