先说清谁跳、谁看
“替换两个人”留下了太多解释空间。双人模式可以先写:@Image1 是穿燕尾服的微型舞者,@Image2 是坐着观看的正常体型人物,每个镜头都保持身份独立。
场景截图提供谷仓和脚步信息,不是第三个人的身份图。加入太多原舞者的面孔,反而可能削弱你希望保留的新人物。
来源:
像描述摄像机能拍到的事情一样写
先用三秒全景交代舞者和旁观者,再切反应特写,返回舞步与手臂动作,接一个脚部细节,最后回到双人画面和结尾反应。这个顺序给模型的是一个过程,而不是一堆形容词。
动作重要时写清方向和幅度,例如抬起脚跟、小幅横向踏步、屈肘、转向旁观者。“有趣、电影感、爆款”不能告诉人物脚放在哪里。
来源:
第一次生成后,一次只改一个问题
本站已经提供各模式的完整默认分镜,不需要从零写。舞者正确但旁观者身份变化时,先加强旁观者分工,不要同时改灯光、服装和动作。场景太复杂时,先减少额外参考。
想保留梗的识别度,就保留微型舞者、深色燕尾服和稻草房间。可以调整表情与表演强度,但指令必须彼此一致。
来源:
文字分镜是重创作,不是描摹原视频
当前生产工具提交身份照片和两张场景截图,不提交参考视频。即使描述仔细,新画面的动作顺序和角度也可能变化。需要原动作完全不变时,用字幕编辑器覆盖既有片段更合适。
目前输出 15 秒、16:9,提供 480p 和 720p。检查效果时同时看身份、角色、全景和特写,不要用一张好看的截图判断双人视频。
来源:
常见问题
需要自己写全部提示词吗?
不需要,每个角色模式已经有默认分镜,选好后可以修改。
可以上传原视频做参考吗?
当前流程使用照片和场景截图,没有参考视频上传。
提示词越长,舞步就越精确吗?
不会。角色分工和一致指令比长度更有用,截图重建仍可能改变动作。