最后更新于
借助 AI 导演智能体将歌曲制作成完整的音乐视频——每一项关键创意决策都由您掌控。
Music Video 将一首歌转化为一支完整、经过全面剪辑的音乐视频。你将与一个 AI 智能体协作—— 导演 ——它负责剧本撰写、选角、场景设计、编舞、分镜、视频生成和剪辑。你始终掌握创意决策的主导权。
导演是一个单一智能体,负责从头到尾完成整套制作流程,而且它只对你负责。制作的每个相位都由专门的 技能 ——一套专业流程手册,导演会在该相位开始时接手,就像电影导演在不同部门简报之间切换一样。你有时会看到导演在聊天中阅读或使用某项技能;仅此而已——技能会自行运作,你无需管理它们。
在整个制作流程中,它的表现如下:
创意策划
撰写创意方案和每个镜头的脚本
创意方案、镜头脚本
选角
设计角色的基础外观和每个场景的造型
角色设定图(多视图)、分场景造型
美术与分镜
定义视觉风格、设计场景环境、绘制分镜
风格指南、场景参考、分镜
编舞
设计舞蹈和表演动作,创建运动关键帧网格
编舞文档、运动关键帧
摄影
撰写生成提示词、运行视频生成、处理唇形同步优化
最终视频镜头
从你的 ACE Studio 工程开始——一首你制作的歌曲,或你导入的成品轨道。导演会将其按你的歌曲进行渲染,分析它,并向你提出四个问题:视觉风格、叙事方式、主角和宽高比。
导演会沿着整条流程推进——创意方案、选角、场景设计、镜头脚本、造型、可选编舞以及分镜。你会在每个里程碑进行审阅并提供反馈。
分镜会被放置在 画布 中作为动画分镜,这样你就能在任何内容渲染之前预览整支视频的节奏。
当一切准备就绪后,你发出开始指令。镜头会并行渲染,自动替换分镜,演唱镜头还会经过一轮唇形同步优化。
观看结果,然后提出修改——只有受影响的镜头会被重新生成。
完整流程请参阅 创建音乐视频。关于修订、手动编辑以及恢复工程,请参阅 编辑与迭代.
Music Video 会在音乐分析、图像生成、视频生成以及 Agent LLM 使用中消耗积分。
音乐分析
音乐分析
每次请求
约每分钟 20
图像模型
Midjourney
每次请求
20
图像模型
Nanobanana
每次请求
25
图像模型
GPT Image 2
每次请求
15
图像模型
Qwen Image Multiple Angles
每次请求
7
视频模型
Seedance 2(1080p)
每秒
68
视频模型
Seedance 2(720p)
每秒
34
视频模型
Lipsync 3
每秒
25
智能体
Agent LLM Tokens
基于实际 Token 用量
随任务而异
最后更新于