All models

maestro

maestroVideo
0.6 Credits
Get your API key
maestro

从自然语言创意到带字幕的多语言成片

Maestro 是以 AI 导演为核心的视频生产服务。描述主题、受众与表达目标后,它会组织脚本、画面、配音、配乐、字幕和渲染,把创意推进为完整成片。它适合知识解说、产品宣传和多语言内容制作,也能结合图片、视频、音频素材,在已有项目上继续修改或延展。

Maestro模型品牌
视频模型类型
视频任务能力

规格与接口特性

在选型前明确容量、输入输出与调用方式。

创作输入
自然语言 prompt;可附图片、视频、音频 URL,最多 20 项
目标时长
5–300 秒,默认 30 秒
画幅选择
9:16、16:9、1:1;默认 9:16
多语言制作
单次最多 4 种语言;默认 zh-cn,第一种为主语言
视频类型
auto、narrated、captions、avatar、drama
创作动作
generate、remix、edit、extend
交付方式
异步任务;完成后获取带字幕的成片及各语言版本

以上为 Maestro 视频生产入口的创作与调用规格,目标时长不等于精确成片时长。

核心能力

了解 maestro 能为你的工作带来什么。

把创意组织成完整视频

Maestro 不只生成画面,而是把选题、脚本、旁白、配乐、字幕和剪辑串成制作流程。提示词可写清观众是谁、需要讲明什么、开场如何吸引注意以及结尾如何收束,让创作围绕表达目标展开,适合从内容简报直接启动制作。

同一套画面,多语言表达

通过 langs 指定语言,第一种作为主语言,其他语言复用同一套画面,再完成对应配音与渲染。中文、英语、日语等版本可在同一次任务中组织制作,减少重复准备视觉内容的工作;交付结果按语言区分,便于分别发布。

基于已有项目继续创作

成片之后不必每次从零开始。remix 用于保留主题并调整表现,edit 用于标题、配音或配色等局部修改,extend 用于延展内容。提供历史任务 ID 和明确的修改要求,即可启动新的迭代任务,逐步完善同一个视频项目。

适用场景

从具体任务出发,找到模型发挥作用的位置。

知识解说与教程短片

输入一个概念、教程要点或整理好的文章内容,说明观众基础与希望保留的结论,选择 narrated 制作解说视频。交付物包含画面、旁白和字幕,适合把文本内容变为便于观看的短片;关键术语和必须出现的信息应在提示词中写明。

产品宣传与品牌内容

附上产品图、logo 等参考素材,描述卖点、受众及希望呈现的视觉气质,再选择横屏、竖屏或方形画幅。可用 modern、luxury 等预设组织观感,用旁白音色配合表达;成片后继续修改标题或配音,形成不同宣传表达。

已有视频加工与海外分发

为已有素材添加字幕时,使用 captions 并提交源视频 URL;需要跨语言传播时,在 langs 中选择目标语言。前者侧重已有视频加工,后者侧重同一视觉内容的多语言交付,可分别用于素材整理与产品介绍的多地区发布。

如何选择这个模型

结合任务复杂度、输入材料与预期结果选择。

需要完整成片时选择 Maestro

如果任务不仅要画面,还需要脚本、配音、配乐和字幕,Maestro 的导演式流程更贴近完整交付目标。相较只围绕单段画面提出要求,这里应优先描述内容结构和观众预期。新项目使用 generate;已制作的项目则按重新演绎、局部修改或续写选择动作。

按视频类型安排素材与控制

解说内容选择 narrated,已有视频加字幕选择 captions,人像口播选择 avatar,角色对白故事选择 drama。类型决定表达形式,style 调整视觉观感,voice 调整旁白音色,不要把三者混为一种控制。想让系统自行组织形式时,可以保留 auto 并写清创作目标。

开始使用

从一次小规模任务到正式接入。

01

准备任务与材料

明确目标、必要输入与输出要求,使用真实业务样例作为起点。

02

在 API 调试区试用

打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。

03

按 API 文档接入

保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。

使用边界

在正式使用前,了解输出质量与能力范围。

  • 目标时长需在 5–300 秒内,单次语言数最多为 4,参考 URL 最多为 20 项。多语言制作复用同一套画面,不等于每个语言版本都会重新设计视觉内容;若不同地区需要不同画面,应拆分创作任务。
  • captions 需要提供源视频,avatar 需要提供人像,不能只选择类型而省略必要素材。参考内容应通过 file_urls 提交媒体 URL;这与直接上传本地文件不同,制作前应准备好可访问的素材地址。
  • Maestro 采用异步制作,提交成功只表示任务已受理,并非成片已经完成。较大的内容调整可能重新生成;视觉风格与旁白音色是创作控制,不应视为逐帧锁定画面或逐字保证配音结果的工具。

常见问题

解答使用 maestro 时的常见疑问。

Maestro 和只生成视频画面的工具有什么区别?

Maestro 的任务是组织完整视频制作,除了画面,还包括脚本、旁白、配乐、字幕、剪辑与渲染。提示词应描述内容目的和表达结构,而不只是镜头外观;它更适合希望从简报推进到成片的创作任务。

如何用自己的产品图、视频或音频?

把媒体 URL 放入 file_urls,并在 prompt 中说明各素材的用途,例如产品图用于展示、logo 用于品牌识别、视频用于字幕加工。最多可提交 20 项;选择 captions 时应提供源视频,选择 avatar 时应提供人像。

一次可以制作几种语言?画面会不同吗?

单次最多指定 4 种语言,默认中文,langs 中第一种是主语言。其余语言复用同一套画面,另做配音和渲染,完成后分别获得语言版本。若希望各地区采用不同视觉叙事,应分别提交对应的创作要求。

修改成片应该选 remix、edit 还是 extend?

想保留主题但换一种表现,可选 remix;改标题、配音或配色等局部内容,可选 edit;继续扩展原有内容,可选 extend。三者都需要 ref_task_id,并在 prompt 中说明修改目标,随后会返回新的任务 ID。

提交后怎样拿到最终视频?

调用 POST /maestro/videos 后先取得 task_id,再用 POST /maestro/tasks 查询进度和结果。任务会经过规划与制作阶段,成功后获取成片及各语言版本;应用应区分提交成功、制作中、完成和失败状态。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 maestro 用到你的下一项任务

从清晰的目标开始,在实际结果中判断它是否适合你的工作。