原生 30 秒叙事
可设置 2–30 秒整数时长,也可使用智能时长,让模型根据内容自动选择合适长度。
面向阿里巴巴 All-in-One 视频模型的实用中心:理解 30 秒多模态工作流,构建 API 请求,估算成本,优化提示词,并把文档整理成可执行的视频方案。
Wan 3.0 不再要求用户在多个任务模型之间来回选择。系统会根据 media 类型与提示词意图,自动路由文生视频、首帧、首尾帧、全模态参考、文件理解、视频编辑或延长。
这次升级同时扩大了单次视频的叙事空间,以及一个请求能够理解的素材范围。
可设置 2–30 秒整数时长,也可使用智能时长,让模型根据内容自动选择合适长度。
单次最多组合 10 张图片、5 段视频和 5 段音频,并按类型与顺序引用素材。
可把文件或公开网页作为结构化资料,用于解说、广告、演示和叙事视频。
参考控制覆盖人脸、道具、空间、风格与关系,适合更长的连续镜头。
画面可与台词、音效、环境声和音乐共同生成;关闭音频不会降低价格。
通过提示词修改画面、剧情、台词或延长视频,无需切换到另一套模型。
同一个模型 ID 根据 input.media 的类型,以及提示词中的清晰动作意图自动选择任务。
| 任务 | 触发方式 | 使用建议 |
|---|---|---|
| 文生视频 | 只传 prompt | 直接设置画幅、分辨率、时长与声音。 |
| 首帧生视频 | first_frame | 使用 adaptive 画幅以保留原图构图。 |
| 首尾帧生视频 | first_frame + last_frame | 明确描述两个锚点之间的动作与过渡。 |
| 全模态参考 | reference_image / video / audio | 按各自类型顺序引用 Image 1、Video 1、Audio 1。 |
| 文件或网页 | file 或 link | 单次只能使用一个公开文件或网页,两者互斥。 |
| 编辑或延长视频 | reference_video + 编辑意图 | 建议 adaptive 画幅;智能时长适合保留或延长节奏。 |
发布能力很强,但真正使用时,服务边界与宣传参数同样重要。
官方生成需要同地域的 Model Studio 工作空间和 API Key;本站不代理付费请求。
30 秒免费额度仅限北京地域,输入与输出视频秒数合并计算,并受 90 天有效期限制。
官方说明音频质感与画面文字准确度仍在改进,交付前应审核台词、标签、图表和排版。
生成结果 URL 与任务 ID 仅保留 24 小时,生产系统应及时下载到持久存储。
模型按量计费。北京地域可能提供一次性 30 秒、90 天有效的免费额度;国际地域当前没有官方免费额度。本页规划工具完全免费,也不会调用模型。
可以。没有输入视频时,duration 可为 2–30 的任意整数;有输入视频时,输入视频与输出视频总时长不得超过 30 秒。
支持。官方格式覆盖常见 Office 文档、PDF、文本、Markdown、Keynote、Pages 和 Numbers;单次一个文件,最大 100MB,已验证页数上限 50 页。
有,默认开启。提示词可控制台词、音色情绪、音效、环境声与配乐;开启或关闭音频不影响计费。
页面中的能力与价格均为带日期的阿里云百炼公开资料快照。付费生产前请再次核对控制台。