> ## Documentation Index
> Fetch the complete documentation index at: https://docs.anyfast.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Wan3.0 Video

> 通过文本、首帧/首尾帧、多模态素材、文件或网页参考，生成最长 30 秒的 Wan3.0 视频。

Wan3.0 Video 是阿里巴巴推出的全能视频生成模型，统一支持文生视频、首帧/首尾帧生视频、多模态参考，以及文件或网页参考。通过 AnyFast 调用时，使用模型 ID `wan3.0-video` 和端点 `POST /v1/video/generations`。

<Info>
  对于特定内容请求，请选择 `Direct` 资源下的 `wan3.0-video-nsfw`。该 NSFW 变体是 AnyFast 专用模型 ID，并非阿里云官方模型。
</Info>

## 核心能力

* 可通过提示词、媒体素材或两者组合生成视频；`input.prompt` 和 `input.media` 至少提供一项。
* 支持通过首帧，或首帧与尾帧共同控制视频。
* 单次最多参考 10 张图片、5 段视频和 5 段音频。
* 支持先理解文档、演示文稿、表格、文本文件或公开网页，再据此生成视频。
* 最长生成 30 秒、30 fps 的视频，并默认生成同步音频。
* 通过 `duration: -1` 和 `ratio: "adaptive"` 让模型智能选择时长和画面构图。

| 能力      | 输入                                                      | 主要限制                       |
| ------- | ------------------------------------------------------- | -------------------------- |
| 文生视频    | 仅 `input.prompt`                                        | 超过 20,000 字符的部分会自动截断       |
| 首帧生视频   | 一个 `first_frame` 图片                                     | 不能与参考媒体、`file` 或 `link` 混用 |
| 首尾帧生视频  | 一个 `first_frame` 和一个 `last_frame` 图片                    | 不能与参考媒体、`file` 或 `link` 混用 |
| 多模态参考   | `reference_image`、`reference_video` 和 `reference_audio` | 10 张图片、5 段视频、5 段音频         |
| 文件或网页参考 | 一个 `file` 或一个 `link`                                    | `file` 与 `link` 互斥         |

## 能力示例

<Info>
  阿里云官方页面仅提供了下方示例的输入素材，没有发布输出视频。请将这些素材视为上游输入示例，不要将其当作通过 AnyFast 复现的结果。
</Info>

<Tabs sync={false}>
  <Tab title="文生视频">
    只传入 `input.prompt`，不传 `input.media`。提示词可描述主体、动作、场景、运镜、视觉风格和声音；超过 20,000 字符的部分会自动截断。

    该工作流支持 2–30 秒的 `duration`，也可设为 `-1` 让模型智能选择时长。
  </Tab>

  <Tab title="首帧生视频">
    添加一个 `type: "first_frame"` 的图片，严格控制视频开场画面。传入媒体时提示词可以省略，但建议用提示词说明动作、运镜和声音。

    <Frame caption="上游首帧输入">
      <img src="https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/wpimhv/rap.png" alt="Wan3.0 上游首帧示例使用的涂鸦说唱歌手图片" />
    </Frame>

    不要将 `first_frame` 与 `reference_image`、`reference_video`、`reference_audio`、`file` 或 `link` 混用。
  </Tab>

  <Tab title="首尾帧生视频">
    添加一个 `first_frame`，再添加一个 `last_frame`。两张图片分别定义开始与结束构图；提示词应说明两帧之间的动作和转场。

    <Columns cols={2}>
      <Frame caption="上游首帧输入">
        <img src="https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/wpimhv/rap.png" alt="Wan3.0 上游首尾帧示例的首帧图片" className="w-full aspect-video object-cover object-center" />
      </Frame>

      <Frame caption="上游尾帧输入">
        <img src="https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260408/sjuytr/wan-r2v-object-girl.jpg" alt="Wan3.0 上游首尾帧示例的尾帧图片" className="w-full aspect-video object-cover object-center" />
      </Frame>
    </Columns>

    该首尾帧模式不能与参考媒体、文件或网页链接混用。
  </Tab>

  <Tab title="多模态参考">
    组合参考图片、视频和音频，控制角色一致性、物体、动作、场景和声音。按媒体类型和顺序通过 `图像1`、`视频1`、`音频1` 等名称引用素材。

    <Accordion title="查看上游多模态输入素材">
      <Columns cols={2}>
        <Frame caption="图像 1：角色参考">
          <img src="https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260408/sjuytr/wan-r2v-object-girl.jpg" alt="Wan3.0 上游示例的角色参考图片" />
        </Frame>

        <Frame caption="视频 1：角色与动作参考">
          <video controls playsInline preload="none" className="w-full aspect-video rounded-xl" src="https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/qigswt/wan-r2v-role2.mp4">
            当前浏览器不支持视频播放。
          </video>
        </Frame>

        <Frame caption="图像 2：物体参考">
          <img src="https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/rtjeqf/wan-r2v-object3.png" alt="Wan3.0 上游示例的第一张物体参考图片" />
        </Frame>

        <Frame caption="图像 3：物体参考">
          <img src="https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/qpzxps/wan-r2v-object4.png" alt="Wan3.0 上游示例的第二张物体参考图片" />
        </Frame>

        <Frame caption="图像 4：背景参考">
          <img src="https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/wfjikw/wan-r2v-backgroud5.png" alt="Wan3.0 上游示例的背景参考图片" />
        </Frame>
      </Columns>
    </Accordion>

    所有参考视频合计最长 15 秒；所有参考音频另有 15 秒的合计时长限制。
  </Tab>

  <Tab title="文件或网页">
    使用 `type: "file"` 让模型理解文件，或使用 `type: "link"` 参考无需登录即可访问的公开网页。最多传入一个文件或一个链接，且两种类型不能同时出现。

    <Card title="上游 PPTX 输入" icon="file" href="https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260806/ebapmr/glass.pptx">
      下载 Wan3.0 官方文件参考示例使用的演示文稿。
    </Card>

    官方页面没有提供该演示文稿对应的生成视频。
  </Tab>
</Tabs>

## 创建任务

<Tabs sync={false}>
  <Tab title="文生视频">
    ```bash cURL theme={null}
    curl --request POST \
      --url https://www.anyfast.ai/v1/video/generations \
      --header 'Authorization: Bearer YOUR_API_KEY' \
      --header 'Content-Type: application/json' \
      --data '{
        "model": "wan3.0-video",
        "input": {
          "prompt": "一只小猫在月光下的屋顶上奔跑，城市霓虹灯在远处闪烁，电影级光影，流畅跟拍。"
        },
        "parameters": {
          "resolution": "1080P",
          "ratio": "16:9",
          "duration": 5,
          "audio": true,
          "seed": 42,
          "watermark": false
        }
      }'
    ```
  </Tab>

  <Tab title="首帧生视频">
    ```bash cURL theme={null}
    curl --request POST \
      --url https://www.anyfast.ai/v1/video/generations \
      --header 'Authorization: Bearer YOUR_API_KEY' \
      --header 'Content-Type: application/json' \
      --data '{
        "model": "wan3.0-video",
        "input": {
          "prompt": "涂鸦角色从墙上活过来，在夜晚的铁路桥下演唱充满活力的英文说唱，镜头平滑推进。",
          "media": [{
            "type": "first_frame",
            "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/wpimhv/rap.png"
          }]
        },
        "parameters": {
          "resolution": "1080P",
          "ratio": "adaptive",
          "duration": 8,
          "audio": true,
          "watermark": false
        }
      }'
    ```
  </Tab>

  <Tab title="首尾帧生视频">
    ```bash cURL theme={null}
    curl --request POST \
      --url https://www.anyfast.ai/v1/video/generations \
      --header 'Authorization: Bearer YOUR_API_KEY' \
      --header 'Content-Type: application/json' \
      --data '{
        "model": "wan3.0-video",
        "input": {
          "prompt": "女孩从微笑逐渐变成开心大笑，镜头保持自然的近景构图。",
          "media": [
            {"type": "first_frame", "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/wpimhv/rap.png"},
            {"type": "last_frame", "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260408/sjuytr/wan-r2v-object-girl.jpg"}
          ]
        },
        "parameters": {
          "resolution": "1080P",
          "ratio": "adaptive",
          "duration": 8,
          "audio": true,
          "watermark": false
        }
      }'
    ```
  </Tab>

  <Tab title="多模态参考">
    ```bash cURL theme={null}
    curl --request POST \
      --url https://www.anyfast.ai/v1/video/generations \
      --header 'Authorization: Bearer YOUR_API_KEY' \
      --header 'Content-Type: application/json' \
      --data '{
        "model": "wan3.0-video",
        "input": {
          "prompt": "视频1抱着图像3，在图像4的椅子上表演；图像1拿着图像2从旁边经过。画面节奏参考音频1。",
          "media": [
            {"type": "reference_image", "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260408/sjuytr/wan-r2v-object-girl.jpg"},
            {"type": "reference_video", "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/qigswt/wan-r2v-role2.mp4"},
            {"type": "reference_image", "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/rtjeqf/wan-r2v-object3.png"},
            {"type": "reference_image", "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/qpzxps/wan-r2v-object4.png"},
            {"type": "reference_image", "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/wfjikw/wan-r2v-backgroud5.png"},
            {"type": "reference_audio", "url": "https://example.com/country-ballad.mp3"}
          ]
        },
        "parameters": {
          "resolution": "1080P",
          "ratio": "adaptive",
          "duration": 5,
          "audio": true,
          "watermark": false
        }
      }'
    ```
  </Tab>

  <Tab title="文件或网页">
    传入一个 `file`：

    ```bash cURL theme={null}
    curl --request POST \
      --url https://www.anyfast.ai/v1/video/generations \
      --header 'Authorization: Bearer YOUR_API_KEY' \
      --header 'Content-Type: application/json' \
      --data '{
        "model": "wan3.0-video",
        "input": {
          "prompt": "根据演示文稿制作一支简洁、未来感的产品广告，突出设计、材质和核心功能。",
          "media": [{
            "type": "file",
            "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260806/ebapmr/glass.pptx"
          }]
        },
        "parameters": {
          "resolution": "1080P",
          "ratio": "16:9",
          "duration": 10,
          "audio": true,
          "watermark": false
        }
      }'
    ```

    或将其替换为一个公开网页：

    ```bash cURL theme={null}
    curl --request POST \
      --url https://www.anyfast.ai/v1/video/generations \
      --header 'Authorization: Bearer YOUR_API_KEY' \
      --header 'Content-Type: application/json' \
      --data '{
        "model": "wan3.0-video",
        "input": {
          "prompt": "将该网页的主要内容制作成一段简短的讲解视频。",
          "media": [{
            "type": "link",
            "url": "https://example.com/public-product-overview"
          }]
        },
        "parameters": {
          "resolution": "1080P",
          "ratio": "16:9",
          "duration": 10,
          "audio": true,
          "watermark": false
        }
      }'
    ```
  </Tab>
</Tabs>

## Wan3.0 如何选择工作流

Wan3.0 根据媒体素材的 `type` 选择生成工作流。

| 工作流    | `input.media` 内容                                                  | 兼容性规则                                      |
| ------ | ----------------------------------------------------------------- | ------------------------------------------ |
| 文生视频   | 省略 `input.media`                                                  | 必须提供 `input.prompt`                        |
| 首帧生视频  | 一个 `first_frame`                                                  | 不要添加参考媒体、`file` 或 `link`                   |
| 首尾帧生视频 | 一个 `first_frame` 和一个 `last_frame`                                 | 不要添加参考媒体、`file` 或 `link`                   |
| 多模态参考  | 任意受支持的 `reference_image`、`reference_video` 和 `reference_audio` 组合 | 不能与 `first_frame` 或 `last_frame` 混用        |
| 文件参考   | 最多一个 `file`                                                       | 不能与 `link`、`first_frame` 或 `last_frame` 混用 |
| 网页参考   | 最多一个 `link`                                                       | 不能与 `file`、`first_frame` 或 `last_frame` 混用 |

`input.prompt` 和 `input.media` 均可单独省略，但请求必须至少包含其中一项。只传入媒体而不提供提示词时，模型会根据媒体推断生成意图。

## 控制输出

| 参数                      | 行为                                               |
| ----------------------- | ------------------------------------------------ |
| `parameters.resolution` | `1080P`（默认）、`720P` 或 `480P`                      |
| `parameters.ratio`      | `adaptive`（默认）、`16:9`、`4:3`、`1:1`、`3:4` 或 `9:16` |
| `parameters.duration`   | 默认 `5` 秒；设为 `-1` 时智能选择时长                         |
| `parameters.audio`      | 默认为 `true`；设为 `false` 时不包含音轨，两种取值价格相同            |
| `parameters.seed`       | `0` 到 `2147483647` 的整数                           |
| `parameters.watermark`  | 默认为 `false`；设为 `true` 时添加水印                      |

分辨率取值表示服务档位，并非固定的宽高像素值；实际输出尺寸会随所选宽高比变化。

没有视频输入时，`duration` 可设为 2–30 的整数或 `-1`。请求包含参考视频时，所有输入视频的总时长与输出时长之和不得超过 30 秒。

所有生成视频均为 30 fps。

## 输入要求

### 图片

以下要求适用于 `first_frame`、`last_frame` 和 `reference_image`。

| 属性   | 要求                                           |
| ---- | -------------------------------------------- |
| 传入方式 | 公网 URL 或 Base64 Data URL                     |
| 格式   | JPEG、JPG、不含透明通道的 PNG、BMP 或 WEBP              |
| 尺寸   | 宽和高分别为 240–8,000 px                          |
| 宽高比  | 1:8 到 8:1                                    |
| 文件大小 | 单张不超过 20 MB                                  |
| 数量   | 最多 10 个 `reference_image`；首帧任务使用一个首帧，并可选一个尾帧 |

### 视频

| 属性   | 要求                         |
| ---- | -------------------------- |
| 传入方式 | 公网 URL                     |
| 格式   | MP4 或 MOV                  |
| 尺寸   | 宽和高分别为 240–4,096 px        |
| 宽高比  | 1:8 到 8:1                  |
| 时长   | 单个 1–15 秒；所有参考视频合计不超过 15 秒 |
| 文件大小 | 单个不超过 100 MB               |
| 数量   | 最多 5 个 `reference_video`   |

### 音频

| 属性   | 要求                         |
| ---- | -------------------------- |
| 传入方式 | 公网 URL                     |
| 格式   | WAV 或 MP3                  |
| 时长   | 单段 1–15 秒；所有参考音频合计不超过 15 秒 |
| 文件大小 | 单段不超过 15 MB                |
| 数量   | 最多 5 个 `reference_audio`   |

### 文件和网页

| 输入     | 要求                                                        |
| ------ | --------------------------------------------------------- |
| 文件格式   | DOCX、DOC、XLSX、XLS、PPTX、PPT、PDF、TXT、KEY、PAGES、NUMBERS 或 MD |
| 文件访问方式 | 公网 URL                                                    |
| 文件大小   | 不超过 100 MB                                                |
| 页数限制   | PDF、DOC/DOCX、PPT/PPTX、KEY 和 PAGES 文件不超过 50 页              |
| 文件数量   | 最多一个 `file`                                               |
| 网页访问方式 | 无需登录即可打开的公网 URL                                           |
| 网页数量   | 最多一个 `link`                                               |

<Warning>
  `file` 和 `link` 不能出现在同一个请求中；两者也都不能与 `first_frame` 或 `last_frame` 混用。
</Warning>

## 提示词技巧

* 描述会影响结果的主体、动作、场景、视觉风格、运镜、时间安排、台词、音乐和音效。
* 按媒体类型和顺序使用 `图像1`、`视频1`、`音频1` 等名称引用多模态输入，并说明每份素材应提供什么内容。
* 首尾帧生视频应明确描述两张图片之间的动作和视觉转场。
* 文件或网页参考应指出需要采用的事实、产品、幻灯片或页面章节，以及内容顺序。
* 提示词超过 20,000 字符的部分会自动截断。

## 查询和保存结果

创建接口返回异步任务 ID。轮询 `GET /v1/video/generations/{id}`，直到 `status` 变为 `SUCCESS` 或 `FAILURE`。任务可能从 `NOT_START` 开始，再进入 `QUEUED` 和 `IN_PROGRESS`；终态为 `SUCCESS` 或 `FAILURE`。`progress` 是百分比字符串，例如 `"0%"` 或 `"100%"`。

阿里云官方说明生成通常需要 1–5 分钟，并建议约每 15 秒轮询一次。该上游典型值不是 AnyFast 的服务等级承诺；AnyFast 的实际处理时间会随请求内容和队列状态变化。

```bash cURL theme={null}
curl --request GET \
  --url https://www.anyfast.ai/v1/video/generations/{TASK_ID} \
  --header 'Authorization: Bearer YOUR_API_KEY'
```

* 任务创建后可查询 24 小时。
* 生成结果 URL 的有效期为 24 小时。
* `status` 变为 `SUCCESS` 后请及时下载或转存视频。

<Card title="Wan3.0 Video API 参考" icon="code" href="/zh/api-reference/model-api/alibaba/wan3.0-video">
  查看所有工作流的完整请求和响应字段。
</Card>

资料来源：[阿里云 Wan3.0 视频生成 API 参考](https://www.alibabacloud.com/help/zh/model-studio/wan3-video-generation-api-reference)

<script src="/public/feedback.js" />
