# AI VOD Studio V2 用户使用手册
## 1. 产品简介
AI VOD Studio V2 是一个沉浸式 AI 视频创作工作台。你可以使用文字、图片、视频和音频完成视频生成,并可直接调用模板库、素材库、官方虚拟人像库和已授权的私域真人素材库。
工作台包含四个主要页面:
| 页面 | 用途 |
| ---- | ------------------------------------------------ |
| 创作 | 编写提示词、引用素材、选择模型和生成参数 |
| 素材 | 浏览和管理可用于生成的图片、视频、音频及人像素材 |
| 作品 | 查看已完成的视频,下载或复用原参数 |
| 任务 | 查看排队、生成中、完成、失败或超时的任务 |
未登录时可以浏览部分页面。上传素材、调用生产素材库、提交生成、查看作品和任务需要先登录。
## 2. 快速开始
### 2.1 文生视频
适合只依靠文字描述生成视频。
1. 打开“创作”页面。
2. 将“模式”选择为“文生视频”。
3. 在输入框中描述主体、动作、场景、镜头、光线、风格和声音。
4. 选择比例、分辨率、时长、数量和模型。
5. 模型支持时,可以打开“有声”。
6. 点击右下角的生成按钮。
示例提示词:
```text
电影感夜景,雨后的城市街道,一名穿红色风衣的女性缓慢走过霓虹灯下的积水,
镜头从远景平稳推进到侧脸特写,冷蓝色环境光与红色霓虹形成对比,真实光影,
细腻雨声和城市环境音。
```
### 2.2 图生视频
适合让一张图片动起来,或使用首帧和尾帧控制画面变化。
1. 将“模式”选择为“图生视频”。
2. 点击“参考内容”。
3. 在图片区上传图片、填写图片 URL,或从素材库选择图片。
4. 添加一张图片时,该图片作为主要起始画面。
5. 当前模型允许两张图片时,按添加顺序分别作为首帧和尾帧。
6. 在提示词中说明人物动作、镜头移动、环境变化和结尾效果。
7. 设置生成参数并提交。
示例:
```text
@图片1 作为开始画面,人物缓慢抬头并向镜头微笑,镜头轻微向前推进;
随后背景光线由清晨逐渐变为金色夕阳,最终自然过渡到 @图片2。
```
图片数量由当前模型能力决定,以“参考内容”面板显示的上限为准。
### 2.3 参考生成
适合同时引用多张图片、多个视频或音频,完成角色、动作、场景、运镜和声音的组合创作。
1. 将“模式”选择为“参考生成”。
2. 点击“参考内容”,加入需要使用的图片、视频和音频。
3. 返回提示词输入框,输入 `@`。
4. 在弹出的“全部 / 图片 / 视频 / 音频”列表中选择素材。
5. 使用生成后的结构化标签编写提示词,例如 `@图片1`、`@视频1`、`@音频1`。
6. 如果工具栏出现“参考方式”,选择符合当前任务的参考方式。
7. 检查参数后提交。
多素材示例:
```text
8 秒产品广告。人物外观参考 @图片1,服装参考 @图片2,拍摄场景参考 @图片3。
人物按 @视频1 的动作节奏拿起产品并转身,镜头运动参考 @视频2。
全程使用 @音频1 作为背景音乐,最后定格产品正面特写。
```
如果一次加入了 8 张图片,可以继续按实际用途分别引用:
```text
0-2 秒:@图片1 中的维修员进入 @图片2 的车间,服装参考 @图片3。
2-5 秒:维修员按照 @图片4 的工具使用方式检修 @图片5 中的设备,
近景细节参考 @图片6。
5-8 秒:镜头拉远,环境变为 @图片7,最后以 @图片8 的构图结束。
```
不要只在输入框里手工敲入普通文字“@图片1”。建议输入 `@` 后从菜单选择,让标签与真实素材建立结构化关联。
## 3. 添加参考素材
### 3.1 通过“参考内容”添加
“参考内容”是创作页的统一素材入口。根据当前模式和模型,面板会显示图片区、视频区和音频区。
每种素材支持:
- 输入可访问的素材 URL;
- 上传本地文件;
- 从素材库选择已有素材;
- 删除已经添加的素材;
- 查看当前数量和模型允许的上限。
支持的上传格式:
| 类型 | 支持格式 |
| ---- | ----------------------------------------- |
| 图片 | JPG、JPEG、PNG、WebP、BMP、TIF、TIFF、GIF |
| 视频 | MP4、MOV |
| 音频 | MP3、WAV |
视频和音频会读取媒体时长。模型存在时长限制时,页面会显示允许的总时长并阻止超限组合。
上传成功后,素材必须获得可持久使用的地址才能参与生成。浏览器临时地址不能直接提交;如果页面提示需要重新选择,请重新上传或从素材库选择。
### 3.2 通过素材库添加
创作页的“素材库”提供“全部、视频、图片、音频”筛选。
- 点击视频卡片可以预览;声音按钮用于打开或关闭预览声音。
- 点击音频卡片可以播放或暂停,封面图片与音频播放地址彼此独立。
- 点击图片可以查看素材。
- 点击“使用”后,素材会加入当前草稿的参考内容。
当前本地化素材使用平台自有域名提供预览和引用,不依赖官方控制台源站。
### 3.3 官方虚拟人像库
点击“虚拟人像库”可以选择官方虚拟人物素材。选择成功后,人像会作为图片参考加入当前草稿。
### 3.4 私域真人素材库
私域真人素材库只展示已经通过可信服务端人脸检测、授权和可用状态校验的真人素材。
- 只有当前用户有权使用且状态可用的素材可以加入草稿。
- 普通图片、视频和音频上传不会自动被认定为已授权真人素材。
- 不要上传或使用未取得本人授权、肖像授权或商业使用许可的真人内容。
## 4. 使用 `@` 引用
加入素材后,输入框上方会出现可点击的引用标签。你可以:
- 点击标签,将对应素材插入当前光标位置;
- 在输入框输入 `@`,打开素材选择菜单;
- 按“全部、图片、视频、音频”筛选;
- 使用键盘上下键选择并确认;
- 在提示词中多次引用同一个素材。
建议让每个引用都承担明确职责:
| 写法 | 推荐用途 |
| ----------------- | ---------------------------- |
| `@图片1` 中的人物 | 主体、角色或产品 |
| 背景参考 `@图片2` | 场景和环境 |
| 动作参考 `@视频1` | 动作、节奏或表演 |
| 运镜参考 `@视频2` | 推拉摇移、第一视角或镜头轨迹 |
| 声音参考 `@音频1` | 音色、音乐、台词或音效 |
如果删除了已被提示词引用的素材,页面会提示引用失效。请重新选择正确素材,不要让标签指向不存在的内容。
## 5. 模板库
模板库按以下类别展示:
- 全部;
- 参考生成;
- 视频编辑;
- 时序补全。
模板卡片提供以下操作:
- 点击或悬停预览示例视频;
- 打开或关闭预览声音;
- 点击“立即体验”,将模板提示词、模式、参数和示例参考素材写入当前草稿;
- 点击代码按钮,查看与当前模板对应的 H5 示例代码。
使用模板后请重点检查:
1. 示例素材是否需要替换成你自己的素材;
2. `@图片N`、`@视频N`、`@音频N` 是否仍与提示词含义一致;
3. 当前模型是否支持模板所需的素材类型和数量;
4. 视频和音频总时长是否超过模型限制;
5. 比例、时长、分辨率和“有声”设置是否符合目标。
“视频编辑”和“时序补全”是模板用途分类。实际提交时,系统仍会转换为当前模型已正式支持的文生视频、图生视频或参考生成输入,不会伪造模型未声明的接口能力。
## 6. 参数说明
| 参数 | 说明 |
| -------- | ----------------------------------------------------- |
| 模式 | 文生视频、图生视频或参考生成 |
| 参考方式 | 仅在当前模型声明多个参考配置时显示 |
| 比例 | 智能比例、1:1、16:9、9:16、4:3、3:4、21:9 |
| 分辨率 | 由当前模型和可用计费配置决定 |
| 时长 | 智能时长、5 秒、10 秒或 15 秒;最终以模型支持范围为准 |
| 数量 | 通常为 1~3 条;Seedance 2.0 固定为 1 条 |
| 有声 | 仅在当前模型或渠道支持生成音频时显示 |
| 模型 | 选择实际用于生成的视频模型 |
| 清空 | 清除当前提示词和参考素材,保留模型及参数设置 |
### 6.1 智能比例
点击“智能比例”会打开比例选择对话框。选择“智能比例”时由模型根据输入内容自适应;有明确投放场景时建议直接选择目标比例:
- 短视频竖屏:9:16;
- 横屏展示:16:9;
- 社交媒体方图:1:1;
- 传统横版内容:4:3;
- 传统竖版内容:3:4;
- 超宽电影画面:21:9。
### 6.2 高级设置
点击模型前面的“高级设置”按钮可以打开:
- 帧率;
- 运动强度;
- Seed;
- 反向提示词。
这些控件会保留在工作台中,但最终是否提交和生效取决于模型的官方接口契约。Seedance 2.0 当前不直接接收帧率、运动强度、Seed 和反向提示词,因此系统会在最终请求中移除这些不受支持的字段;这不会影响提示词、参考素材、比例、分辨率、时长和声音开关等受支持设置。
## 7. 提交生成与查看结果
点击右下角生成按钮后,页面会显示生成状态:
- 提交中;
- 生成中;
- 已完成;
- 失败;
- 超时。
生成期间不能关闭生成结果窗口。完成后可以:
- 播放生成视频;
- 再次生成;
- 将生成结果作为新的参考视频继续创作;
- 前往“作品”或“任务”页面查看记录。
视频生成是异步任务。页面超时不一定代表上游任务最终失败,请前往“任务”页面刷新状态。
## 8. 作品与任务
### 8.1 作品
“作品”页面只展示已经成功完成的视频。支持:
- 按模型、模式和比例筛选;
- 悬停预览视频;
- 下载视频;
- 复用生成参数并返回创作页;
- 刷新和翻页。
### 8.2 任务
“任务”页面展示全部视频任务,可能出现排队中、生成中、完成、失败或超时。
你可以复制任务 ID、复用参数、刷新状态和翻页。联系技术支持时,请同时提供任务 ID、出现时间、所选模型和页面错误信息。
## 9. 移动端使用
工作台支持移动端自适应:
- 顶部导航可横向滚动;
- 智能比例使用移动端对话框;
- `@` 素材菜单自动适应屏幕;
- 参考内容、高级设置和历史记录使用抽屉或移动端面板;
- 素材卡片自动减少列数。
上传大视频或音频时,建议使用稳定网络并保持页面前台运行,直到上传完成。
## 10. 常见问题
### 10.1 提示“当前模型未声明参考素材能力”
当前模型或路由没有发布参考素材能力。请切换到文生视频、更换支持参考生成的模型,或联系管理员检查模型渠道能力。
### 10.2 素材添加后无法生成
依次检查:
- 素材数量是否超限;
- 图生视频是否缺少图片;
- 参考生成是否只添加了音频而没有图片或视频;
- 视频或音频总时长是否超限;
- 素材是否上传完成并获得持久地址;
- `@` 标签是否仍然指向存在的素材;
- 当前模型是否支持该素材类型和参考方式。
### 10.3 上传文件提示格式不支持
请转换为本手册列出的格式。视频推荐 MP4,音频推荐 MP3 或 WAV,图片推荐 JPG、PNG 或 WebP。
### 10.4 音频有封面但不能播放
音频封面和播放文件是两个独立资源。请确认网络正常后重新点击播放;仍失败时刷新页面并记录素材名称。
### 10.5 Chrome 能看到图片,Safari 看不到
1. 强制刷新页面;
2. 关闭内容拦截器或跨站资源拦截扩展后重试;
3. 确认浏览器允许访问 `image.xihuyun.com`;
4. 清理该站点缓存后重新登录;
5. 把浏览器版本、素材名称和截图提供给技术支持。
### 10.6 点击“清空”后模型没有变化
这是正常行为。“清空”只清除提示词和参考素材,方便在同一模型及参数下开始新的创作。
### 10.7 页面提示草稿来自更高版本
当前浏览器保存了由更高版本编辑器创建的草稿。为避免破坏结构,页面会只读保留。请升级或刷新到最新版本后再编辑。
## 11. 内容与版权要求
使用平台前,请确保:
- 对上传的图片、视频和音频拥有合法使用权;
- 使用真人素材时已经取得肖像权、声音权和必要的商业授权;
- 不上传违法、侵权、欺诈、仿冒或未经授权的敏感内容;
- 模板和素材库内容只在平台授权范围内使用;
- 生成结果发布前由用户自行完成事实、版权、商标和合规审核。
## 12. 获取技术支持
反馈问题时建议提供:
- 页面地址;
- 任务 ID;
- 所选模型和生成模式;
- 素材数量和类型;
- 页面完整错误信息;
- 浏览器名称与版本;
- 问题截图或录屏;
- 问题发生时间。
不要在工单、聊天或截图中公开 API Key、密码、Cookie、Authorization 请求头或其他敏感凭据。
Getting Started