You need to enable JavaScript to run this app.
文档中心
火山方舟

火山方舟

复制全文
下载 pdf
接入多模态生成模型
接入视觉模型
复制全文
下载 pdf
接入视觉模型
方舟 Agent Plan 提供图片生成、视频生成模型,支持通过 Skill、ArkCLI、API 接口调用方式接入并使用生图、生视频能力。
通过 Skill 接入
在 AI 工具中使用图片生成、视频生成能力,建议使用 Skill 方式接入。
安装视频生成 Skill
通过 Skill 方式,可以快速为 AI 工具安装并接入视频生成能力,目前支持的 AI 工具:OpenClaw、Hermes Agent、Claude Code。视频生成 Skill 信息参见 byted-ark-seedance-skill
OpenClaw
Hermes Agent
Claude Code
TraeCode
  1. 已完成 OpenClaw 的安装及语言模型的配置,具体步骤见 OpenClaw
  1. 在终端执行以下命令为 OpenClaw 安装并接入视频生成 Skill byted-ark-seedance-skill
  • npx skills add https://skills.volces.com/skills/volcengine/agentplan -s byted-ark-seedance-skill --agent openclaw
  1. 安装完成后,可以在 OpenClaw 发送视频生成的提示词,触发并使用生成视频能力。
安装图片生成 Skill
通过 Skill 方式,可以快速为 AI 工具安装并接入图片生成能力,目前支持的 AI 工具:OpenClaw、Hermes Agent、Claude Code。图片生成 Skill 信息参见 byted-ark-seedream-skill
OpenClaw
Hermes Agent
Claude Code
TraeCode
  1. 已完成 OpenClaw 的安装及语言模型的配置,具体步骤见 OpenClaw
  1. 在终端执行以下命令为 OpenClaw 安装并接入图片生成 Skill byted-ark-seedream-skill
  • npx skills add https://skills.volces.com/skills/volcengine/agentplan -s byted-ark-seedream-skill --agent openclaw
  1. 安装完成后,可以在 OpenClaw 发送图片生成的提示词,触发并使用生成图片能力。
通过 ArkCLI 接入
通过 ArkCLI(命令行工具)同样可以接入图片生成、视频生成能力,支持通过 Agent 调用终端调用两种方式使用。
安装与配置
请确保已购买 Agent Plan 套餐。安装、登录及配置步骤,参见 ArkCLI:Agent Plan 个人版使用指南
注意:登录 ArkCLI 时需要选择消费模式为 agent-plan
配好 Agent 工具后即可开始使用。
使用示例
通过 Agent 调用
通过终端调用
在 Agent 对话中直接说明生图、生视频要求即可调用,建议在提示词中注明“不要使用后付费”
1. 生图
请使用 Agent Plan 的 doubao-seedream-5.0-lite 模型生成一张 4K 大图:一只赛博朋克风格的猫咪坐在东京街头,霓虹灯反射,不要使用后付费
2. 生视频
请使用 Agent Plan 的 doubao-seedance-2.5 模型生成一段 5 秒 16:9 视频:无人机航拍雪山日出,缓慢右移,同步等结果,不要使用后付费
通过 API 接入
如果使用的 AI 工具不支持接入 Skill,或者无需在 AI 工具中使用,可通过 API 接入的方式使用图片生成、视频生成能力。
核心配置信息
在使用 Agent Plan 时,需要使用专属 API Key、专属 Base URL、支持的模型来调用视频生成、图片生成 API,否则可能会调用失败或产生额外费用。
  • 专属 API Key获取专属 API Key,其他方舟 API Key 如 Coding Plan API Key 无法在 Agent Plan 中使用。
  • image-20260908-203322-616.png
  • 专属 Base URL:Agent Plan 对应的 API 接口信息中包含/plan,请勿混用其他 API 接口。
  • Curl 方式:支持的 API 参数可查看对应的 API 文档。
  • 视频生成 API
    图片生成 API
    • 查询视频生成任务列表https://ark.cn-beijing.volces.com/api/plan/v3/contents/generations/tasks?page_num={page_num}&page_size={page_size}&filter.status={filter.status}&filter.task_ids={filter.task_ids}&filter.model={filter.model}
    图片生成https://ark.cn-beijing.volces.com/api/plan/v3/images/generations
  • SDK 方式:
  • 专属 Base URL:https://ark.cn-beijing.volces.com/api/plan/v3
调用视频生成 API
参见视频生成教程Doubao Seedance 2.5 教程Doubao Seedance 2.0 系列教程完成视频生成任务,需注意必须使用 Agent Plan 专属 API Key、专属 Base URL 及支持的模型,否则可能会调用失败或产生额外费用。具体参见核心配置信息
通过 Agent Plan 创建视频生成任务的示例如下:
Curl
Python
Java
Go
curl https://ark.cn-beijing.volces.com/api/plan/v3/contents/generations/tasks \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AGENT_API_KEY" \
-d '{
"model": "doubao-seedance-2.0",
"content": [
{
"type": "text",
"text": "女孩抱着狐狸,女孩睁开眼,温柔地看向镜头,狐狸友善地抱着,镜头缓缓拉出,女孩的头发被风吹动,可以听到风声"
},
{
"type": "image_url",
"image_url": {
"url": "https://ark-project.tos-cn-beijing.volces.com/doc_image/i2v_foxrgirl.png"
}
}
],
"generate_audio": true,
"ratio": "adaptive",
"duration": 5,
"watermark": false
}'
调用图片生成 API
参见 Seedream 5.0 Pro 教程图片生成教程 完成图片生成任务,需注意必须使用 Agent Plan 专属 API Key、专属 Base URL 及支持的模型,否则可能会调用失败或产生额外费用。具体参见核心配置信息
通过 Agent Plan 实现文生图的示例如下:
Curl
Python
Java
Go
OpenAI
curl https://ark.cn-beijing.volces.com/api/plan/v3/images/generations \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AGENT_API_KEY" \
-d '{
"model": "doubao-seedream-5.0-lite",
"prompt": "充满活力的特写编辑肖像,模特眼神犀利,头戴雕塑感帽子,色彩拼接丰富,眼部焦点锐利,景深较浅,具有Vogue杂志封面的美学风格,采用中画幅拍摄,工作室灯光效果强烈。",
"size": "2K",
"output_format":"png",
"watermark": false
}'
支持模型及能力
注意
Agent Plan 的套餐支持的模型不同,具体参见支持模型及 Harness
生视频模型
doubao-seedance-1.5-pro 即将下线,建议使用以下模型。
模型
doubao-seedance-2.5【New】
doubao-seedance-2.0
doubao-seedance-2.0-fast
doubao-seedance-2.0-mini
文生视频
图生视频-首帧
图生视频-首尾帧
多模态参考
图片参考
视频参考
音频参考
✗(需搭配图片/视频)
✗(需搭配图片/视频)
✗(需搭配图片/视频)
组合参考
  • 图片 + 音频
  • 图片 + 视频
  • 视频 + 音频
  • 图片 + 视频 + 音频
编辑视频
延长视频
生成有声视频
参考素材数量上限
50(30张图+10个视频+10个音频)
15(9张图+3个视频+3个音频)
15(9张图+3个视频+3个音频)
15(9张图+3个视频+3个音频)
联网搜索工具
样片模式
返回视频产物对应的尾帧图
输出视频规格
输出分辨率
  • 480p(8bit 位深)
  • 720p(8bit 位深)
  • 1080p(10bit 位深)
  • 480p(8bit 位深)
  • 720p(8bit 位深)
  • 1080p(8bit 位深)
  • 4k(10bit 位深)
  • 480p(8bit 位深)
  • 720p(8bit 位深)
  • 480p(8bit 位深)
  • 720p(8bit 位深)
输出宽高比
21:9, 16:9, 4:3,
1:1, 3:4, 9:16, adaptive
21:9, 16:9, 4:3,
1:1, 3:4, 9:16, adaptive
21:9, 16:9, 4:3,
1:1, 3:4, 9:16, adaptive
21:9, 16:9, 4:3,
1:1, 3:4, 9:16, adaptive
输出时长
4~30 秒;-1(在有效时长内由模型自动选择最佳时长)
4~15 秒;-1(在有效时长内由模型自动选择最佳时长)
4~15 秒;-1(在有效时长内由模型自动选择最佳时长)
4~15 秒;-1(在有效时长内由模型自动选择最佳时长)
输出视频格式
mp4, mov
mp4
mp4
mp4
抵扣系数
  • 输出视频分辨率为 480p,720p
  • 输入包含视频:210
  • 输入不含视频:350
  • 输出视频分辨率为 1080p
  • 输入包含视频:230
  • 输入不含视频:385
  • 输出视频分辨率为 480p,720p
  • 输入包含视频:140
  • 输入不含视频:230
  • 输出视频分辨率为 1080p
  • 输入包含视频:155
  • 输入不含视频:255
  • 输出视频分辨率为 4k
  • 输入包含视频:80
  • 输入不含视频:130
  • 输入包含视频:110
  • 输入不含视频:185
  • 输入包含视频:70
  • 输入不含视频:115
生图模型
模型
doubao-seedream-5-0-pro
doubao-seedream-5.0-lite
文生图
文生组图
暂不支持
单 / 多图生图
单 / 多图生组图
暂不支持
交互编辑
图层拆分
流式输出
暂不支持
联网搜索
暂不支持
模型参数
分辨率
1K, 1.5K, 2K
2K, 3K, 4K
输出格式
png, jpeg
png, jpeg
提示词优化模式
标准模式, 极速模式
标准模式
生成数量
支持生成单图/多张图层( 1张底图+16张图层)
输入的参考图数量 + 最终生成的图片数量 ≤ 15张
抵扣系数
输入图
  • 第一张:免费
  • 第二张起:10
-
输出图
  • 单图生成场景:
  • ≤ 261 万像素(分辨率 1.5K 及以下):150
  • > 261 万像素(分辨率 1.5K 以上):300
  • 图层拆分场景:
  • ≤ 261 万像素(分辨率 1.5K 及以下):75
  • > 261 万像素(分辨率 1.5K 以上):150
1 张成功生成的图片 = 99 AFP
最近更新时间:2026.09.18 15:02:34
这个页面对您有帮助吗?
有用
有用
无用
无用