You need to enable JavaScript to run this app.
文档中心
AI 数据湖服务

AI 数据湖服务

复制全文
下载 pdf
内容创作
视频脚本规划
复制全文
下载 pdf
视频脚本规划

输入视频主题和创作要求,即可生成一份可用于后续制作的视频生产规划,包括图片素材规划、视频内容结构、镜头安排、视频引用素材建议、时长节奏和口播文案等(不直接生成音视频、图文等素材资产)。规划会将创意拆解为清晰的内容结构、镜头安排、素材建议和时长节奏,适合教育及营销视频的前期策划。

算子介绍

算子 ID:las_hypervideo_script_planner

适用场景

  • 课程讲解:语文古诗伴读、英语单词讲解、数学例题讲解、科学现象解释等教育视频前置规划。
  • 广告营销:广告输出、营销视频生产等。
  • 批量策划:为系列化内容生成结构统一的制作方案,减少重复策划工作。
  • 需要控制纯视频画面与精准文字画面生成比例,并约束准确文字进入课件帧的混合生产场景。

核心能力

  • 从创意到制作方案:将主题、受众和表达目标整理成可执行的视频生产规划。
  • 生产规划:拆解视频内容,规划各场景的生成模式、分镜脚本、时长和衔接关系。
  • 模式路由:将场景分配为 videoframehybridvideo 适合人物动作、故事情境、环境氛围和视觉演示等纯视频场景;frame 适合课件页、准确文字、公式、音标、例题、练习题、图表和总结页等文字较多的场景。hybrid 适合同一个场景中既需要生成视频画面,又需要准确渲染文字/布局的场景。
  • 参考资料理解与图片复用:理解内容图片、PDF 和视频;通过 ref_strategy 决定内容原图是否进入人物、道具或背景的具体状态,并由场景引用。PDF 和视频只用于理解。
  • 图文联合风格:visual_style 支持一张风格图、风格文字或二者结合;明确冲突以风格文字为准。风格独立于内容图片引用策略。
  • 素材状态与角色声音:同一人物、道具或背景可具有多个状态;一个状态可保留多张内容原图,人物各状态可配置独立声音,台词引用相应人物及声音状态。
  • 适配不同内容类型:支持课程讲解和广告营销视频策划。

效果展示

  • 输入:教育场景的示例
    "prompt": "为小学三年级数学《长方形面积》课程生成 1 分钟讲解视频规划,要求结构清晰、示例贴近生活。",
    "prompt_strategy": "education_v1",
    "total_duration_sec": 300,
    "planning": {
    "domain": "education",
    "context": {         "target_grade": "小学三年级",
        "subject": "数学",
        "course_topic": "长方形面积"
                }
            }
    
  • 算子输出结果:
    • 脚本意图结果
      Image
      intent_profile.json
      未知大小
    • 视频制作的规划结果
      Image
      production_plan.json
      未知大小
  • 可基于算子输出结果进行视频生成,以下为示例
——注意,本算子不直接输出视频

支持的地域

  • 北京:cn-beijing
  • 上海:cn-shanghai
  • 广州:cn-guangzhou

算子性能

细分项

性能影响说明

Submit RPM

600

Poll RPM

600

输入与输出要求

输入要求

细分

详细要求

输入数据模态

  • 文本(Prompt)
  • 图片(reference image)
  • 文件(reference file)
  • 视频

输入模态:prompt

通过请求参数 prompt 提供给算子输入数据,输入建议:

  • 描述清楚视频主题、目标受众、期望时长和必须呈现的信息,生成的规划会更贴近创作目标。
  • 课程视频建议补充年级、学科和课程主题;营销视频建议在创作需求中说明商品、核心卖点和目标人群。

输入模态:参考 image/file/video

通过请求参数 ref_imagesref_filesref_videos 提供给算子输入数据。

  • 当前仅支持通过公网 URL (HTTPS、HTTP链接)提供给算子。
  • 单次任务最多支持提供 20 个参考图、3 个参考 PDF 文档、5 个参考视频。

输入模态:视觉风格 image/prompt

visual_style.ref_images 最多 1 张,不占内容图片额度;visual_style.prompt 最多 6000 字符

输出要求

细分

详细要求

输出数据模态

  • 文本
  • 其他:单次规划任务支持规划脚本的内容时长范围为 30 秒至 30 分钟。

输出路径:TOS

您可通过请求参数output_tos_path 指定算子输出结果的存储路径,当前支持设置为 TOS 路径。

  • TOS 路径:与LAS服务同主账号、同地域下,有可写权限的 TOS Bucket 目录,格式:tos://bucket/output/

计费说明
  • 计费标准

    细分项
    计费标准说明

    计费项

    • 算子处理费用:基于输出的视频脚本的目标视频时长统计用量,不同时长按不同单价进行计费。即,需要规划脚本的目标视频时长越长,费用越高。
    • 多模态参考输入费用(按需):如果提供了多模态的输入内容(有效内容图片、PDF 文档、视频、独立风格图片等),则收取 1元的多模态输入费用。

    计费类型

    按量计费,单位:,按实际的计费用量每小时出账。

    单价

    基于需要规划脚本的目标视频时长进行阶梯计费。

  • 计费详情

    计费项

    目标视频时长
    单价

    算子处理费用

    (0 秒,30 秒]

    1.2 元

    (30 秒,1 分钟]

    1.5 元

    (1 分钟,2 分钟]

    2.0 元

    (2 分钟,5 分钟]

    3.0 元

    (5 分钟,10 分钟]

    4.5 元

    (10 分钟,20 分钟]

    7.0 元

    (20 分钟,30 分钟]

    9.5 元

    多模态参考输入费用

    不涉及

    1.00 元,有多模态参考输入时收取;不提供多模态参考输入时不收取

注意与前提

细分项

注意与前提

开通 LAS

  • 如果您是一个全新的火山引擎用户,此前未开通过 LAS 产品,您可先开通 LAS,不使用 LAS 的计费功能仅开通 LAS 产品不会产生费用。开通操作请参见准备工作
  • 开通完成后可查看算子介绍文档,了解算子能力、上手引导等,详情可参见:LAS 智能数据处理算子

费用

调用算子前,您需先了解使用算子时的模型调用费用,详情请参见大模型调用计费

鉴权(API Key)

调用算子前,您需要先生成算子调用的API Key,并建议将API Key配置为环境变量,便于更安全地调用算子,详情请参见获取 API Key 并配置

BaseURL

调用算子前,您需要先根据您当前使用的LAS服务所在地域,了解算子调用的BaseURL,用于配置算子调用路径参数取值。
详情请参见获取 Base URL,下文中的调用示例仅作为参考,实际调用时需替换为您对应地域的路径取值。

Rest API 调用

API 调用说明

  • 本算子的 API 为异步任务接口,您需要通过 Submit 接口提交任务获得任务的 task_id,再通过 Poll 接口获取对应任务(task_id)运行状态,并获取算子处理结果。
  • 注意,任务提交后,任务的 task_id 有效期为 3 天,超过 3 天后即无法通过此 task_id 来获取算子处理结果。

Submit

接口说明

提交视频脚本规划任务,提交成功后返回任务 ID,可通过查询接口获取处理结果。

请求参数

参数
类型
是否必填
示例值
描述
operator_id
string
las_hypervideo_script_planner
算子 ID。
operator_version
string
v1
算子版本。
data
HyperVideoScriptPlannerReqParams
视频脚本规划请求参数。

返回数据

参数
类型
示例值
描述
metadata
metadata
请求元信息

请求示例

curl --location "https://operator.las.cn-beijing.volces.com/api/v1/submit" \
--header "Content-Type: application/json" \
--header "Authorization: Bearer $LAS_API_KEY" \
--data '{
    "operator_id": "las_hypervideo_script_planner",
    "operator_version": "v1",
    "data": {
        "prompt": "为面向通勤人群的便携咖啡杯生成 60 秒产品介绍视频规划,结合产品图片、规格文档和演示视频,突出防漏设计及易于清洗的特点。",
        "prompt_strategy": "marketing_ecommerce_v1",
        "total_duration_sec": 60,
        "planning": {
            "domain": "marketing"
        },
        "ref_images": ["https://example.com/product-front.png"],
        "ref_files": ["https://example.com/product-specification.pdf"],
        "ref_videos": ["https://example.com/product-demo.mp4"],
        "ref_strategy": "all",
        "visual_style": {
            "ref_images": ["https://example.com/watercolor-style.png"],
            "prompt": "保留参考图的水彩笔触,使用冷色调并增加留白,确保产品文字清晰可读"
        },
        "output_tos_path": "tos://bucket/output/script_planner/",
        "output_language": "zh",
        "aspect_ratio": "16:9",
        "resolution": "1920x1080",
        "fps": 25,
        "video_target_ratio": 0.6,
        "frame_target_ratio": 0.3,
        "hybrid_target_ratio": 0.1,
        "video_max_scene_duration_sec": 8,
        "min_total_duration_sec": 50,
        "max_total_duration_sec": 70
    }
}'

返回示例

{
  "metadata": {
    "task_id": "20250108_150000_abc123",
    "task_status": "PENDING",
    "business_code": "0",
    "error_msg": ""
  }
}

错误码

HttpStatusCode

错误码

错误信息

描述

400

Parameter.Invalid

The parameter is invalid.

请求参数不合法,如必填字段为空、planning.domain 不支持、数量或长度超限、素材或风格字段类型及 URL 不合法、ref_strategyreference_mode 冲突、时长关系不满足要求。执行阶段发生的素材读取、PDF 页数超限、模型规划或引用绑定失败通过 Poll 的终态元信息返回。

401

Authorization.Missing

The authorization header is missing.

缺少鉴权。

401

ApiKey.Invalid

The api key is invalid.

API Key 不合法。

500

Server.InternalError

General Internal Error

服务内部错误。

Poll

接口说明

查询视频脚本规划任务的执行状态和结果。

请求参数

名称

类型

是否必选

示例值

描述

operator_id

string

las_hypervideo_script_planner

算子 ID

operator_version

string

v1

算子版本

task_id

string

task-xxx

任务 ID

返回数据

参数
类型
示例值
描述
metadata
metadata
请求的元信息
data
HyperVideoScriptPlannerResponse
返回的数据

请求示例

curl --location "https://operator.las.cn-beijing.volces.com/api/v1/poll" \
--header "Content-Type: application/json" \
--header "Authorization: Bearer $LAS_API_KEY" \
--data '{
    "operator_id": "las_hypervideo_script_planner",
    "operator_version": "v1",
    "task_id": "20250108_150000_abc123"
}'

返回示例

{
  "metadata": {
    "task_id": "20250108_150000_abc123",
    "task_status": "COMPLETED",
    "submit_time": "2026-07-21T16:04:06+08:00",
    "end_time": "2026-07-21T16:04:06+08:00",
    "business_code": "0",
    "error_msg": ""
  },
  "data": {
    "intent_profile_path": "tos://bucket/out/run/intent_profile.json",
    "intent_profile_uri": "https://example.com/intent_profile.json",
    "production_plan_path": "tos://bucket/out/run/production_plan.json",
    "production_plan_uri": "https://example.com/production_plan.json",
    "creative_brief_path": "tos://bucket/out/run/creative_brief.json",
    "creative_brief_uri": "https://example.com/creative_brief.json",
    "reference_analysis_path": "tos://bucket/out/run/reference_analysis.json",
    "reference_analysis_uri": "https://example.com/reference_analysis.json",
    "total_duration_sec": 60.0,
    "contains_multimodal_input": true
  }
}

错误码

HttpStatusCode

错误码

错误信息

描述

400

Parameter.Invalid

The parameter is invalid.

参数不合法

401

Authorization.Missing

The authorization header is missing.

缺少鉴权

401

ApiKey.Invalid

The api key is invalid.

API Key 不合法

500

Server.InternalError

General Internal Error

服务内部错误

参考:输出 JSON 文件字段说明

intent_profile.json

intent_profile.json 描述用户想要什么内容,主要包含视频标题、规划领域、主题、关键知识点、受众、内容目标、内容单元、总时长、画幅、分辨率、输出语言、全局视觉风格、文字策略、音频策略、约束和假设等信息。关键字段包含:

名称

类型

描述

video_title

string

建议的视频标题。

planning_domain

string

识别出的规划领域,当前支持教育 education 和营销 marketing

scenario_type

string

领域内的具体场景类型,如古诗。

topic

object

主题信息,包含主主题、关键知识点和分类。

target_audience

object

目标受众信息,包含年龄范围、认知水平、注意力特点等。

content_goal

string

视频的整体内容目标。

key_messages

array

需要传达的关键信息或目标。

content_units

array

结构化的内容单元,如公式讲解、操作步骤、产品卖点等。

total_duration_sec

integer

规划的视频总时长,单位为秒。

aspect_ratio

string

目标视频画幅比例。

resolution

string

目标视频分辨率。

language

string

视频输出语言。

global_style

object

全局风格,包含视觉风格、文字策略、音频风格和音乐策略。

production_plan.json

production_plan.json 描述下游如何生产视频,主要包含:

名称

类型

描述

content_structure

array

内容结构,每一项包含章节 ID、名称、目标、时长和建议生成模式。

generation_mix_strategy

object

video / frame / hybrid 时长比例策略。

asset_plan

array

待生成或复用的素材。人物、道具和背景按主体及 states 管理;封面、独立插画、图标或图表可使用平铺结构。

scene_plan

array

可执行场景列表,每个 scene 通过 generation_type 区分 videoframehybrid

assembly_plan

object

最终拼接顺序、默认转场、转场时长、音频归一化和背景音乐策略。

metadata

object

规划附加信息。asset_schema_version="v3" 表示当前素材与声音结构版本,不改变算子版本 v1

asset_plan 关键字段

人物、道具和背景的根节点表示主体身份,视觉生成信息放在一层 states 中。同一人物的不同年龄或服装、同一道具的完好或破损、同一背景的白天或夜晚属于同一主体的不同状态;同状态的不同视角可共用一个状态的多张原图。

名称

类型

描述

asset_id

string

主体唯一 ID。人物身份由台词中的 character_id 引用;场景视觉引用使用具体状态 ID。主体、状态及其他素材 ID 全局唯一。

asset_type

string

主体类型:人物 character、道具 prop、背景 background。封面、独立插画等平铺素材使用对应素材类型。

name

string

主体名称。

purpose

string

素材在视频中的用途。

states

array

一层具体视觉状态;可见主体至少有一个状态,状态不可再嵌套 states。纯声音角色使用空数组。

voice_only

boolean

仅人物适用,默认 falsetrue 表示只闻其声的角色,包括旁白;不生成视觉状态或图片。

audio

object

出镜人物为 null,声音设定位于对应状态;纯声音人物在此保存 speaker_rolevoice_style。道具和背景无声音设定。

metadata

object

素材相关附加信息。

states 关键字段

名称

类型

描述

asset_id

string

当前状态的唯一 ID,供场景 asset_refs 及人物台词的 character_state_id 引用。

state_name

string

状态名称,如幼年、成年、破损或夜晚。

asset_type

string

与父主体对应的视觉类型:video_character_reference_image / frame_character_reference_imagevideo_prop_reference_image / frame_prop_reference_imagevideo_background_reference_image / frame_background_reference_image

purpose

string

当前状态在视频中的用途。

prompt

string

完整视觉生成描述,应同时包含共同身份特征与本状态外观;prompt 与已有 uri 至少有一个非空。

negative_prompt

string

当前状态的负向视觉生成约束。

generation_model

string

建议生成模型;复用内容原图的状态为 null

uri

string

已有素材主图地址。复用内容原图时等于 reference_images[0].uri,不是已生成的新图或多图融合结果。

reference_images

array

当前状态保留的全部内容原图,每项含 reference_id 和原始输入 uri;只来源于顶层 ref_images,不包含 PDF 页图、视频或独立风格图。

audio

object

人物状态的声音设定:speaker_role 为非空声音角色名,voice_style 描述音色、口音或表达风格,可为空表示无额外要求。不说话的状态为 null,道具和背景无声音设定。

metadata

object

状态相关附加信息。

场景通过状态 asset_id 引用视觉素材;ref_image_* 是原图标识,不可填入 asset_refs。复用一个状态时应保留其全部 reference_images,不能只读取主图 uri 就认定已使用其余图片。逻辑主体不直接生图;封面等平铺素材仍在自身保存生成模型、提示词和 URI。新规划不再输出 reference_materialsreference_refs

scene_plan 关键字段

名称

类型

描述

scene_id

string

场景唯一 ID。

section_id

string

所属章节 ID,章节规划在 content_structure 中。

scene_title

string

场景标题。

generation_type

string

场景生成模式,支持 videoframehybrid

duration_sec

double

场景规划时长,单位为秒。

scene_goal

string

场景需要完成的内容目标。

scene_function

string

场景功能,如吸引注意、建立语境、讲解、演示或总结。

content_summary

string

场景内容摘要。

asset_refs

array

当前场景使用的具体视觉状态或平铺素材 ID;人物、道具、背景填写状态 asset_id,不能填写逻辑主体 ID 或 ref_image_*

storyboards

array

视频分镜列表,包含分镜时长、画面提示词、镜头设计和分镜音频。

frame_prompt

object

frame 或 hybrid 场景的画面、文字、布局和动画规划。

audio

object

场景级音频规划,保留文案、时序与声音引用。声音设定通过 character_idcharacter_state_id 读取,详见下表。

transition

object

场景转入和转出的转场要求。

场景与分镜的 audio

名称

类型

描述

need_audio

boolean

是否需要该段音频。

audio_type

string

音频类型,例如对白 dialogue

character_id

string

说话人物的根节点 asset_id,不可指向道具、背景或状态。

character_state_id

string

说话状态的 asset_id,必须属于 character_id 对应人物,并有有效 audio 声音设定。纯声音角色为 null,使用根节点声音。

text

string

当前场景或分镜的台词,不存放在主体或状态声音设定中。

sync_required

boolean

是否要求音画同步。

allow_bgm

boolean

是否允许背景音乐。

allow_sfx

boolean

是否允许音效。

有分镜的 video 场使用 storyboards[*].audio,场级音频为空;frame 使用 scene.audiohybrid 的配音在 scene.audio,分镜音频关闭。场景和分镜的 audio 不再直接存放 speaker_rolevoice_style。声音状态可以与画面状态不同,例如画面使用幼年状态,旁白使用成年状态;不同人物或不同声音状态的台词分别保留。
以下为生产规划结构节选,展示两张内容原图属于同一人物状态及台词声音引用;省略其余章节、场景和组装字段。

creative_brief.json(可选)

营销任务生成营销创意时返回该文件;教育任务不返回。文件以 creative_brief 字符串保存用于规划的创意正文,保留原有换行与段落,不是另一份结构化生产规划。

reference_analysis.json(可选)

内容图片、PDF 或视频等参考资料产生分析结果时返回,教育和营销均适用。没有内容参考资料、仅有独立风格图或风格文字时不返回。即使 ref_strategy=none,资料仍可产生分析;分析中的来源标识不代表原图已被场景引用。

名称

类型

描述

source_purpose

string

参考资料的用途。

summary

string

参考资料内容摘要。

evidence

array

事实、约束等依据;每项可包含 evidence_idkindcontentsource_refsattributes

ambiguities

array

资料中的不确定或存在歧义的信息。

image_entities

array

内容图片的主体与状态分组;每项含 entity_keyentity_typenamestates,无可用分组时为空数组。

image_entitiesentity_typecharacterpropbackground;其 states 中每项含 state_keystate_namedescriptionimage_refsimage_refs 指向内容原图 ref_image_*,而 entity_keystate_key 解释识别分组,实际执行引用以生产规划中主体和状态的 asset_id 为准。文件直接保存分析对象,不额外包裹一层 reference_analysis
所有产物均随完整任务成功后由 Poll 返回地址;未生成的可选文件会省略对应 pathuri 字段,不输出空文件。文件路径及返回条件见 Poll 接口。

最近更新时间:2026.09.17 22:13:03
这个页面对您有帮助吗?
有用
有用
无用
无用