输入视频主题和创作要求,即可生成一份可用于后续制作的视频生产规划,包括图片素材规划、视频内容结构、镜头安排、视频引用素材建议、时长节奏和口播文案等(不直接生成音视频、图文等素材资产)。规划会将创意拆解为清晰的内容结构、镜头安排、素材建议和时长节奏,适合教育及营销视频的前期策划。
算子 ID:las_hypervideo_script_planner
video、frame和hybrid。video 适合人物动作、故事情境、环境氛围和视觉演示等纯视频场景;frame 适合课件页、准确文字、公式、音标、例题、练习题、图表和总结页等文字较多的场景。hybrid 适合同一个场景中既需要生成视频画面,又需要准确渲染文字/布局的场景。ref_strategy 决定内容原图是否进入人物、道具或背景的具体状态,并由场景引用。PDF 和视频只用于理解。visual_style 支持一张风格图、风格文字或二者结合;明确冲突以风格文字为准。风格独立于内容图片引用策略。"prompt": "为小学三年级数学《长方形面积》课程生成 1 分钟讲解视频规划,要求结构清晰、示例贴近生活。", "prompt_strategy": "education_v1", "total_duration_sec": 300, "planning": { "domain": "education", "context": { "target_grade": "小学三年级", "subject": "数学", "course_topic": "长方形面积" } }
细分项 | 性能影响说明 |
|---|---|
Submit RPM | 600 |
Poll RPM | 600 |
细分 | 详细要求 |
|---|---|
输入数据模态 |
|
输入模态:prompt | 通过请求参数
|
输入模态:参考 image/file/video | 通过请求参数
|
输入模态:视觉风格 image/prompt | visual_style.ref_images 最多 1 张,不占内容图片额度;visual_style.prompt 最多 6000 字符 |
细分 | 详细要求 |
|---|---|
输出数据模态 |
|
输出路径:TOS | 您可通过请求参数
|
计费标准
细分项 | 计费标准说明 |
|---|---|
计费项 |
|
计费类型 | 按量计费,单位: |
单价 | 基于需要规划脚本的目标视频时长进行阶梯计费。 |
计费详情
计费项 | 目标视频时长 | 单价 |
|---|---|---|
算子处理费用 | (0 秒,30 秒] | 1.2 元 |
(30 秒,1 分钟] | 1.5 元 | |
(1 分钟,2 分钟] | 2.0 元 | |
(2 分钟,5 分钟] | 3.0 元 | |
(5 分钟,10 分钟] | 4.5 元 | |
(10 分钟,20 分钟] | 7.0 元 | |
(20 分钟,30 分钟] | 9.5 元 | |
多模态参考输入费用 | 不涉及 | 1.00 元,有多模态参考输入时收取;不提供多模态参考输入时不收取 |
细分项 | 注意与前提 |
|---|---|
开通 LAS |
|
费用 | 调用算子前,您需先了解使用算子时的模型调用费用,详情请参见大模型调用计费。 |
鉴权(API Key) | 调用算子前,您需要先生成算子调用的API Key,并建议将API Key配置为环境变量,便于更安全地调用算子,详情请参见获取 API Key 并配置。 |
BaseURL | 调用算子前,您需要先根据您当前使用的LAS服务所在地域,了解算子调用的BaseURL,用于配置算子调用路径参数取值。 |
Submit 接口提交任务获得任务的 task_id,再通过 Poll 接口获取对应任务(task_id)运行状态,并获取算子处理结果。task_id 有效期为 3 天,超过 3 天后即无法通过此 task_id 来获取算子处理结果。提交视频脚本规划任务,提交成功后返回任务 ID,可通过查询接口获取处理结果。
参数 | 类型 | 是否必填 | 示例值 | 描述 |
|---|---|---|---|---|
operator_id | string | 是 | las_hypervideo_script_planner | 算子 ID。 |
operator_version | string | 是 | v1 | 算子版本。 |
data | HyperVideoScriptPlannerReqParams | 是 | 视频脚本规划请求参数。 |
参数 | 类型 | 示例值 | 描述 |
|---|---|---|---|
metadata | metadata | 请求元信息 |
curl --location "https://operator.las.cn-beijing.volces.com/api/v1/submit" \ --header "Content-Type: application/json" \ --header "Authorization: Bearer $LAS_API_KEY" \ --data '{ "operator_id": "las_hypervideo_script_planner", "operator_version": "v1", "data": { "prompt": "为面向通勤人群的便携咖啡杯生成 60 秒产品介绍视频规划,结合产品图片、规格文档和演示视频,突出防漏设计及易于清洗的特点。", "prompt_strategy": "marketing_ecommerce_v1", "total_duration_sec": 60, "planning": { "domain": "marketing" }, "ref_images": ["https://example.com/product-front.png"], "ref_files": ["https://example.com/product-specification.pdf"], "ref_videos": ["https://example.com/product-demo.mp4"], "ref_strategy": "all", "visual_style": { "ref_images": ["https://example.com/watercolor-style.png"], "prompt": "保留参考图的水彩笔触,使用冷色调并增加留白,确保产品文字清晰可读" }, "output_tos_path": "tos://bucket/output/script_planner/", "output_language": "zh", "aspect_ratio": "16:9", "resolution": "1920x1080", "fps": 25, "video_target_ratio": 0.6, "frame_target_ratio": 0.3, "hybrid_target_ratio": 0.1, "video_max_scene_duration_sec": 8, "min_total_duration_sec": 50, "max_total_duration_sec": 70 } }'
{ "metadata": { "task_id": "20250108_150000_abc123", "task_status": "PENDING", "business_code": "0", "error_msg": "" } }
HttpStatusCode | 错误码 | 错误信息 | 描述 |
|---|---|---|---|
400 | Parameter.Invalid | The parameter is invalid. | 请求参数不合法,如必填字段为空、 |
401 | Authorization.Missing | The authorization header is missing. | 缺少鉴权。 |
401 | ApiKey.Invalid | The api key is invalid. | API Key 不合法。 |
500 | Server.InternalError | General Internal Error | 服务内部错误。 |
查询视频脚本规划任务的执行状态和结果。
名称 | 类型 | 是否必选 | 示例值 | 描述 |
|---|---|---|---|---|
operator_id | string | 是 | las_hypervideo_script_planner | 算子 ID |
operator_version | string | 是 | v1 | 算子版本 |
task_id | string | 是 | task-xxx | 任务 ID |
参数 | 类型 | 示例值 | 描述 |
|---|---|---|---|
metadata | metadata | 请求的元信息 | |
data | HyperVideoScriptPlannerResponse | 返回的数据 |
curl --location "https://operator.las.cn-beijing.volces.com/api/v1/poll" \ --header "Content-Type: application/json" \ --header "Authorization: Bearer $LAS_API_KEY" \ --data '{ "operator_id": "las_hypervideo_script_planner", "operator_version": "v1", "task_id": "20250108_150000_abc123" }'
{ "metadata": { "task_id": "20250108_150000_abc123", "task_status": "COMPLETED", "submit_time": "2026-07-21T16:04:06+08:00", "end_time": "2026-07-21T16:04:06+08:00", "business_code": "0", "error_msg": "" }, "data": { "intent_profile_path": "tos://bucket/out/run/intent_profile.json", "intent_profile_uri": "https://example.com/intent_profile.json", "production_plan_path": "tos://bucket/out/run/production_plan.json", "production_plan_uri": "https://example.com/production_plan.json", "creative_brief_path": "tos://bucket/out/run/creative_brief.json", "creative_brief_uri": "https://example.com/creative_brief.json", "reference_analysis_path": "tos://bucket/out/run/reference_analysis.json", "reference_analysis_uri": "https://example.com/reference_analysis.json", "total_duration_sec": 60.0, "contains_multimodal_input": true } }
HttpStatusCode | 错误码 | 错误信息 | 描述 |
|---|---|---|---|
400 | Parameter.Invalid | The parameter is invalid. | 参数不合法 |
401 | Authorization.Missing | The authorization header is missing. | 缺少鉴权 |
401 | ApiKey.Invalid | The api key is invalid. | API Key 不合法 |
500 | Server.InternalError | General Internal Error | 服务内部错误 |
intent_profile.json 描述用户想要什么内容,主要包含视频标题、规划领域、主题、关键知识点、受众、内容目标、内容单元、总时长、画幅、分辨率、输出语言、全局视觉风格、文字策略、音频策略、约束和假设等信息。关键字段包含:
名称 | 类型 | 描述 |
|---|---|---|
video_title | string | 建议的视频标题。 |
planning_domain | string | 识别出的规划领域,当前支持教育 |
scenario_type | string | 领域内的具体场景类型,如古诗。 |
topic | object | 主题信息,包含主主题、关键知识点和分类。 |
target_audience | object | 目标受众信息,包含年龄范围、认知水平、注意力特点等。 |
content_goal | string | 视频的整体内容目标。 |
key_messages | array | 需要传达的关键信息或目标。 |
content_units | array | 结构化的内容单元,如公式讲解、操作步骤、产品卖点等。 |
total_duration_sec | integer | 规划的视频总时长,单位为秒。 |
aspect_ratio | string | 目标视频画幅比例。 |
resolution | string | 目标视频分辨率。 |
language | string | 视频输出语言。 |
global_style | object | 全局风格,包含视觉风格、文字策略、音频风格和音乐策略。 |
production_plan.json 描述下游如何生产视频,主要包含:
名称 | 类型 | 描述 |
|---|---|---|
content_structure | array | 内容结构,每一项包含章节 ID、名称、目标、时长和建议生成模式。 |
generation_mix_strategy | object |
|
asset_plan | array | 待生成或复用的素材。人物、道具和背景按主体及 |
scene_plan | array | 可执行场景列表,每个 scene 通过 |
assembly_plan | object | 最终拼接顺序、默认转场、转场时长、音频归一化和背景音乐策略。 |
metadata | object | 规划附加信息。 |
人物、道具和背景的根节点表示主体身份,视觉生成信息放在一层 states 中。同一人物的不同年龄或服装、同一道具的完好或破损、同一背景的白天或夜晚属于同一主体的不同状态;同状态的不同视角可共用一个状态的多张原图。
名称 | 类型 | 描述 |
|---|---|---|
asset_id | string | 主体唯一 ID。人物身份由台词中的 |
asset_type | string | 主体类型:人物 |
name | string | 主体名称。 |
purpose | string | 素材在视频中的用途。 |
states | array | 一层具体视觉状态;可见主体至少有一个状态,状态不可再嵌套 |
voice_only | boolean | 仅人物适用,默认 |
audio | object | 出镜人物为 |
metadata | object | 素材相关附加信息。 |
名称 | 类型 | 描述 |
|---|---|---|
asset_id | string | 当前状态的唯一 ID,供场景 |
state_name | string | 状态名称,如幼年、成年、破损或夜晚。 |
asset_type | string | 与父主体对应的视觉类型: |
purpose | string | 当前状态在视频中的用途。 |
prompt | string | 完整视觉生成描述,应同时包含共同身份特征与本状态外观; |
negative_prompt | string | 当前状态的负向视觉生成约束。 |
generation_model | string | 建议生成模型;复用内容原图的状态为 |
uri | string | 已有素材主图地址。复用内容原图时等于 |
reference_images | array | 当前状态保留的全部内容原图,每项含 |
audio | object | 人物状态的声音设定: |
metadata | object | 状态相关附加信息。 |
场景通过状态 asset_id 引用视觉素材;ref_image_* 是原图标识,不可填入 asset_refs。复用一个状态时应保留其全部 reference_images,不能只读取主图 uri 就认定已使用其余图片。逻辑主体不直接生图;封面等平铺素材仍在自身保存生成模型、提示词和 URI。新规划不再输出 reference_materials 或 reference_refs。
名称 | 类型 | 描述 |
|---|---|---|
scene_id | string | 场景唯一 ID。 |
section_id | string | 所属章节 ID,章节规划在 |
scene_title | string | 场景标题。 |
generation_type | string | 场景生成模式,支持 |
duration_sec | double | 场景规划时长,单位为秒。 |
scene_goal | string | 场景需要完成的内容目标。 |
scene_function | string | 场景功能,如吸引注意、建立语境、讲解、演示或总结。 |
content_summary | string | 场景内容摘要。 |
asset_refs | array | 当前场景使用的具体视觉状态或平铺素材 ID;人物、道具、背景填写状态 |
storyboards | array | 视频分镜列表,包含分镜时长、画面提示词、镜头设计和分镜音频。 |
frame_prompt | object | frame 或 hybrid 场景的画面、文字、布局和动画规划。 |
audio | object | 场景级音频规划,保留文案、时序与声音引用。声音设定通过 |
transition | object | 场景转入和转出的转场要求。 |
名称 | 类型 | 描述 |
|---|---|---|
need_audio | boolean | 是否需要该段音频。 |
audio_type | string | 音频类型,例如对白 |
character_id | string | 说话人物的根节点 |
character_state_id | string | 说话状态的 |
text | string | 当前场景或分镜的台词,不存放在主体或状态声音设定中。 |
sync_required | boolean | 是否要求音画同步。 |
allow_bgm | boolean | 是否允许背景音乐。 |
allow_sfx | boolean | 是否允许音效。 |
有分镜的 video 场使用 storyboards[*].audio,场级音频为空;frame 使用 scene.audio;hybrid 的配音在 scene.audio,分镜音频关闭。场景和分镜的 audio 不再直接存放 speaker_role、voice_style。声音状态可以与画面状态不同,例如画面使用幼年状态,旁白使用成年状态;不同人物或不同声音状态的台词分别保留。
以下为生产规划结构节选,展示两张内容原图属于同一人物状态及台词声音引用;省略其余章节、场景和组装字段。
营销任务生成营销创意时返回该文件;教育任务不返回。文件以 creative_brief 字符串保存用于规划的创意正文,保留原有换行与段落,不是另一份结构化生产规划。
内容图片、PDF 或视频等参考资料产生分析结果时返回,教育和营销均适用。没有内容参考资料、仅有独立风格图或风格文字时不返回。即使 ref_strategy=none,资料仍可产生分析;分析中的来源标识不代表原图已被场景引用。
名称 | 类型 | 描述 |
|---|---|---|
source_purpose | string | 参考资料的用途。 |
summary | string | 参考资料内容摘要。 |
evidence | array | 事实、约束等依据;每项可包含 |
ambiguities | array | 资料中的不确定或存在歧义的信息。 |
image_entities | array | 内容图片的主体与状态分组;每项含 |
image_entities 的 entity_type 为 character、prop 或 background;其 states 中每项含 state_key、state_name、description、image_refs。image_refs 指向内容原图 ref_image_*,而 entity_key、state_key 解释识别分组,实际执行引用以生产规划中主体和状态的 asset_id 为准。文件直接保存分析对象,不额外包裹一层 reference_analysis。
所有产物均随完整任务成功后由 Poll 返回地址;未生成的可选文件会省略对应 path 和 uri 字段,不输出空文件。文件路径及返回条件见 Poll 接口。