You need to enable JavaScript to run this app.
文档中心
AI 数据湖服务

AI 数据湖服务

复制全文
下载 pdf
算子上新
算子精选
复制全文
下载 pdf
算子精选

首推算子

视频精细理解
Image

提供多维度、精细化的视频内容理解

爆款素材剪辑
Image

自动识别视频精彩片段,一键生成爆款素材

视频字幕翻译
Image

自动提取视频字幕并翻译为多语种

短剧剧本生成
Image

基于全剧/全片视频逆向生成文本剧本和角色表

精选算子

视频

视频生成增强版/基础版

通用视频生成 方舟模型

基于 Seedance 2.x 系列模型的视频生成算子。

视频生成(Doubao-Seedance-1.x系列模型)

基于 Seedance 1.x 系列模型的视频生成算子。

短剧素材解说

解说视频生成 影视二创推广

基于单个输入视频自动完成原片 ASR、视频理解、爆款解说稿生成、TTS 配音、字幕生成和视频渲染,输出带解说旁白的新视频,适用于短剧推广、影视二创和素材批量生产。

视频翻译

影视出海

将视频内容从源语言转换为一种或多种目标语言,服务范围不仅包含字幕翻译,还涉及语音翻译,最终输出配音后的视频以及相应语言的字幕文件。

视频编辑增强版

物品/环境替换编辑

结合输入视频与参考图片完成定向视频替换,适用于广告素材重制、商品替换、背景重绘和视频创意编辑等场景。

爆款素材剪辑

投流素材剪辑

基于多集短剧视频,自动完成分镜检测、语义分析、剪辑决策与视频合成,批量生成多个适合在短视频平台投放的引流素材视频

视频智能剪辑

影视高光剪辑 口播剪辑

长视频中快速提取有价值的内容片段,支持自然语言描述的剪辑需求理解、参考图像辅助识别、多维度视频内容分析,输出标准化的剪辑决策。

视频精细理解

通用视频内容理解 长视频输入

对视频进行理解与分析,无论是短视频、影视片段、课程录屏还是监控录像,均可对视频内容进行描述、问答、信息提取,并结合时间戳定位相关片段。

视频分镜

分镜提取

对输入视频进行镜头/场景切分、全局角色识别、场景级人物关联以及人物图片抽取,输出场景汇总结果、人物注册表、每个场景的切片视频,以及按人物归档的图片文件,便于后续检索、剪辑和内容理解。

短剧剧本生成

逆向剧本提取

面向短剧以及长视频/电影等连载或超长视频内容的自动化剧本逆向提取工具。逆向生成包含场景、动作、神态及对话等细节的高质量文本剧本和角色表,助力视频内容的二次创作、出海翻译与版权保护。

视频超分

超分

对输入视频进行清晰度增强与分辨率提升,输出更高分辨率的视频结果。适用于老片修复、素材增强、4K 制作和视频清晰化等场景。

视频修复

水印/字幕/滚动字幕擦除

提供视频水印和字幕智能擦除能力。支持自动检测和擦除视频中的水印、字幕、滚动字幕等不需要的内容,输出修复后的视频文件。

人脸模糊

人脸打码

面向视频内容的自动化人脸模糊处理工具。算子能够自动识别视频中的人脸,并根据用户指定的模糊等级,对人脸进行模糊处理,保护用户隐私。


音频

语音转文字(Doubao-Seed-2.0-lite)增强版

语音转文字

在基础 ASR 识别结果之上提供多模态精修能力,支持从热词上下文中抽取参考热词,用于修正专有名词、数字、标点和部分识别错误,输出更高质量的语音转文字结果。

音视频合并

音视频合并

对输入的视频和音频素材进行顺序拼接、时长调整和最终合成,支持 1 对 1、1 对多、多对 1、多对多等多种输入组合。

音频切分

音频切分

用于从音频或视频文件中提取音频,并按照指定规则将音频切分为多个片段,输出到用户指定的存储路径。该算子主要用于长音频或视频的结构化处理场景,如音频预处理、数据切分、训练数据构建等。


其他

PDF 文档解析(豆包)

PDF/图片解析 高保真MD输出

支持对 PDF 文件和图片文件进行视觉模型解析与 Markdown 结构化输出,支持对模糊、复杂排版、繁体、复杂公式等内容进行解析并输出高保真 Markdown 解析结果。

多模态深度思考(Doubao-seed-2.0)

多模态深度思考 方舟模型

多模态场景下提供大模型的深度思考能力,使用具备深度思考能力的模型,对图片、视频、音频或文本进行分析理解,并返回结构化文本输出。

图片生成(Seedream 系列模型)

通用图片生成 方舟模型

基于 Seedream 图片生成模型,可根据用户输入的文本或参考图像生成高质量图片,支持组图与流式输出。

最近更新时间:2026.07.20 10:26:00
这个页面对您有帮助吗?
有用
有用
无用
无用