You need to enable JavaScript to run this app.
文档中心
复制全文
下载 pdf
LAS skills 应用实践
语音识别 Skill:会议总结/客服质检/字幕生成/游戏审核
复制全文
下载 pdf
语音识别 Skill:会议总结/客服质检/字幕生成/游戏审核
语音识别 Skill 是 AI 数据湖服务(LAS)提供的多模态数据处理技能,目前已对接火山引擎 ArkClaw 和 OpenClaw。
Skill 优势
LAS 语音识别 Skill 提供语音转写与语义解析能力,可将海量音视频中的语音内容高精度转换为结构化文本,支持多语种、多音轨识别、智能断句与标点、时间轴与说话人切分等高级能力。结合自然语言理解与自定义词表,能更好适配垂直业务术语与口音场景,帮助业务快速完成内容索引、检索与统计分析,广泛应用于会议纪要、直播与短视频字幕生成、内容审核与质检、运营洞察与知识沉淀等场景。
音视频一体转写
多语种多方言覆盖
内置降噪精准识别
一套 ASR 能力同时支持音频与视频转写,覆盖会议录音、直播回放、短视频等多种素材形态,减少多套方案维护成本。
支持的语种更丰富,可识别含 99+ 种外国语和多类方言,几乎不受语种限制,更适配跨区域业务与多语言内容场景。
内置智能降噪与声学优化能力,在嘈杂环境、远讲等复杂声场下也能保持更高识别准确率,显著提升下游检索与分析效果。
应用场景
说明
以下为您展示示例的音频文档转写的效果,转写结果为大模型生成,每次生成结果可能不完全一致。
场景一:从嘉宾访谈音频中提炼精彩观点
场景介绍
你是一名某科技宣传公司的记者,需要在一段长达 8 分钟的对话访谈音频中,提炼出内容提纲、核心观点,并制作出个人精彩话语、犀利观点等内容,进行传播推广。
效果展示
原音频
  • 直播2_音频.mp3
任务示例
识别后的 MarkDown 文件
Markdown源文件
  • 直播2音频转写结果.md
预览示例
最近更新时间:2026.04.01 20:58:54
这个页面对您有帮助吗?
有用
有用
无用
无用