Meta 推出 Muse Voice Transcribe,支持多语言及长音频转写
22 小时前
Meta 推出由其超级智能实验室开发的实时音频感知模型 Muse Voice Transcribe,该模型支持实时流式自动语音识别、超 20 位说话人语音分割及端点控制,可处理超 1 小时长音频,支持多语言及无缝语码切换,能通过语言、关键词和上下文偏好提升识别准确率,在相关基准测试中排名第一。它已用 70 多种语言训练,25 种经全面验证,具备自适应延迟功能,可动态平衡速度与准确率,还基于 ASR 构建了说话人分割和语音端点检测功能,可通过 Meta Model API、Mac 版 Meta AI 和 Muse Code 使用,API 有相应定价。语音转写正从独立工具向 AI 系统实时感知层演进,未来竞争核心将聚焦多维度能力并与大模型相关能力融合。
Meta 甩出语音转写「神器」:准确识别中英文夹杂
ITBear 科技资讯
Meta 推出语音转写新模型:多语言无缝切换,超 20 人畅聊 1 小时精准识别
ITBear 科技资讯
Meta 甩出语音转写「神器」:准确识别中英文夹杂,支持超 20 人长聊 1 小时
maomu.com/36Kr/智东西
2026-09-03
Meta 发布 Muse Spark 1.3 模型 推进个人 AI 代理开发2026-08-06
Meta 推出首款 AI 编程智能体 Muse Code2026-07-09
Meta 推出首款付费 AI 开发者模型 拟打造性价比优势2026-04-09
Meta 推出新 AI 模型 Muse Spark 加码追赶竞争对手2025-11-11
Meta AI 推出「全语种」语音识别系统,支持 1600+ 语言2025-08-25
Meta 公布 Reels 短视频音频翻译功能,支持英语与西班牙语互译2025-08-20
Meta 面向全球推出 AI 语音翻译功能,助力全球创作者打破语言壁垒查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。