阿里发布 Qwen-Audio-3.0-ASR-Flash 语音识别大模型,让 AI 更好听懂专业词汇
4 小时前
阿里巴巴发布语音识别大模型 Qwen-Audio-3.0-ASR-Flash,该模型在上下文一致性、行业词识别、热词定制化方面优化,具备语音润色及结构化文本输出能力,其依托多行业高质量词库提升专业词识别率,医疗场景听中率达 95.36%。Qwen-Audio-ASR-Flash 系列已在会议纪要整理等多场景验证,曾以 1.7% 错字率获 AI 评测平台全球第一。目前 Qwen-Audio-3.0-ASR 通过阿里云百炼平台开放调用,含语音识别、离线文件转写、实时语音识别三个版本。
2026-07-15
阿里发布实时语音交互对话模型 Qwen-Audio-3.0-Realtime2026-06-22
阿里巴巴发布 HappyHorse 1.1 视频生成模型2026-06-16
阿里发布首个具身大模型 Qwen-Robot 系列2026-06-02
阿里拉升涨超 6%,发布 Qwen3.7-Plus 多模态智能模型升级版2026-05-28
ASR、TTS、Chat 均为第一,阿里语音大模型拿下「大满贯」2026-04-16
阿里发布世界模型 HappyOyster,与谷歌 Genie3 竞争2026-04-16
阿里巴巴发布可用于游戏开发的 AI 模型2026-04-10
阿里视频生成大模型 Wan2.7 登顶 DesignArena 榜单查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。