阿里发布Qwen-Audio-3.0-ASR-Flash语音识别大模型

2026年7月31日,阿里巴巴正式发布语音识别大模型Qwen-Audio-3.0-ASR-Flash。该模型聚焦上下文一致性、行业词识别与热词定制化三大方向,新增语音润色能力,可直接输出结构化文本。其医疗场景专业词识别率达95.36%,并在AI评测平台Artificial Analysis以1.7%错字率获全球第一。目前已通过阿里云百炼平台开放调用,提供Flash(5分钟内识别)、Filetrans(离线转写)和Streaming(实时识别)三个版本。

原创文章,作者:狐呼网,如若转载,请注明出处:https://www.ihuho.cn/13343.html

(0)
上一篇 11小时前
下一篇 11小时前

相关推荐

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

公众号
公众号
新媒体群
新媒体群
联系邮箱

1284674160@qq.com

分享本页
返回顶部