2026年7月31日,阿里巴巴正式发布语音识别大模型Qwen-Audio-3.0-ASR-Flash。该模型聚焦上下文一致性、行业词识别与热词定制化三大方向,新增语音润色能力,可直接输出结构化文本。其医疗场景专业词识别率达95.36%,并在AI评测平台Artificial Analysis以1.7%错字率获全球第一。目前已通过阿里云百炼平台开放调用,提供Flash(5分钟内识别)、Filetrans(离线转写)和Streaming(实时识别)三个版本。
原创文章,作者:狐呼网,如若转载,请注明出处:https://www.ihuho.cn/13343.html

