2026年7月31日,阿里巴巴正式发布语音识别大模型Qwen-Audio-3.0-ASR-Flash。该模型聚焦上下文一致性、行业词识别与热词定制化三大方向,新增语音润色能力,可直接输出结构化文本。其医疗场景专业词识别率达95.36%,并在AI评测平台Artificial Analysis以1.7%错字率获全球第一。目前已通过阿里云百炼平台开放调用,提供Flash(5分钟内识别)、Filetrans(离线转写)和Streaming(实时识别)三个版本。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。

扫一扫关注微信