Qwen 于 7 月 31 日发布新一代语音识别模型 Qwen-Audio-3.0-ASR-Flash,主打上下文一致性、领域术语识别、自定义热词,以及将语音润色输出为结构化文本等能力。内部测试显示,该模型医学术语召回率达 95.36%,工业术语召回率达 93.24%。
模型提供三种部署形态:实时流式识别(Streaming)、录制文件转录(Filetrans)和非实时识别,均已通过阿里云模型服务上线。
Qwen(@Alibaba_Qwen)
🌸 在花频道 · 茶馆水群 · 投稿通道
👍 119 👎 10 ❤️ 2