语音与音频·EASYHUB 选读
Qwen3-ASR 将语音识别和时间戳对齐分成独立组件

这次有什么变化
系列包含两种语音识别尺寸和强制对齐模型,提供流式、批量与时间戳功能。语种和方言数量、并发吞吐与单请求延迟是不同指标,部署时需分别核对。
- 原文标题
- 阿里千问开源 Qwen3-ASR 语音识别模型:支持 52 种语种与方言,1.7B 版本达 SOTA 水平
- 来源
- IT之家 · www.ithome.com
- 主题
- 语音与音频
- 原文月份
- 2026-01
本页是 EasyHub 根据所列来源整理的简短选读,不是完整报道或原创采访。预览、计划开放与正式可用以摘要及原文说明为准。
本站摘要页面发布 · 更新 · 内容说明