科技进展中更新于 6 小时前 · 始于 2026年9月23日
科大讯飞发布全新语音识别大模型Spark-ASR-2.0
据 IT之家 报道,9 月 23 日,科大讯飞正式发布最新一代语音识别大模型 Spark-ASR-2.0。该模型通过关键技术创新在通用识别和复杂声学场景识别等方面实现明显改善,其整体推理成本相较于 Spark-ASR-1.0 仅增加了 10%。

coda.news 分析
要点
- 01Spark-ASR-2.0 采用了解析非自回归与 LLM 增强自回归协同、中英文混合文本与声学联合增强以及动态上下文注入等关键技术创新。
- 02该模型改善了中英文混合、方言、专业术语等通用识别,以及高噪、小音量、快语速和儿童等复杂声学场景识别。
- 03相较于 Spark-ASR-1.0,新模型在各核心语音识别场景下的 WER 明显降低,并在测试集中使用了 WER 和 CER。
- 04官方表示,与当前业界最好水平相比,该模型在方言、高噪和小音量上拥有显著优势,主要任务效果均好于业界最优水平。
由 AI 根据下方来源生成,请以原文为准。
各国怎么说
在我们收录的来源里,目前只有一个国家报道了这件事。找到第二个国家的报道后,这里会出现各国视角对比。
来源
摘要由 AI 根据所链接的来源生成,可能有误,请以原文为准。我们只做摘要和链接,从不转载原文。图片来自开放授权图库、官方宣传图和品牌 logo,均注明来源。如您是图片权利人,希望修改署名或删除,请发邮件至 info@coda.news,我们会尽快处理。