36氪 09-23
科大讯飞发布最新一代语音识别大模型Spark-ASR-2.0
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

9 月 23 日,科大讯飞正式发布最新一代语音识别大模型 Spark-ASR-2.0。据了解,该模型延续并深化了 Spark-Audio-1.0-Preview 语音基座大模型的技术能力,通过非自回归与 LLM 增强自回归协同、中英文混合文本与声学联合增强、动态上下文注入等关键技术,实现了整体语音识别效果的大幅提升。同时,Spark-ASR-2.0 的推理成本相对前一代模型仅增加了 10%。Spark-ASR-2.0 将从 9 月 24 日开始逐步上线讯飞输入法,并且通过讯飞开放平台提供 API 服务,后续将陆续应用在讯飞 AI 眼镜、讯飞智能办公本、讯飞听见等产品上。

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

语音识别 科大讯飞 讯飞 效果
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论