新浪财经 股票

科大讯飞发布语音识别大模型Spark-ASR-2.0

观点新媒体

关注

观点网讯:9月23日,科大讯飞发布最新一代语音识别大模型Spark-ASR-2.0。

该模型采用非自回归与LLM增强自回归协同、中英文混合文本与声学联合增强、动态上下文注入等关键技术创新,实现整体语音识别效果的大幅提升。

在通用识别方面,该模型对中英文混合、方言及专业术语的识别能力显著增强。

在复杂声学场景下,该模型针对高噪、小音量、快语速及儿童语音的识别表现明显改善。

此外,该模型在上下文识别和文本流畅规范性方面也取得了优化。

免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。

加载中...