观点网讯:9月23日,科大讯飞发布最新一代语音识别大模型Spark-ASR-2.0。
该模型采用非自回归与LLM增强自回归协同、中英文混合文本与声学联合增强、动态上下文注入等关键技术创新,实现整体语音识别效果的大幅提升。
在通用识别方面,该模型对中英文混合、方言及专业术语的识别能力显著增强。
在复杂声学场景下,该模型针对高噪、小音量、快语速及儿童语音的识别表现明显改善。
此外,该模型在上下文识别和文本流畅规范性方面也取得了优化。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.