把音频送进语音转文字模型之前先做降噪处理,效果会有巨大提升。这是Krisp给出的判断,它刚刚发布了一个开放的基准测试。
Krisp把这件事拆成了两个环节:一是削减噪音,二是把处理后的音频交给语音转文字模型。前一步做得好不好,直接决定后一步的输出质量。
![]()
语音隔离正在成为下一个重点
Krisp认为,语音隔离是接下来值得重点关注的方向。它没有停留在概念层面,而是选择用开放基准测试的方式,把这件事摆到台面上来比较。
对于做语音相关产品的团队来说,这个信号很直接:与其在转写模型上反复调优,不如先看看送进去的音频本身干不干净。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.