Google发布了一款新的语音识别模型Gemini 3.5 Transcribe。它能够从原始语音数据中生成准确、格式规整的文本。
实时转写与自动清理
![]()
该模型在实时文字转写过程中,可以自动删除“あー”“えー”这类语气词。面对噪声、复杂专业术语和口语表达,它也能保持较好的识别效果。
![]()
输出格式化的文本
![]()
根据Google的介绍,Gemini 3.5 Transcribe不只是简单记录语音内容,而是直接产出经过格式处理的文本,省去后续整理步骤。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.