字节跳动于2026年8月5日正式推出原生音视频全双工大模型SeedRealtime。该模型采用统一架构,原生融合音频、视频与文本,能够在连续多模态信息流上进行实时交互。
端到端人工评测结果显示,与级联模型相比,SeedRealtime的音视频对话节奏问题减少一半,模型在说话时机的把握上更为自然,“话未说完被抢断、话音已落却回应迟缓、被背景杂音与闲聊误触发”等情况显著减少;同时,单次对话完整、顺畅交流的概率也有明显提升。
SeedRealtime已在豆包App全量上线。
市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。
本文源自:市场资讯
作者:疏桐
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.