NVIDIA在获得Groq非独家授权8个月后,首次将Groq技术整合进机架级产品。Groq机架将于今年上线,标志着双方合作从授权阶段进入产品落地阶段。
工作负载如何拆分
![]()
NVIDIA将智能体AI工作负载按任务特性拆分为三部分:Rubin GPU负责重计算,Groq 3 LPX处理延迟敏感的token生成,Vera CPU运行代码与数据处理。这种分工让不同硬件各司其职。
性能对比
相比Cerebras,Groq 3 LPX声称带来4倍响应速度提升,对长任务影响尤为显著。不过这一数据来自厂商宣称,实际表现有待产品上线后验证。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.