字节跳动与京东在48小时内先后向同一个方向落子:让AI学会生成或理解一个能对人做出回应的世界,而不只是生成一段文字或一张图片。世界模型成为中国头部公司AI竞争的新方向。
9月7日,彭博社援引知情人士报道,字节跳动正基于视频生成模型Seedance开发一款实时空间视频生成模型,最快10月亮相。淡出日常管理五年的创始人张一鸣亲自协调业务、模型和算力资源。
两天后的9月9日,京东在全球科技探索者大会(JDD)上宣布,京东云将与摩尔线程等合作伙伴规划建设10万卡国产GPU集群。
京东同时发布实时可交互世界模型JoyAI-EchoWM,并亮出覆盖多模态、世界模型和具身模型的JoyAI基础模型矩阵。
不过,双方共同押注的前提尚未被验证:世界被生成、被计算出来后,规模化的生意究竟如何成立。
可参照的是上一轮对元宇宙的押注。Meta旗下Reality Labs自2021年以来累计运营亏损已超850亿美元,截至2026年上半年。
其中,2025年该部门单年亏损192亿美元;Meta预计2026年亏损规模仍与上年持平。
彭博社给出的参数显示,字节的新模型能以每秒20帧的速度按需生成视频,端到端延迟约50毫秒,接近人类感知阈值。更关键的是生成方式:计算密集的空间渲染在云端完成,再串流到头显。
用户戴上Pico后,走动、转身或开口,眼前的虚拟世界会实时改变。这一方案落地方向指向直播、短剧和游戏。
其瞄准的是VR行业成本最高的一环——硬件。Meta Quest与苹果Vision Pro将算力塞进头显,导致设备又贵又重;据第三方统计,Vision Pro全球累计销量仅约60万台。
字节的解决方案则相反:头显只负责显示与交互,算力交给云端。一旦成立,VR的竞争焦点将从硬件规格转向模型、云和内容,这恰是字节已有的三类资产。
但成本并未消失,只是发生转移。在Meta和苹果模式下,硬件成本由用户一次性承担;在字节模式下,每一小时使用都是一笔实时推理账单,用户越多、在线越久,算力消耗越大。
把每秒20帧的生成质量乘以百万级并发,是一张尚无任何VR厂商支付过的账单。这门生意能否成立,取决于一个当前没有答案的问题:推理成本下降速度能否跑赢使用时长的增长。
终端同样构成现实约束。模型计划与Pico头显打通,但Pico的进展并不顺利:2023年底,因Pico 4销量不及预期、每售出一台约亏损500元,字节取消了Pico 5的发布,团队从1800余人收缩至800余人。
整体市场亦未回暖。Omdia数据显示,2026年上半年全球XR头显出货量同比下降38.7%至190万台,连续第四年萎缩。另有一个细节:字节被曝正在开发计划2027年发布的中端MR眼镜,计算单元采用外置设计。
市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。
本文源自:市场资讯
作者:闻野
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.