一家由剑桥连续创业者创办的实时交互视频生成公司,刚刚拿到了新一轮融资。
SigmaZ AI,这家专注于AI视觉交互赛道的公司,近日宣布完成数百万美元融资。本轮由蓝驰创投领投,多家机构跟投。公司基于扩散语言模型(Diffusion-LM)技术,打造出将像素(Pixel)与代码(Code)结合的“活画面”——既能实时交互,又能现场修改,和传统视频那种“像素锁死”的形态有本质区别。
![]()
两位创始人,一条新赛道
![]()
SigmaZ AI由两位联合创始人共同创立。William Yang Bolin,2003年出生的剑桥连续创业者;Derek Law,此前担任亚马逊AGI实验室(伦敦)旗舰模型视觉代码训练负责人。一个懂用户需求,一个懂模型能力,两人在Pixel-Code融合路径上的判断相当清晰。
公司的首款产品Tap8即将正式上线,定位是让交互式视频成为人与AI之间的新界面。
为什么是“像素+代码”?
想象一下和AI开视频会议的场景。你当然希望看到一张脸——表情、手势、眼神、情绪,这些高熵、模糊的信息,最适合用像素来表达。
但如果AI在讲解一家公司的财报呢?你大概率不希望它举着一张纸对着镜头念数字。你更想要的是屏幕共享:图表就是图表,数字就是可读的数字,按钮可以点击,3D产品可以旋转,流程可以展开,系统清楚知道哪个对象发生了变化。
![]()
这两类信息,本质上属于不同的模态。像素擅长表达外观,代码擅长表达结构。前者处理“世界长什么样”,后者处理“世界里有什么、事物之间如何关联、我能对它们做什么”。
从“聊天框”到“活画面”
回看过去两年,AI的想象力一直被“聊天框”束缚着。无论是打字还是语音,交互方式始终停留在传统的问答格式。
但现实中,大量人类的好奇心很难被精确翻译成文字。比如看耳机评测时,我们想直接看到内部结构——这种需求,用像素加代码的交互视频来表达,远比文字描述来得直观。
蓝驰创投方面表示,AI技术的持续演进正在推动信息媒介从“可看”走向“可交互”,加速内容生产和消费的形态重塑。实时交互内容正在成为AI时代重要的新媒介形态,蓝驰会持续关注并支持这一方向的技术演进和产品落地。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.