手机摄像头已经卷到2亿像素、8K视频的今天,苹果却给未来AI硬件准备了一颗只有100万像素的摄像头。这个看起来有些寒酸的参数,恰恰可能是苹果AI布局里最关键的一环。
MacRumors从macOS Tahoe 26.7 RC的系统代码中挖出了苹果制作好的宣传视频:戴着AirPods拿起一本书,Visual Intelligence看见书名,再让Siri把它保存下来。视频里的产品代号是B790,按照Mark Gurman的说法,它原本就在苹果2026年的产品路线图上,后续量产版本B798则要等到2027年。
![]()
系统代码第一次让我们看清了这副耳机究竟怎么「看」。这套摄像头至少存在两种工作状态:主动模式下可以采集640×640图像,经过处理后最高输出1024×1024;被动模式则采集320×320,输出320×320或512×512图像。左右两只AirPods可以同步获取RGB静态图像,通过相同的Frame ID对齐两个视角,再按照一定频率持续采集,交给Visual Intelligence处理。
为什么100万像素就够了?
对于AI来说,很多时候根本不需要4800万像素的照片。模型只需要知道,桌上放着一本书,前面是家餐厅,手里拿着瓶饮料,路牌上写着什么。分辨率降下来,数据量随之减少,图像处理和传输的负担也会下降。对于电池只有耳机大小、又需要长时间佩戴的设备来说,功耗和续航是比清晰度更需要考虑的问题。
过去二十年,消费电子里的摄像头主要服务于人。像素、传感器尺寸、动态范围、色彩,最终都指向同件事:得到好看的照片。但AI硬件的摄像头,核心用途并非摄影,而是场景AI识别。现实世界先被摄像头转化成视觉数据,再交给模型理解。
今年上市的光帆AI全感耳机就是很直接的参照。它同样把摄像头塞进左右两只耳机,采用两颗200万像素定焦摄像头,甚至把4G eSIM和GPS放进耳机盒,让设备减少对手机的依赖。200万还是100万像素,在这里没有那么重要。工程问题已经变成:能不能看清,处理要多久,需要传多少数据,又要消耗多少电。
AirPods如何理解「这本」?
两只AirPods耳机,已经组成了一套传感器组合:摄像头观察眼前有什么,陀螺仪记录头部朝向,麦克风收集周围声音,位置和运动传感器补充人在哪里、正在做什么。
比如走进书店,拿起一本书,然后问Siri:「这本怎么样?」单独把这句话交给今天的大模型,它其实什么也不知道。但如果AirPods刚刚看到了封面,知道头部正在朝向这本书,同时iPhone知道你身处书店,那么Siri才真正理解「这本」究竟指什么。如果系统还知道你过去读过同个作者的两本书,其中一本看完了,另一本只读了三分之一,它甚至可以给出只对你有意义的答案。
今天我们和AI交流时,一直在不停地向它解释自己:我是谁,我在哪里,我刚刚看到了什么,我手里拿着什么,为什么突然问这个问题。很多Prompt,本质上都在人工补充机器缺失的上下文。摄像头、麦克风和位置、运动状态传感器所做的,就是逐渐把这些解释省掉。
隐私保护的新问题
这次被挖出来的系统代码里还有个很小的细节:每只AirPod似乎都能够控制硬件指示灯,包括开关和亮度。如果这对应摄像头的工作状态,那么当AirPods获取环境图像时,周围的人可能会通过灯光得到提醒——这倒是很符合苹果一贯的隐私保护策略。
如果摄像头只是偶尔拍张照片,亮灯或许已经足够;但如果它需要以较低频率持续理解环境,问题就复杂了。因为AI需要的并不是某张照片,而是上下文,因此也需要持续打开各项感官,这时候恰当的提醒就非常重要。
从这个角度上看,AirPods的定位也发生了微妙的变化——不再是单纯的耳机,而是一种新的AI硬件形态。如果诸如此类的变化不止于AirPods,而是来到更多苹果产品上呢?
2027年:苹果AI硬件的关键节点
2027年,对苹果而言本来就是特殊的年份——iPhone发布二十周年。按照目前的爆料,苹果正在准备大幅改变设计的二十周年iPhone,而摄像头AirPods也可能在同一时期登场。与此同时,苹果还有几条AI硬件产品线正在推进:除了摄像头AirPods,还有智能眼镜,以及可以夹在衣服上、或者作为项链佩戴的AI挂饰。此前曝光的产品规划中,也出现过配备摄像头的Apple Watch。
但如果暂时把「产品」拿掉,只看它们身上的传感器,会看到另一幅图景。其实这张网络的很多节点,今天已经在我们身上了:手腕上的Apple Watch知道昨晚几点睡着、今天走了多少路;口袋里的iPhone知道几点离开公司、去了哪家餐厅;Mac知道下午打开了哪些文档;AirPods则几乎一直贴着耳朵。
苹果现在准备做的,是给这些设备继续增加感知能力。过去,这些信息分散在不同设备和App里——心率属于「健康」,照片属于「相册」,位置属于「地图」……AI出现以后,它们第一次可以成为同样的东西:上下文。
于是,AirPods知道听到了什么,也可能知道正在面对什么;Apple Watch知道身体正在发生什么;iPhone知道在哪里、正在和谁沟通;Mac知道正在处理什么工作。如果智能眼镜最终出现,它还会获得直接的第一人称视角。任何设备单独拿出来,都不足以真正理解人,但它们分别掌握着人的不同切面,一经协同,就拥有了对一个人的全景式了解。
这也是苹果和许多AI硬件创业公司之间很难复制的差别。过去几年,行业一直在寻找所谓「AI时代的iPhone」——有人做Pin,有人做项链,有人做眼镜。但苹果不需要重新发明AI硬件,它只需要让已经存在的硬件,长出新的感官。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.