决策模型「d1」现在能读图了。它可以在处理文本的同时接收图像输入,把两种信息放在同一个任务里一起处理。
官方给出的对比对象是现有的最前沿模型。在同一任务上,d1的表现被描述为同等以上,而成本大幅更低。速度快、精度高、花钱少,这三件事同时出现在一份说明里。
![]()
多模态输入对决策类模型意味着什么,目前还没有更多细节。能确定的是,文本加图像的双通道处理能力,已经写进了d1的能力清单。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.