网易首页 > 网易号 > 正文 申请入驻

阿里云“抢滩”物理AI    构建多模态硬件生态闭环

0
分享至

来源:市场资讯

(来源:证券时报)

随着多模态大模型的发展,物理AI成为科技巨头角逐的关键阵地。日前在深圳举办的阿里云通义智能硬件展上,阿里云发布多模态交互开发套件,集成了千问、万相、百聆三款通义基础大模型,预置十多款Agent和MCP工具,丰富硬件设备与物理世界的智能交互能力。

降低开发门槛

“2026年我们特别看好智能硬件,应该会看到很多新的品类,绝对不光是手机、汽车和眼镜。”阿里云通义大模型业务总经理徐栋在展会期间接受媒体采访时预计,把模型从“云上”向“云下”落地,提高易用性,有利于生态繁荣,商业模式也可能会形成闭环;作为重要趋势,当前一些新型应用围绕小型化、碎片化的刚需开展,厂商通过模型去定义硬件,提高用户黏性,模型能力逐渐提升,品牌效应逐步形成。

但是,AI硬件的普及仍然面临多重障碍。

徐栋指出,很多AI硬件的形态成本仍未达到大众普及水平,而且存在隐私顾虑。另外,开发范式转型滞后,很多厂商还停留在传统Coding(编程)思维,没意识到IDR(需求定义)的价值越来越重要,且模型能力在泛化调用工具等方面仍有提升空间。此外,硬件厂商自建模型面临的延时、效果与安全问题,进一步制约了产业发展。

本次阿里云多模态交互开发套件为硬件企业和解决方案商提供了低开发门槛、响应速度快、场景丰富的平台。其中,突出特点在于计费方式的改变。

“我们把原来的按Token计量计费改变成一个按硬件的终端提供服务。”徐栋介绍,按License收费是精算的过程,通过区分不同类目和等级,比开发者自己搭建ASR(语音转文本)、TTS(文本转语音)、LLM(大语言模型)成本低很多。比如有些语音模型TTS可以稍微降低拟人化的要求,从而大幅降低成本。

专有硬件交互模型

现场,阿里云展示了面向智能穿戴设备、陪伴机器人、具身智能等领域的解决方案。例如,在AI眼镜领域,基于千问VL、百聆CosyVoice等模型,阿里云打造了感知层、规划层、执行层以及长期记忆的完整交互链路,可一站式实现同声传译、拍照翻译、多模态备忘录、录音转写功能,有效解决交互不自然、回答准确率低的难题。

面向家庭陪伴机器人场景,基于千问模型和多模态交互套件,阿里云推出的解决方案不仅可实时监测异常状况,并及时告警信息推送,用户还能基于关键词查找、定位视频,与机器人进行对话交互和控制设备等。

除通义模型家族外,阿里云还针对大量多模态交互场景进行分析,推出适合AI硬件交互的专有模型,全面支持全双工语音、视频、图文等交互方式,端到端语音交互时延低至1秒,视频交互时延低至1.5秒。该套件还接入了阿里云百炼平台生态,用户不仅可以添加其他开发者提供的MCP和Agent模板,还能通过A2A协议兼容三方Agent,极大程度地扩展了应用的能力边界,帮助企业灵活搭建业务场景。

对于阿里云在手机、智能眼镜等大品类硬件领域的竞争壁垒,徐栋表示,阿里云愿意与开发者合作,降低门槛,也会探索大量的垂直领域的深度合作。

目前AI手机并行GUI(图形界面,GraphicalUserInterface)与A2A(应用间自动化交互,Application-to-Application)两大技术路线。

在徐栋看来,当前两大路线均处于发展早期。技术核心需解决泛化性与速度性能问题,且需依托手机更多权限实现优化。短期来看,A2A路线发展更快,体验更优、响应速度更快且模型消耗成本更低;GUI路线依赖多模态视觉交互,长期使用成本更高,两条路线均具备探索价值。

助力垂直场景应用落地

该套件还接入了阿里云百炼平台生态,用户不仅可以添加其他开发者提供的MCP和Agent模板,还能通过A2A协议兼容第三方Agent,极大程度地扩展了应用的能力边界,帮助企业灵活搭建业务场景。

“今天的套件其实依托于我们阿里云的MaaS(模型即服务)服务而来的,适合垂直场景。”徐栋介绍,过去很多开发者基于百炼平台自行搭建工具、开发Agent,如今套件做了针对性改造,降低了操作复杂度,支持快速实现多种智能化能力,同时对百炼平台的MCP(模型调用平台)能力进行了封装,开发者可直接快速调取,而且套件通过API(应用程序接口)、SDK(软件开发工具包)与百炼形成通道衔接,实现与各类硬件的深度整合。

另外,套件适配30多款主流ARM、RISC-V和MIPS架构终端芯片平台;未来,通义大模型还将与玄铁RISC-V实现软硬全链路的协同优化,实现通义大模型家族在RISC-V架构上的极致高效部署和推理性能。

“玄铁在RISC-V开源生态贡献很大,我们最早合作是为了让千问与玄铁同频共振,让开发者能自主可控。”徐栋表示,不过与玄铁合作并非目标实现模型硬件化,而是优化通用模型,让端侧速度更快、体验更好。

2026年CES上,芯片巨头重点锚定物理AI以及具身智能等进展趋势,推出系列新品。

“具身智能还处于非常早期的阶段。”徐栋表示,阿里云在具身智能领域一方面是基于千问Omni多模态模型的交互合作。该模型支持“看、听、说”多模态协同,非单路输入输出,而是具备低延时、高拟人性及多语言出海能力,已被头部机器人公司用于交互场景,但受限于机器人市场本身规模,当前应用量不大。另一方面,公司研发探索VLA(视觉—语言—动作)模型,但受数据、模型架构、任务泛化性等因素限制,仍处于早期阶段;预计2026年下半年可看到相关架构成果,但要实现高度泛化的VLA能力还需更多时间。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
算命人说,家有这3生肖的人财气缠身,2026年躲不过一富

算命人说,家有这3生肖的人财气缠身,2026年躲不过一富

人閒情事
2026-01-12 10:41:54
山东传来一声巨响,中国在海底挖出“第二国库”,突破技术封锁!

山东传来一声巨响,中国在海底挖出“第二国库”,突破技术封锁!

蜉蝣说
2026-01-13 11:12:50
丹麦首相警告特朗普:你要是敢动一下格陵兰,那北约就等着解体吧

丹麦首相警告特朗普:你要是敢动一下格陵兰,那北约就等着解体吧

爱史纪
2026-01-13 14:44:51
放弃狄龙走向重建了!两大球星摆上货架,19+7榜眼价值不如特雷杨

放弃狄龙走向重建了!两大球星摆上货架,19+7榜眼价值不如特雷杨

你的篮球频道
2026-01-13 08:12:49
5万一套海景房成“鬼城”!200户仅20户住,老人靠卖煎饼勉强维生

5万一套海景房成“鬼城”!200户仅20户住,老人靠卖煎饼勉强维生

墨兰史书
2026-01-13 03:40:03
马斯克抛出2026年九大“疯狂”预言:科技狂飙下的未来图景

马斯克抛出2026年九大“疯狂”预言:科技狂飙下的未来图景

娱乐督察中
2026-01-11 13:48:02
今年三九天太反常!老话“三九连日晴”,啥预兆?答案来了

今年三九天太反常!老话“三九连日晴”,啥预兆?答案来了

刘哥谈体育
2026-01-13 11:45:52
珠穆朗玛峰明明只有一半在中国,为何全世界都认为是中国的?

珠穆朗玛峰明明只有一半在中国,为何全世界都认为是中国的?

丰谭笔录
2026-01-07 10:58:31
王毅罕见取消访问,台媒大肆炒作,别以为借题发挥,就能阴谋得逞

王毅罕见取消访问,台媒大肆炒作,别以为借题发挥,就能阴谋得逞

历史有些冷
2026-01-13 18:20:03
金球奖这一夜,国际女星个个风情万种,但都被一位中国女星艳压了

金球奖这一夜,国际女星个个风情万种,但都被一位中国女星艳压了

八卦南风
2026-01-12 16:25:50
美军对伊朗的打击,已经是箭在弦上了

美军对伊朗的打击,已经是箭在弦上了

寰宇大观察
2026-01-13 18:35:03
再次提醒,红旗河工程全是骗局!所有工程人,一定要远离

再次提醒,红旗河工程全是骗局!所有工程人,一定要远离

荷兰豆爱健康
2026-01-12 11:32:56
被吐槽的平庸之王:为何满身瑕疵的F-35,目前依然能统治全球天空

被吐槽的平庸之王:为何满身瑕疵的F-35,目前依然能统治全球天空

形上谓道
2026-01-12 10:25:18
三分绝杀,是张庆鹏布置的战术成功了?赛后,廖三宁是这样说的

三分绝杀,是张庆鹏布置的战术成功了?赛后,廖三宁是这样说的

小楼侃体育
2026-01-13 15:19:41
多人对一女生拳打脚踢视频疯传!内蒙古五原警方回应:正在调查

多人对一女生拳打脚踢视频疯传!内蒙古五原警方回应:正在调查

潇湘晨报
2026-01-13 15:54:15
82岁大妈大实话:男人过了75岁,剩下的用处就这两点,别嫌弃太早

82岁大妈大实话:男人过了75岁,剩下的用处就这两点,别嫌弃太早

观星赏月
2026-01-11 08:28:26
A股:周二,放量跳水,原因是这两点!股市尾声将至?

A股:周二,放量跳水,原因是这两点!股市尾声将至?

明心
2026-01-13 11:17:28
大俄太狠!一顿袭击将基辅变成“冰窖”,市长都呼吁市民尽快离开

大俄太狠!一顿袭击将基辅变成“冰窖”,市长都呼吁市民尽快离开

战刃
2026-01-10 20:04:54
Science:首次证实,有些狗狗通过偷听主人对话学会新词汇,能力堪比一岁半的人类宝宝

Science:首次证实,有些狗狗通过偷听主人对话学会新词汇,能力堪比一岁半的人类宝宝

生物世界
2026-01-12 12:24:25
国家发改委原副主任扶持公司上市,原始股十三年后获利数千万

国家发改委原副主任扶持公司上市,原始股十三年后获利数千万

南方都市报
2026-01-12 22:21:05
2026-01-13 19:07:00
新浪财经 incentive-icons
新浪财经
新浪财经是一家创建于1999年8月的财经平台
2013782文章数 5234关注度
往期回顾 全部

科技要闻

每年10亿美元!谷歌大模型注入Siri

头条要闻

距中国加强管制不到一周 日本派船盯上6000米深海稀土

头条要闻

距中国加强管制不到一周 日本派船盯上6000米深海稀土

体育要闻

他带出国乒世界冠军,退休后为爱徒返场

娱乐要闻

周杰伦以球员身份参加澳网,C位海报公开

财经要闻

"天量存款"将到期 资金会否搬入股市?

汽车要闻

限时9.99万元起 2026款启辰大V DD-i虎鲸上市

态度原创

本地
艺术
亲子
家居
教育

本地新闻

云游内蒙|到巴彦淖尔去,赴一场塞上江南的邀约

艺术要闻

书法争议再起:拙与妍孰优孰劣引发热议

亲子要闻

复旦儿科医联体体重管理联盟来了!将重点加强儿童超重肥胖危险因素的监测与评估

家居要闻

现代简逸 寻找生活的光

教育要闻

重磅!艺考生或将开启100%升本科阶段!山东高一、高二400分以下的学生,赶紧去了解艺考!

无障碍浏览 进入关怀版