1月8日,阿里云在通义智能硬件展上发布了一款面向AI硬件的多模态交互开发套件。该套件集成了千问、万相、百聆三款通义基础大模型,并预置了覆盖生活休闲、工作效率等领域的十多款Agent和MCP工具。
这套开发工具旨在为硬件设备提供能听、会看、可思考并与物理世界交互的能力,目标应用场景包括AI眼镜、学习机、陪伴玩具、智能机器人等多种硬件设备。
在技术层面,该套件为满足硬件设备对低成本、低时延的普遍需求,在芯片层面适配了超过30款主流的ARM、RISC-V和MIPS架构终端芯片平台。除基础模型外,阿里云还针对大量多模态交互场景进行了分析,推出了适合AI硬件交互的专有模型,全面支持全双工语音、视频、图文等交互方式。据披露,其端到端语音交互时延可低至1秒,视频交互时延低至1.5秒。
此外,该套件接入了阿里云百炼平台生态,用户不仅可以添加其他开发者提供的MCP和Agent模板,还能通过A2A协议兼容第三方Agent,以扩展应用的能力边界。阿里云在展会现场还展示了面向智能穿戴设备、陪伴机器人等领域的解决方案。
根据国际权威市场研究机构Gartner发布的生成式AI技术创新指南系列报告,阿里云在生成式AI云基础设施、工程、模型以及AI知识管理应用四大维度均位于新兴领导者象限。
声明:市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。
本文源自:市场资讯
作者:观察君
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.