伴随大模型产业全面普及,行业对高性能边缘推理算力的需求集中爆发。然而,云端 Token 成本高、算力不足、数据合规受限等痛点,持续制约 AI 的规模化落地。在 WAIC 2026 上,爱芯元智重磅揭秘全新"元曦"系列大算力 AI 推理新品,正是为破解这一行业难题而来——从底层重构边缘 AI 的 Token 经济体系,为企业 AI 规模化落地实现降本、提效、合规的多重价值。
![]()
痛点:被"云端"卡住的企业 AI
当企业尝试把大模型能力引入多路视频分析、私有化知识库、机房集群等高负载业务时,往往会撞上三道墙:一是云端 Token 调用成本随规模线性上升;二是高峰期云端算力不足,推理延迟难以接受;三是核心业务数据出域带来的合规风险。这三大痛点,本质上都指向同一个解——把推理算力搬到边缘。
元曦系列:千 TOPS 级边缘大算力登场
元曦系列大算力产品专攻高并发、高负载场景。其中 A 系列 AI 推理卡搭载超 1000 TOPS 推理算力,配合超大显存与超高显存带宽的硬核配置,补齐了高端边缘大算力市场的空白。其超大显存可稳定承载大模型权重与海量数据,超高带宽突破传统边缘设备的性能天花板,高效支撑长文本推理、高清图像解析等高 Token 消耗业务,大幅削减对云端调用的依赖,从源头压降 Token 开销与传输成本。
分层算力矩阵:从轻量到千 TOPS 的全覆盖
元曦系列并非孤立产品,而是与已规模化落地的 M.2 算力卡、标准化核心模组共同构成"分层全覆盖"的边缘算力矩阵:
![]()
技术底座:爱芯通元混合精度 NPU
元曦系列的硬实力,来自爱芯元智多年"场景需求驱动技术创新"的积累。公司持续发力"爱芯通元"混合精度 NPU的全栈自研,在多精度调度、访存效率及全模型兼容上形成优势。这让元曦系列既能稳定承载大模型权重,又能高效支撑长文本、高清图像等高 Token 消耗业务,在算力效率、成本控制与数据安全之间实现统一。
价值闭环:从"云端试点"迈向"边缘规模化落地"
通过重构企业的 AI 成本模型,元曦系列在降低 Token 开销的同时,全面满足数据本地化与合规管控要求,有力推动产业 AI 从"云端试点"迈向"边缘规模化落地"——这正是边缘计算从概念走向生产力拐点的关键一跃。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.