大模型落地难?那就把NPU“拆”出来单干
2026年7月24日,AI系统芯片(SoC)供应商爱芯元智正式宣布成立全资子公司“爱芯计算”。这一消息在刚刚落幕的WAIC 2026余温未散之际释放,恰逢AI产业从大模型预训练全面切换至AI Agent商业化落地的关键节点。爱芯计算的诞生,既是爱芯元智七年技术积累的自然延伸,更是一次从“AI芯片供应商”向“AI计算平台赋能者”的战略跃迁。

| 大模型训练卷不动了,推理才是真战场
2026年被业界定义为Token商业化元年。华泰证券研报指出,AI推理算力需求已进入加速增长通道。一个清晰的趋势正在形成:推理算力的增长速度已快于训练算力,AI正加速向云端、边缘侧和端侧全面渗透。
爱芯元智对此有着深刻洞察。公司创始人、董事长仇肖莘博士在宣布爱芯计算成立时表示,这是“面向未来AI时代做出的重要战略决策”。将AI推理业务从母体剥离、以独立主体运营,正是对“推理时代”到来的主动回应。这家2025年营收突破5.6亿元、研发投入占营收比重超过40%的AI芯片公司,选择以更聚焦的姿态迎接算力市场的激烈竞争——英伟达、AMD持续施压,寒武纪、地平线等国内对手亦在推理芯片领域加速布局。

| 都说NPU差不多,通元凭什么敢喊“代差”?
爱芯计算并非平地起楼。它全面承接了母公司自研的“爱芯通元”混合精度NPU的深厚技术积累。这颗NPU采用了独特的“算子指令集+数据流DSA微架构”,将AI程序视为计算图结构,通过硬件层面的高效调度大幅减少数据搬运次数。它支持INT4/INT8混合精度,原生适配CNN、Transformer以及DeepSeek、Qwen、Llama等主流大模型结构。
这种前瞻性的底层架构设计带来了两个核心优势:一是超高的计算效率与极低的物理功耗,在端侧及边缘侧推理上构建起核心技术代差;二是极高的系统易用性与完备的算子支持度,实现主流模型在边端侧“极速转换与一键跑通”。在算力性价比与总拥有成本(TCO)成为推理时代核心竞争维度的当下,爱芯通元的技术路线切中了市场对“高智价比”AI推理算力的迫切需求。

| 纸上谈兵不算数,WAIC上跑通了才算
刚刚收官的WAIC 2026世界人工智能大会,成为爱芯计算技术实力的最佳注脚。爱芯元智在会上首度揭秘了“元曦”系列大算力产品——A系列AI推理卡搭载超1000TOPS推理算力、超大显存与超高显存带宽,补齐了高端边缘大算力市场空白。与已规模化落地的M.2算力卡、标准化核心模组一道,形成了分层全覆盖的边缘算力矩阵。
更具战略意义的是,爱芯元智在WAIC上展示的不仅是硬件——爱芯元曦系列AI推理卡、推理服务器,搭配具身智能大小脑整体方案及配套软件适配体系悉数亮相。这完整验证了公司从自研芯片硬件到上层行业场景交付的全链路算力闭环实力。从智慧工业到智慧教育,从商业办公到智慧零售,从具身智能到民生消费,爱芯元智的AI算力底座已经渗透进物理世界的多元场景。
| 算力卡只是开始,后面还有一盘大棋
爱芯计算将核心聚焦提供领先的AI推理解决方案,通过算力卡等标准化参考方案的完整交付,赋能具身智能、智慧办公、智慧零售、智慧教育、智慧工业等多元物理AI应用场景。仇肖莘博士将新公司的使命概括为“普惠AI,造就美好生活”——专注于AI算力的核心突破,为客户提供极致的AI推理性能和智价比,共同构建一个智能无处不在的物理AI世界。
从2019年创立到2026年登陆港交所成为“中国边缘AI芯片第一股”,爱芯元智用七年时间完成了从创业公司到上市企业的跨越。如今,爱芯计算的独立运营,意味着这家公司正试图用更敏捷的组织形态、更聚焦的战略方向,在AI推理的广阔市场中开辟新的增长曲线。
AI算力的竞争正从“单卡比拼”走向“系统级较量”。爱芯计算的成立,不仅是一家企业的战略选择,更折射出整个AI产业从模型训练走向推理落地的时代转向。当AI开始真正融入物理世界的每一个角落,算力底座的价值将不再以峰值性能衡量,而以能否让每一个场景都用得上、用得起、用得好来定义。爱芯计算能否在这一进程中扮演关键角色,值得持续关注。
是说芯语原创,欢迎关注分享
合作洽谈,进入公众号:服务—>商务合作

