9月22日,阿里旗下平头哥发布新一代AI芯片真武V900,计划于2027年第一季度量产售卖,较此前预期的2027年第三季度提前两个季度。
“Agentic(智能体)时代的算力需求爆发比所有人预想的都要快,我们的交付节奏也要跟着需求一起提速。”阿里平头哥半导体副总裁高慧在当日的云栖大会上表示,“客户等不起,我们也不能等。”
官方参数显示,相较于今年2月发布的上一代真武M890芯片,真武V900的单芯片算力性能提升3倍。阿里方面未给出真武V900的具体计算能力参数。该芯片搭载216GB大容量显存,片间互联带宽达1200GB/s,原生支持FP8(8位浮点数)和FP4低精度计算。
阿里将真武V900视为“目前算力性能最强的中国自研AI芯片”,称其可满足万亿级模型的训练与推理需求。这凸显出国产AI芯片的竞争加剧。此前,华为昇腾长期被视为国产AI芯片性能上的头号玩家。华为新一代昇腾960 DT芯片的研发也快于预期,预计提前三个季度,同样于2027年第一季度准备就绪。
从过往的出货量来看,华为和阿里在国产AI芯片阵营中位居前二。市场调研机构IDC于4月发布的一份报告显示,在2025年中国云端AI加速器市场的国产公司中,华为以81.2万张卡的出货量位居首位,市场份额约49.2%;阿里平头哥出货26.5万张卡,跃居次席,份额16%。
另据阿里官方的数据,截至2026年4月,平头哥AI芯片已累计出货56万片;截至2026年6月,客户有650余家,覆盖智驾、金融、大模型、具身智能、能源、制造等行业。
阿里巴巴集团CEO吴泳铭在2026云栖大会上表示,由于平头哥芯片产品线的成熟和客户的广泛应用,预计未来数年平头哥AI芯片的年出货量将大幅提升。
随着AI芯片的竞争已从单芯片延伸至超节点和大规模集群,阿里同样推出和升级相关产品应对竞争。
2026云栖大会上,阿里发布全新升级的超节点服务器,内置真武V900、ICN Switch互联芯片、磐脉智能网卡及镇岳SSD存储主控芯片,单一集群可扩展至50万卡规模。这款名为“磐久”的超节点服务器将于2027年第一季度上市。
据阿里介绍,真武V900芯片通过自研ICN Switch互联芯片连接后的超节点,具备原生内存语义和内存统一编址能力,可实现千卡全带宽高速互联。内存统一编址是超节点的一项核心技术特征,这一设计旨在打破硬件孤岛,让所有GPU共享同一地址空间。跨GPU数据同步通过地址即可直接读写,是解决“多GPU协同效率”与“数据一致性”的关键。
智能体应用需求在今年的持续爆发,也让一度被AI芯片排挤到边缘的CPU逐渐重回舞台核心。高慧形容,CPU以前充当配角,负责打杂,而智能体让CPU从配角重新回到了关键路径。
阿里方面介绍,智能体产品的任务规划、状态管理、工具调用等环节极其依赖CPU,同时海量数据的预处理、编排与吞吐也需要CPU完成。因此,智能体不仅需要高AI算力支撑,还需要单核性能强、内存带宽高,并与GPU紧耦合的CPU,以提升智能体的运行效率。
据高慧判断,智能体时代的CPU将不再由“一颗CPU打天下”,而是分化成两条产品线,对应两种截然不同的需求——
一种是延迟敏感型服务,用于AI head node(AI服务器中的机头CPU),承担请求预处理、KV Cache(一种缓存机制)管理、GPU内核调度、结果后处理等任务环节。“在GPU推理的前后,GPU等着CPU给数据,CPU等着GPU出结果。每一微秒都直接影响用户的体感,所以需要的是单核够快、内存带宽够宽、和GPU之间的路径够短。”
另一种是吞吐并发型的CPU,服务于Agentic Rack(部署在AI加速器机架旁的独立CPU服务器机架),承担工具调用、代码沙箱执行、多智能体编排等工作。“这些环节不是一个Agent在跑,是几百、几千个Agent同时在跑,所以需要的是核够多、内存容量够大、(沙箱)隔离够严。”
“一个追求快,一个追求多,这是Agentic时代CPU两种截然不同的使命。”高慧表示,如果试图用一颗芯片同时满足这两类需求,“要么快不够快,要么多不够多”。
为此,阿里平头哥规划了倚天服务器CPU的迭代路线。在现有的倚天710芯片之后,计划于2027年第三季度推出倚天720和倚天730两款CPU产品。其中,前者面向吞吐并发型场景;后者的单核性能跑分最高可达倚天710的1.4倍,面向延迟敏感型场景。
高慧透露,从倚天720芯片开始,磐久超节点也会部署这款自研CPU,从而实现超节点产品内核心芯片的全自研。