国产GPU,跑出一匹黑马。
8月底,曦望完成20亿元新一轮融资,投后估值飙升至200亿元。
这家杭州芯片企业,4月刚完成超10亿元融资,跻身百亿估值阵营。不到半年,估值翻倍。
曦望不是“新手”,而是脱胎于商汤科技芯片部门的企业,由其联合创始人徐冰领衔。
国产芯片牌桌上,多数玩家主打通用型技术路线。曦望选择走一条更垂直的路:all-in推理,目标是百万Token只需一分钱。
“训练市场是头部玩家的游戏,门槛越来越高。推理是百花齐放的,需求看不到天花板。”徐冰曾在接受21记者采访时提到。
三人搭档
曦望快速起势背后,徐冰是关键推手。
接手该企业前,他主要负责商汤投融资工作,曾带领团队完成数次大额融资。
入局曦望,无异于二次创业。
“如果继续在商汤,就是挑简单的事去做的状态。”徐冰解释,人机共生的状态即将出现,如果不冲在最前面,解决最难的问题,就是在躺平。
曦望原本是商汤的AI芯片预研项目,2020年以“上海阵量智能”之名成立,作为商汤全资子公司,专做芯片。
其相继推出启望S1、S2,并量产落地,但作为内部项目,其潜力始终无法释放。
为此,徐冰亲自挂帅搭建班底,力邀王勇、王湛加盟,并委以联席CEO之职。
王勇拥有20余年芯片研发经验,曾任AMD GPU首席架构师、百度昆仑芯高级研发工程师;王湛为百度创始团队成员、百度搜索“凤巢”系统的总设计师。
二人加入曦望后,一个主导研发和量产,一个建立商业化体系,与徐冰组成“铁三角”,投身国产GPU大潮。
2024年底,曦望分拆独立,融资提速。一年内,其完成了近30亿元战略融资,加上2026年两次融资,迄今融资额近60亿元。
2025年,曦望AI芯片交付已突破1万片。按这一交付规模,曦望已跻身国产GPU第一梯队。
同期,徐冰卸任商汤执行董事、董事会秘书职务。
其现有团队约400人,研发人员占比超过80%,核心技术骨干平均拥有15年行业经验。
天眼查显示,曦望目前有65位股东,其中商汤为最大单一股东,持股12.43%。
打下价格
资本押注的,是曦望的技术。
创立之初,徐冰决定,放弃走主流训推一体的路,all-in推理。
这既是差异化竞争策略,也是需求使然。
徐冰判断,AI产业正由训练驱动全面转向推理主导:“当Token变成可计价的商品,推理GPU就是在为这个商品降低成本。”
与训练阶段的一次性投入不同,推理是持续性、高频次的算力消耗过程,每一次模型调用都在生成和消耗Token,需求庞大。
“过去一年,推理的Token增长了100倍。随着最近AI Agent等进一步普及,推理Token仍会以几十倍的速度成长。”年初,王勇公开表示。
初创期,曦望在all-in推理这条路上走得不够“绝”。
彼时已量产的两代GPU,启望S1和S2,定位推理,骨子里却是训推一体的设计逻辑。
团队发现,S2在实验室里对标顶级GPU企业的产品,训推一体表现亮眼;到了客户真实的业务环境中,几乎全被用来跑推理场景。
这让团队决心做“减法”。
2026年初,启望S3发布,摒弃训练相关的技术组件,放弃昂贵、超高带宽的HBM,选择成本更低、容量更大的LPDDR6内存。以往这种内存常用于手机、笔记本电脑。
“在Agent系统里,内存不只是显卡的一个配置参数,它是数字员工的工位。”徐冰解释,“工位越大,一台机器养得起的Agent越多,每个Agent记得住的事越久。”
启望S3采用大容量LPDDR内存,实现了更低的真实任务成本。单卡成本预计在2~4万元之间,推理性能较上一代S2提升5倍,Token成本下降90%。
徐冰的目标,是将推理成本降至百万Token一分钱,“让AI像水电一样成为普惠基础设施”。
据炜烨智算测算,曦望每百万Token价格约0.57元,低于行业7~14元的平均水平。
徐冰团队也已付出高昂成本:八年累计研发投入达20亿元,至今尚未盈利。根据商汤财报,曦望的前身上海阵量,2024年净亏损1.9亿元。
冲刺百亿
技术再好,也要市场买单。启望S3的量产和商业化落地,是徐冰团队接下来的重任。
第一代S1推理芯片于2020年量产,实现上万片交付及场景落地;S2已向金融、工业等领域规模化交付。
请核实2024年营收的具体数据,修正为准确金额(如“2400万元”或“2.4亿元”等)
鉴于上年的低基数,增长本在预期内,曦望更需在长周期中经得起审视。
“S1、S2证明了三件事:我们能做出来……从S3开始,我们要和整个产业一起,把中国的推理成本彻底拉到‘百万Token一分钱’的新级别。”徐冰称。
未来两年,曦望将推出两款产品:启望S4推理GPU、启望S5-GPU芯片。
王勇公开称:“百万Token一分钱”目标,将在S3至S5迭代中逐步达成,并力争取得百亿元级收入。
“国产GPU四小龙”中,规模最大的摩尔线程,2026年全年收入预计在40亿元左右。
曦望的百亿元目标,达成不易。
徐冰的野心,不只是卖芯片,更是要整体布局“芯片+系统+生态”。
他计划,给产业提供推理GPU卡、一体化的服务器、整机、集群方案,让大家少走弯路;与AI巨头、算力厂商和芯片厂商合作,实现算力系统的推理分流,并成为成本优化层。
此前,曦望打造了产品矩阵,包括智望系列加速卡及模组、辰望系列服务器。
商业化的核心主力,是启望S3。曦望已拿下数个客户订单,并与浙江大学、三一集团、协鑫科技等签约。
签约易,批量交付难,尚未盈利更添紧迫感。未来,曦望需要在更多客户场景中,跑通商业化流程。