股吧首页 > 高通吧 > 正文
  • 最近访问:
发表于 2026-09-23 14:25:00 股吧网页版
手机本地跑通300亿参数大模型 移动芯片进入AI能力竞争时代
来源:每日经济新闻

  美国当地时间9月22日,高通在“2026骁龙峰会”上推出第六代骁龙8超级至尊版和第六代骁龙8至尊版两款旗舰移动平台,两款芯片均采用2nm制程工艺,并打破长期以来仅推出一颗高端旗舰SoC的惯例。小米、vivo、OPPO、荣耀等厂商均出现在首批采用名单中。

  就在一周前,联发科发布的天玑9600 Pro同样采用2nm制程。随着全球两大主要安卓手机SoC厂商相继推出2nm旗舰产品,旗舰移动芯片的制程竞赛正式从3nm迈入2nm 阶段。

  不过,相比强调性能的提升,今年高通明显把更多篇幅留给了Agentic AI(智能体AI)。高通公司总裁兼CEO(首席执行官)安蒙在主题演讲中强调:“智能体时代已经到来。推理成为关键,边缘侧将发挥重要作用。”按照高通对下一阶段AI终端的判断,AI正在从响应用户指令的工具,进一步变成能够理解上下文、拆解任务,并在获得授权后执行操作的智能体。

  为了推动更加复杂的智能体AI落地手机,高通此次联合阶跃星辰、无量火和江波龙,基于第六代骁龙8超级至尊版,将一款300亿参数的MoE模型部署至手机端。值得注意的是,目前能够在手机本地运行的大模型更多集中在数十亿参数量级,而参数更大的模型则可以为更复杂的手机智能体提供底层能力。

  可以看到,当手机开始承担越来越复杂的AI推理和智能体任务,移动芯片的新一轮竞争正在从“手机性能有多高”,转向“手机本地能够运行多大的AI,以及AI究竟能替用户完成多少事情”。

  过去几代旗舰手机芯片的升级重点,是让手机“算得更快”,一颗旗舰手机SoC将多个功能模块集成在单一芯片上,比如CPU影响应用启动和系统响应速度,GPU主要承担图形和游戏计算,ISP负责影像处理,NPU则主要承担AI计算。每一代旗舰芯片的竞争,也往往围绕这些模块各自提升了多少展开。

  但Agent的出现正在模糊这些边界。一个能够真正替用户办事的AI,并不是在NPU上完成一次模型推理就结束了。以规划一次出差为例,智能体可能需要先读取邮件中的时间和地点,理解用户的行程需求,再调用航班、酒店、地图和日历等服务,持续完成多个步骤;在这一过程中,还可能需要调用用户的个人知识和历史信息,并保存上下文。

  这意味着,AI从过去相对单一的问答、修图、摘要等任务,进一步走向连续执行任务后,所需要的不只是更高的NPU算力,而是CPU、GPU、NPU、内存、存储之间更高效的协同。

  “我们刚刚进入智能体时代的开端,智能体需要全新的系统架构,而骁龙正是为这个时代打造的平台。”安蒙在此次峰会上说道。事实上,随着AI承担的任务越来越复杂,手机芯片内部不同计算单元的分工也将随之变化。

  围绕智能体的工作方式,此次高通重新设计了手机的芯片。比如,CPU搭载高通定制Oryon CPU内核,采用8核架构,主频最高达到5GHz,这是业界首个主频突破5GHz的移动CPU;高主频之外,高通还在GPU中加入AI专用核心并配备独立高速缓存,在NPU中增加Transformer加速器并扩容内存,优化传感器中枢里的低功耗感知能力等,使得新骁龙双旗舰芯片可以让手机在有限的功耗内完成更复杂的连续智能任务。

  除此之外,高通为数据中心AI推理设计的HBC(高带宽计算)技术未来也计划应用于骁龙平台。HBC的核心思路之一,是通过3D堆叠让计算单元与内存更加靠近,以降低AI计算过程中数据搬运带来的性能和能耗损失。

  当CPU、GPU和NPU开始围绕Agent协同工作,另一个备受关注的问题是,手机本地究竟能够运行多大的模型?

  过去几年,这个问题的答案一直受手机内存和功耗的严格限制。相比拥有数百GB甚至TB级显存的云端服务器,智能手机通常只有十几GB的运行内存,其中还需要为操作系统和大量应用留出空间。因此,即使芯片AI算力不断提升,把几十B参数的大模型搬到手机本地运行,过去仍面临较高门槛。

  vivo副总裁、OS领域副总裁周围日前在接受包括记者在内的媒体采访时回忆,直到去年,行业对于端侧大模型落地规模的判断仍相对谨慎。

  “去年我们觉得手机上跑3B、7B(Billion,代表十亿)的模型,对于内存来说都很吃力。”周围表示,变化出现在今年初。

  据周围介绍:“随着MoE(混合专家)等稀疏模型架构的发展,大模型每一次运行不一定需要调用全部参数,即不用一次加载完,可以每次只加载一个或者几个专家模型。”

  这成为300亿参数模型开始走向手机端的关键。传统Dense(稠密)模型在推理过程中需要调用整个模型,而MoE模型内部可以包含多个针对不同任务训练的“专家”。面对具体任务时,系统只选择其中部分专家参与计算。因此,即使模型拥有300亿总参数,单次推理真正参与计算的参数量也可以远低于300亿,从而降低对计算资源和内存带宽的需求。

  高通此次联合阶跃星辰、无量火和江波龙部署的StepEdge-Omni 30B-MoE也采用了该技术路线。其中,无量火通过CPU、GPU和NPU异构调度,使该模型运行内存需求相比常规方案下降超过50%;江波龙则通过端侧存储方案,让模型权重从闪存加载,并通过存储与计算协同减少模型对运行内存的持续占用。

  随着Agent需要处理更复杂的任务,它需要理解更长的上下文,拥有更丰富的知识,并具备更强的推理、规划和工具调用能力。更大的模型容量,为这些复杂智能体能力提供了更大的空间。据高通现场展示,300亿参数模型能够实现从邮件中读取信息,随后完成行程规划、日历同步、航班和酒店推荐,并最终生成邮件草稿的功能,并且整个过程均在本地完成,无需云端调用。

  从高通此次发布的两颗芯片,以及300亿MoE模型在手机上的运行来看,移动芯片已经在为下一阶段的AI手机重新搭建底座。

郑重声明:用户在财富号/股吧/博客等社区发表的所有信息(包括但不限于文字、视频、音频、数据及图表)仅代表个人观点,与本网站立场无关,不对您构成任何投资建议,据此操作风险自担。请勿相信代客理财、免费荐股和炒股培训等宣传内容,远离非法证券活动。请勿添加发言用户的手机号码、公众号、微博、微信及QQ等信息,谨防上当受骗!
作者:您目前是匿名发表   登录 | 5秒注册 作者:,欢迎留言 退出发表新主题
温馨提示: 1.根据《证券法》规定,禁止编造、传播虚假信息或者误导性信息,扰乱证券市场;2.用户在本社区发表的所有资料、言论等仅代表个人观点,与本网站立场无关,不对您构成任何投资建议。用户应基于自己的独立判断,自行决定证券投资并承担相应风险。《东方财富社区管理规定》

扫一扫下载APP

扫一扫下载APP
信息网络传播视听节目许可证:0908328号 经营证券期货业务许可证编号:913101046312860336 违法和不良信息举报:021-34289898 举报邮箱:jubao@eastmoney.com
沪ICP证:沪B2-20070217 网站备案号:沪ICP备05006054号-11 沪公网安备 31010402000120号 版权所有:东方财富网 意见与建议:021-54509966/952500