阿里发布并开源千问3，称成本仅需DeepSeek-R1三分之一_阿里巴巴(usbaba)股吧

股吧首页 > 阿里巴巴吧 > 正文

最近访问：

阿里巴巴吧

返回阿里巴巴吧>>

- 重要股东股权质押数据全览

阿里巴巴资讯

发表于 2025-04-29 08:45:10 股吧网页版

阿里发布并开源千问3，称成本仅需DeepSeek-R1三分之一

来源：第一财经作者：陈杨园

　　4月29日凌晨，阿里巴巴宣布推出新一代通义千问模型Qwen3（千问3）并进行开源。阿里云方面表示，千问3是国内首个“混合推理模型”，将“快思考”与“慢思考”集成进同一个模型，参数量仅为DeepSeek-R1的1/3，成本大幅下降，并在ChatBot Arena等榜单中性能全面超越R1、OpenAI-o1等全球顶尖模型，登顶全球最强开源模型。知情人士对记者表示，这是今年上半年阿里云最核心的技术产品发布。

　　具体来看，通义千问官方发布的技术博客显示，千问3采用混合专家（MoE）架构，总参数量235B，激活仅需22B。预训练数据量达36T ，并在后训练阶段多轮强化学习。同时将非思考模式无缝整合到思考模型中，对简单需求可“快思考”，低算力“秒回”答案，对复杂问题可多步骤“深度思考”，两种模式的结合增强了模型实现稳定且高效的“思考预算”控制能力。

　　阿里云方面表示，性能大幅提升的同时，千问3的部署成本大幅下降，仅需4张H20即可部署千问3满血版，显存占用仅为DeepSeek-R1的三分之一。

　　目前，千问3已开源了2款30B、235B的MoE模型，以及0.6B、1.7B、4B、8B、14B、32B等6款密集模型，阿里云透露，千问3的30B参数MoE模型实现了10倍以上的模型性能杠杆提升，仅激活3B就能实现上代Qwen2.5-32B模型性能。所有千问3模型都是混合推理模型，API可按需设置“思考预算”（即预期最大深度思考的tokens数量），灵活满足AI应用和不同场景对性能和成本的多样需求。

　　开源后，用户可在魔搭社区、HuggingFace等平台下载模型并商用，也可以通过阿里云百炼调用千问3的API服务。个人用户可通过通义APP体验千问3，记者了解到，夸克也即将全线接入千问3。

　　未来，千问3将通过优化模型架构和训练方法等提升模型，以实现几个关键目标：扩展数据规模、增加模型大小、延长上下文长度、拓宽模态范围，并利用环境反馈推进强化学习以进行长周期推理。通义千问团队在技术博客中表示，“Qwen3 代表了我们在通往通用人工智能（AGI）和超级人工智能（ASI）旅程中的一个重要里程碑。我们认为，我们正从专注于训练模型的时代过渡到以训练 Agent 为中心的时代。”

（文章来源：第一财经） [点击查看原文]

郑重声明：用户在财富号/股吧/博客等社区发表的所有信息（包括但不限于文字、视频、音频、数据及图表）仅代表个人观点，与本网站立场无关，不对您构成任何投资建议，据此操作风险自担。请勿相信代客理财、免费荐股和炒股培训等宣传内容，远离非法证券活动。请勿添加发言用户的手机号码、公众号、微博、微信及QQ等信息，谨防上当受骗！

评论该主题

帖子不见了！怎么办？

作者：您目前是匿名发表登录 | 5秒注册作者：，欢迎留言退出发表新主题

郑重声明：用户在社区发表的所有资料、言论等仅代表个人观点，与本网站立场无关，不对您构成任何投资建议。用户应基于自己的独立判断，自行决定证券投资并承担相应风险。《东方财富社区管理规定》