阿里千问 Qwen3.8 正式发布:2.4T 参数的基座旗舰,Agent 第一次被推到产品主位

8 月 3 日,阿里巴巴正式发布新一代基座大模型 Qwen3.8,总参数量达到 2.4 万亿。发布当天,Qwen3.8 的 API 已上线千问 AI 平台,并直接接入同一天推出的企业级 Agent 产品“千问办公(QwenWork)”——网页版与独立 PC 客户端率先开放,钉钉 PC 端与手机端内置入口将在近期上线 [1]。

这一次的发布节奏里隐藏着一个比参数更重要的信号:阿里把基座模型和 Agent 产品首次做成了同日发布。同一个工作日,模型上线、Cowork 场景落地、Agent 产品入口全开——这并不是把模型塞进一个聊天框那么简单。

旗舰能力集中在两类工作:Coding 与 Cowork

按照官方口径,Qwen3.8 在 编程(Coding)专业办公(Cowork) 两个方面做了重点强化 [1]。从 7 月 19 日开放的 Qwen3.8-Max-Preview 内部测评看,其面向“全栈开发、数据分析、Office 办公工作流”等多 Agent、长程复杂任务的能力,官方表述为“匹敌世界前沿模型的实力水平” [2]。

这并不是单纯的 C 端写作能力升级——它把目标工作流压到了长程、多步骤、跨工具 这一档,对应的真实场景是开发者在 IDE 里的长任务、企业员工在 Office/数据分析里跑出的多步骤协作。

LMArena 三方榜,阿里排第二,排第一的是 Anthropic Claude

发布当日,LMArena 三方榜单放榜,阿里 Qwen 系列的排名位列 Anthropic Claude 系列之后,居第二 [1]。在 2.4T 总参数规模下,排在闭源的 Claude 系列之后,这一位置对开源/半开源路线来说已经是头部成绩。

需要注意的是,这里的对比锚点是三方榜单的总排名,而不是某个具体的 benchmark 跑分。文章对应到的是 8 月 3 日当日的榜单口径,而不是某一周内的滚动数据。

开源节奏下周落地:Qwen3.8-Max + Qwen3.8-27B

发布通稿明确:Qwen3.8-Max 预计下周开源同时还将开源 Qwen3.8-27B [1]。这意味着对独立开发者和小团队来说,真正能本地化部署、或者在云上微调的版本要再等几天

加上千问 AI 平台已经在跑的 API,可以理解为阿里在同一天铺了三件事:把旗舰模型给到大客户和 Agent 产品、把 API 给到开发者、把“即将开源”的时间点给到社区。三种触点在 24 小时内一起动,节奏比之前几代都密。

为什么“2.4T 参数”这次不是单独卖点

参数堆叠一直是国内基座模型的标配叙事,这次的不同在于它没有像过去那样单独拉出来宣传。在这篇 36氪的发布通稿里 [1],“2.4 万亿参数”只是定语,真正作为分段落核心卖点的是 Coding 与 Cowork 两个场景

这种“从参数规模转向场景能力”的叙事切换,反映出基座模型竞争已经从“谁的总参数大”过渡到“谁能把多 Agent 长程工作流跑通”。如果只看 LMArena 总榜,Qwen3.8 仍在 Anthropic 之后;但配合同日上线的 QwenWork Agent 产品,阿里其实在押一条**“模型 + Agent 入口”一体化**的路。

所以呢:对开发者意味着什么?

短期来看,做选择的不是模型大小,而是接入路径

  • 想用 Qwen 3.8 的 API:今天就能在千问 AI 平台上跑;
  • 想做企业 Agent 集成:盯“千问办公”开放节奏——网页/PC 客户端现已上线,钉钉入口近期落地;
  • 想本地化或者私有云:等下周开源的 Qwen3.8-Max 和 Qwen3.8-27B,这是真正能跑微调和部署的版本。

如果 Qwen3.8-Max 在开源后的复现跑分基本对齐官方口径,加上同源的 QwenWork Agent 入口,这一代 Qwen 走出来的不是“又一个大模型”,而是**“把大模型 + Agent 产品 + 开源分叉”三条线在一个工作日打通**的组合拳。


引用

[1] 36氪:阿里巴巴正式发布新一代基座大模型 Qwen3.8,总参数量 2.4 万亿 — https://36kr.com/newsflashes/3923193948614025

[2] IT之家:阿里千问 Qwen3.8 预览版模型上线:2.4T 参数量,宣称“可能是除了 Fable 5 外最强大的模型” — https://www.ithome.com/0/978/730.htm