阿里发布千问3.8大模型:2.4万亿参数跻身全球第一梯队

作者: CBISMB

责任编辑: 邹大斌

来源: CBISMB

时间: 2026-08-04 10:50

关键字: 大模型 阿里巴巴 千问3.8 Qwen3.8 MoE架构

浏览: 0

点赞: 0

收藏: 0

8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8(千问3.8),总参数量达2.4万亿,为千问系列尺寸最大、性能最强的旗舰模型。在权威第三方榜单Arena中,Qwen3.8仅次于Anthropic的Claude系列,整体性能稳居全球大模型第一梯队。受此消息提振,阿里巴巴港股当日上涨7.01%,报收125.2港元。

编程能力实现范式级突破

Qwen3.8在编程(Coding)和专业办公(Cowork)两大核心维度实现关键突破。在CodeArena榜单中,Qwen3.8位居全球第四,超越多数国际旗舰模型。更值得关注的是,Qwen3.8实现了从"写函数补代码"到"从零交付完整项目"的质变。在一次真实演示中,仅需一句"创建一个自进化的智能体Harness"指令,Qwen3.8从空文件夹出发,自主搭建循环工程框架,编排智能体自动领取和执行任务,连续运行约16天后独立交付了一个可用的自进化智能体框架项目,全程无需人工干预。开发过程代码已开源至GitHub。

稀疏MoE架构与超长上下文

Qwen3.8采用稀疏MoE(混合专家)架构,总参数量2.4万亿,单次激活参数仅95B——相当于拥有2400名员工的超级工厂精准调度95名骨干,实现推理效率与模型容量的最优平衡。模型支持1M Tokens超长上下文,可完整读取200页财报PDF或分析超100小时视频内容。

技术评测方面,Qwen3.8在科学推理GPQA Diamond评测中取得92.6分,指令遵循IFBench评测82.8分,视觉推理BabyVision无工具条件下82.0分(超出部分主流模型近两倍),OSWorld-Verified智能体电脑操作能力评测以86.1分位居主流模型首位。

此外,阿里巴巴真武M890超节点已成功适配Qwen3.8,通过芯片、云平台与千问大模型的全链路优化,在Agentic推理场景中最多实现1.5倍性能提升。

千问办公同步公测

Qwen3.8的API已上线千问AI平台,国内定价为每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元。国际定价分别为Anthropic Opus5的40%和24%,实现相近智能水平下更高性价比。

同日,阿里巴巴推出企业级Agent产品"千问办公"(QwenWork)开启公测。该产品由QoderWork、MuleRun、悟空三款产品整合而来,是业内首款同时支持桌面端Agent、云端Agent和企业协同Agent的产品,已初步打通钉钉IM。典型场景包括:律所资深律师完成并购尽调报告后可将全过程一键沉淀为"组织级Skill"向全团队共享;篮球数据分析团队利用Qwen3.8在数十分钟内精准拆解160小时比赛录像中的8400多个攻防回合,一次性输出球员战术画像和教练报告。

千问系列累计下载量已超过10亿次,在全球最大AI开源社区HuggingFace排名榜首。阿里巴巴预计下周开源Qwen3.8-Max和Qwen3.8-27B,进一步扩大开源生态。花旗重申对阿里巴巴买入评级,目标价192美元,认为近期股价强势反映了云业务收入增长预期和千问3.8-Max基准分率的显著提升。

©本站发布的所有内容,包括但不限于文字、图片、音频、视频、图表、标志、标识、广告、商标、商号、域名、软件、程序等,除特别标明外,均来源于网络或用户投稿,版权归原作者或原出处所有。我们致力于保护原作者版权,若涉及版权问题,请及时联系我们进行处理。