8月3日,阿里巴巴正式推出新一代基座大模型Qwen3.8,总参数量达到2.4万亿,成为千问系列迄今规模最大的旗舰模型。在当天放榜的权威三方榜单Arena中,阿里Qwen模型综合表现仅次于Anthropic的Claude系列,整体性能稳居全球大模型第一梯队。
此次发布的旗舰版本Qwen3.8-Max采用稀疏MoE架构与混合注意力机制的联合优化方案,在总参数2.4T的体量下仅激活950亿参数,兼顾了推理效率与运算速度。模型支持视觉理解能力,上下文窗口长度达到100万Tokens,为长文档处理和复杂任务提供了充裕的上下文空间。
编程能力是Qwen3.8最突出的突破方向。官方演示显示,该模型可以从一个空文件夹出发,自主完成一个需要十数天工期的真实项目并交付成果,全程无需人工干预。在一次测试中,Qwen3.8-Max仅凭一句指令就独立编程约16天,构建出真实可用的自进化智能体框架。在权威CodeArena排行榜上,Qwen3.8位居全球第四。

在专业办公场景中,Qwen3.8通过真实环境和算力的联合强化学习扩展,实现了数百种高价值、高频专业任务的生产级交付。它能将法务团队约一周的合同审阅量压缩到一小时内完成,也能凭一句话规划出复杂的动态量化策略工作流。这种将复杂专业任务自动化的能力,标志着AI从辅助工具向独立执行者的角色转变。
长程任务处理方面,Qwen3.8涌现出系统级自主规划与全栈闭环自适应学习能力。面对精密的数字芯片设计或瞬息万变的商业模拟运营,模型能在执行—反馈—迭代的闭环中经历数千轮超长交互,持续重构算法与策略,而不会出现中途偏差累积的问题。

多模态能力同样亮眼。Qwen3.8-Max能跨页理解200页财报,将100小时长视频组织成可检索的图谱记忆。在视觉推理BabyVision评测中取得82.0分,超出部分主流模型近两倍。在评估智能体电脑操作能力的OSWorld-Verified评测中以86.1分位居首位。在Vision Arena榜单中排名全球第二。
定价方面,Qwen3.8 API已上线千问AI平台,国内每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元,国际价格仅为竞品Opus5的40%与24%。阿里同步推出了企业级Agent产品千问办公,由QoderWork、MuleRun、悟空三款产品整合而成,是业内首款同时支持桌面端Agent、云端Agent和企业协同Agent的产品。

按照官方计划,Qwen3.8-Max模型权重将于下周开源,同步开源的还有Qwen3.8-27B版本。消息发布后,阿里巴巴港股早盘持续拉升,涨幅一度超过6%,市场对这个国产旗舰大模型的表现给出了积极反馈。






