🚀 2026.08.03 正式发布 · Qwen 家族迄今最强旗舰

Qwen3.8-Max

2.4 万亿参数 稀疏 MoE · 100 万 Token 上下文 · 文本 / 图像 / 视频多模态
为长周期自主任务而生:从一个空文件夹,到完整交付。

总参数 2.4T 激活 95B 上下文 1M 最大输出 131K 推理 262K OSWorld 86.1 分 · 全球第一梯队 $2 / $6 每百万 Token
向下滚动探索
Specifications

一组数字,看懂 3.8-Max

基于 Qwen3.5 架构,通过稀疏 MoE 与混合注意力机制联合优化,首次把千问系列推进到 2.4T 参数级别。

0
总参数量
稀疏混合专家(MoE)架构
0
激活参数
每次推理仅启动约 4%
0
上下文窗口
原生支持 1,000,000 tokens
0
最大输出
较上代翻倍(输入上限 991K)
0
推理 Token 上限
独立的长思考预算
0
PaperBench 得分
科研复现评测新高,较上代 +28.2
0
OSWorld-Verified
智能体电脑操作 · 主流模型首位
0
连续自主编程
零人工干预完成真实项目交付
Architecture

稀疏 MoE:2.4T 的体量,95B 的身段

每次推理,路由器只唤醒最合适的少数专家。点击下面的任务类型,看看「专家路由」是如何工作的。

🧠 专家路由模拟器

选择一个任务,观察 Router 激活哪些专家(示意动画)。
Router 混合注意力
稀疏激活,推理更快

总参数 2.4T,单次推理仅激活 95B,相比同规模稠密模型大幅降低计算成本与延迟。

🔀混合注意力机制

与稀疏 MoE 联合优化,兼顾超长上下文的召回能力与生成效率,原生吃下 1M tokens

🖼️多模态基座

文本、图像、视频输入,文本输出。读得懂 200 页财报 PDF,也看得完 100 小时长视频。

🖥️真武 M890 超节点适配

芯片 × 云平台 × 模型全链路优化,Agentic 推理场景最高 1.5 倍性能提升。

🔌完整 API 能力

Function calling、结构化输出、上下文缓存、前缀续写;兼容 OpenAI / Anthropic 双协议接入。

Benchmarks

与全球第一梯队掰手腕

切换类别查看官方基准对比。绿色高亮为 Qwen3.8-Max。

* 数据来源:阿里巴巴 2026-08-03 官方发布自测表及公开报道;Text Arena 全球第五、Vision Arena 全球第二、CodeArena 全球第四。第三方独立评测仍在进行中。

Real-world Feats

不是跑分,是真干活

官方展示的四个长周期实战案例——把鼠标悬停在卡片上试试。

💻

16 天自主编程

从空文件夹出发,自主构建自进化智能体框架「oh-my-cli」:自己领 issue、写代码、跑测试、迭代优化,全程零人工干预,项目已完全开源。

265 commits · 127 PRs · 151 issues
🔬

复现并超越论文

约 125 小时连续工作、7,600 行代码、33 次 GPU 训练:先复现论文全部 6 项主要结论,再自主提出 18 项改进,AIME24 较原方法 +2.7 分。

PaperBench 93.0(全球最高)
🛒

模拟经营 365 天

E-Commerce Bench:用 10 万元启动资金独立经营电商一年,覆盖选品、议价、库存、定价与退货全流程。

期末现金 ¥41.6 万 · 领先第二名 38%
👁️

视觉驱动的创造

从 UI 截图重建完整前端项目、2D 平面图转 3D 室内效果图、素材自动剪辑成 Vlog、按需求直接做出可玩的小游戏——边做边看,发现错位自己改。

Vision Arena 全球第二

⏱️ 那 16 天里发生了什么

DAY 0

一句指令,一个空文件夹

任务:「创建一个自进化的智能体 Harness」。没有脚手架、没有模板,模型开始自主规划。

DAY 1-3

搭建循环工程框架

自主设计 Loop Engineering 架构,编排智能体自动领取和执行任务,建立「生成 → 测试 → 预览 → 日志分析」的闭环。

DAY 4-12

自我进化,持续交付

把用户需求转成 GitHub issue、自己认领、写代码、跑测试、提 PR。人类工程师只需通过钉钉提新需求。

DAY 16

oh-my-cli 诞生并开源

产出 Hermes Agent 级别的可用自进化智能体框架,完整过程公开在 GitHub 仓库,任何人可复查全部 265 次提交。

Interactive Demo

和「3.8-Max」聊两句

模拟演示(本地离线运行),点击右侧问题或直接输入试试。

💡 试试问我:

qwen3.8-max · session #2026
Qwen3.8-Max你好!我是 Qwen3.8-Max,2.4T 参数、1M 上下文。想聊点什么?👇
Pricing

旗舰能力,更友好的价格

拖动滑块估算成本。按官方定价:输入 $2 / 输出 $6(每百万 Token),比上代还便宜 20%。

Qwen3.8-Max$2.0 输入 / $6.0 输出
$22.0
Claude Opus 5约 $30 / 百万 tokens(合计口径)
$—
GPT-5.6 Sol约 $35 / 百万 tokens(合计口径)
$—
💸 相比 Claude Opus 5 节省约 73%
海外 API(QwenCloud)模型 ID:qwen3.8-max,已兼容 OpenAI / Anthropic 协议
$2 / $6 per M tokens
国内 API(百炼)命中隐式缓存时输入低至 ¥1.5 / M
¥12 / ¥36 per M tokens
缓存读取(隐式)长上下文重复调用场景大幅降本
$0.25 per M tokens
速率上限2M tokens/分钟 · 15K 请求/分钟
高并发 ready
体验渠道千问 App · 千问办公 · Qoder / QoderWork · TokenPlan
今日可用 ✨
FAQ

常见问题

官方于 2026-08-03 宣布权重将于「下周」放出(Max 级别模型首次开放权重),同批开源 Qwen3.8-27B。截至发布时具体 License 与确切日期尚未公布。
总计 1M tokens:最大输入 991K、最大输出 131K(较上代翻倍),另有独立的 262K 推理 token 预算用于长思考。
支持文本、图像、视频输入,文本输出。可处理 200+ 页 PDF 财报、100+ 小时视频,并将其转化为可检索、可交互的知识结构。
科研复现 PaperBench +28.2 分(93.0)、指令遵循 IFBench 82.8、Terminal Bench 74.5→86.6;最大输出从 64K 翻倍到 131K,且价格更便宜约 20%
QwenCloud / 百炼 API 已上线,第三方网关已上架 bailian/qwen3.8-max,兼容 OpenAI 与 Anthropic 双协议——可直接塞进 Claude Code 等 Agent 工具链。
第三方 Arena:Text 全球第五、Vision 全球第二、CodeArena 全球第四,仅次于 Claude 系列,处于全球第一梯队(截至 2026-08-03 放榜)。