2026年8月3日,阿里正式发布新一代基座大模型 Qwen3.8-Max,总参数量 2.4 万亿——这是千问系列迄今尺寸最大、性能最强的旗舰模型,也是 Qwen-Max 级别模型首次对外开源权重。
发布会前后最出圈的一个案例:Qwen3.8-Max 无人干预自主编程 16 天,跑完 430 个 commits、211 个 PR、62 个 issues,交付了一个叫 oh-my-cli 的自进化智能体系统。
这篇文章把它的硬参数、榜单成绩、API 价格和三种上手方式讲透,最后告诉你它适合谁,跟 DeepSeek、GPT-5.6、Kimi K3 怎么选。
太长不看版
| 维度 | 结论 |
|---|---|
| 定位 | 阿里千问旗舰基座大模型,代码 + Agent 能力为核心卖点 |
| 发布时间 | 2026年7月19日预览,8月3日正式发布 |
| 参数规模 | 总参数 2.4T,稀疏 MoE 架构,单次激活约 950 亿参数 |
| 上下文窗口 | 100 万 token,原生多模态视觉 |
| 最大亮点 | Max 级旗舰首次开源权重;自主编程 16 天交付完整项目 |
| 榜单成绩 | Arena 整体仅次于 Claude 系列;PaperBench 得分 93.0,多项 Agent 基准超过 GPT-5.6 Sol 与 Claude Fable 5 |
| API 价格 | 国内输入 ¥12 / 输出 ¥36 / 百万 tokens;海外 $2 / $6 |
| 上手方式 | Qwen Studio 网页(免费)、Qoder CLI、OpenAI 兼容 API、千问办公 |
| 适合谁 | 程序员、Agent 开发者、想白嫖开源旗舰的企业 |
一、背景:千问 Max 级模型第一次开源
先交代一下 Qwen3.8-Max 在千问家族里的位置。它的上一代 Qwen3.7-Max 是 5 月 18 日发布的,当时还是闭源旗舰——API 能用,权重不给。再往前的 Qwen3.5、Qwen3.6 走的是另一条线:开放权重,但尺寸小一个量级。
这次 Qwen3.8-Max 把两条线合到一起了:最强旗舰 + 开放权重。官方承诺发布后约一周内,权重在 Hugging Face 和 ModelScope 双平台放出,Qwen3.8-27B 同步开源。对开发者来说,这意味着 2.4T 参数量级的”开源天花板”第一次不再是闭源的。
时间线也值得注意:7 月 19 日 preview 上线,8 月 3 日正式版发布,期间模型几乎日更迭代。也就是说你现在能用到的正式版,已经不是发布当天的版本——是跑完无数轮修 bug 之后的稳定版。8 月 3 日同期,千问办公(阿里企业级 Agent 产品)开启公测,Qwen3.8-Max 直接作为基座能力接入。
二、硬参数:2.4T 不是纸面数字
总参数 2.4 万亿,乍一看吓人,但真正决定体验的是两个数:激活参数和上下文。
- 稀疏 MoE + 混合注意力架构:2.4T 是总参数,每个 token 实际激活约 950 亿参数(约 3.9%)。这是它能”又大又快”的原因——推理成本相当于 950 亿参数的稠密模型,而不是 2.4 万亿。
- 100 万 token 上下文:长程任务设计。跨数百次工具调用维持连贯计划,不丢早期关键信息——这是 Agent 场景的刚需。
- 原生多模态视觉:能看图、读图表、理解截图,不用外挂视觉模型。
参数大不代表能打,这个道理这两年大家看明白了。但 2.4T + 95B 激活的搭配,配合后面说的榜单成绩,说明这次参数是实打实堆在能力上的。
三、最出圈的案例:自主编程 16 天
官方放出来的演示,是 Qwen3.8-Max 自主编程 16 天:没有人盯着、没有人干预,自己跑完 430 个 commits、211 个 PR、62 个 issues,交付了一个叫 oh-my-cli 的自进化智能体系统。
这个案例的含金量不在”写代码”,在于长程任务维持:16 天、几百次工具调用、跨天连续工作,模型要一直记得项目整体状态,不能做着做着忘了最初目标。这正是 100 万 token 上下文的用武之地。
国内媒体 8 月 4 日的实测也验证了这点:用 Qoder(阿里自己的 AI 编程 CLI,对标 Claude Code)从空目录开始做一个小游戏,从开 Session 到完整交付十分钟,一次跑通、无人工干预。对普通开发者来说,这个”十分钟从空目录到能玩的项目”比 16 天的大案例更有参考价值——日常开发里的活儿,大部分是这种规模。
四、榜单成绩:全球第一梯队
8 月 3 日同期放榜的 Arena 数据里,Qwen 模型整体仅次于 Anthropic 的 Claude 系列,处于全球大模型第一梯队。
单项上更亮眼的是智能体(Agentic)和研究基准:
| 基准 | Qwen3.8-Max 表现 |
|---|---|
| PaperBench | 93.0 分,前沿级 |
| 多项 Agent 基准 | 超过 GPT-5.6 Sol 与 Claude Fable 5 |
| Arena 综合 | 仅次于 Claude 系列 |
翻译成人话:通用对话它是一梯队,Agent 干活它可能是当前开源阵营里最能打的之一。加上权重开放,这是”前沿级能力 + 开放权重”的组合,过去基本是二选一。
五、价格:国产旗舰里的”价格侠”
Qwen3.8-Max 的 API 定价,官方放出来后被认为相当能打:
| 计费项 | 国内价格(每百万 tokens) | 海外价格 |
|---|---|---|
| 输入 | ¥12 | $2 |
| 输出 | ¥36 | $6 |
| 隐式缓存命中 | ¥1.5 | $0.25 |
对比一下:海外输入价格是 Claude Opus 5 的 40%,输出是它的 24%。同期 OpenAI 把 GPT-5.6 Luna 输出价从 $6 砍到 $1.2(降 80%),DeepSeek 则宣布计划上调 API 价格并引入峰谷定价。市场在分化——海外往下压,国内头部在往回收。这个背景下,Qwen3.8-Max 的 12/36 元定价显得更实在。
另外 8 月上旬有限时活动:白天 credits 消耗 1 折,Token Plan 个人版夜间再享 2 折。量大用户值得蹲一下。
六、三种上手方式
方式一:Qwen Studio 网页版(免费,零门槛)
最省事的路子。打开 qwen.ai(Qwen Studio),注册登录就能用,模型已默认切到 Qwen3.8-Max。适合:想先试试能力、不做开发、偶尔用一下的用户。免费、不需要 API key、网页和 App 都能用。
方式二:Qoder CLI(程序员首选)
Qoder 是阿里 2025 年 8 月推出的 Agentic 编程平台,2026 年 5 月发布 1.0,全球用户突破 500 万,IDC 口径中国 AI 编程市场份额 47.6%。它的 CLI 可以理解成”阿里版 Claude Code”:
- 命令习惯基本一致(
/clear、/compact、/help通用) - 项目约定文件用
AGENTS.md(对应 Claude Code 的CLAUDE.md) - 默认支持 BYOK:自带 Key 就能接入阿里云百炼、OpenAI、GLM、Kimi 等模型,对国内用户友好(不用折腾模型代理)
- 支持 Windows / macOS / Linux,有 CLI 和 IDE 两种形态
在 Qoder 里选择 Qwen3.8-Max 作为模型,就能体验官方演示里的那套自主编程工作流。8 月上线的 Qoder Mobile 还能远程操作桌面端。
方式三:OpenAI 兼容 API(开发者)
Qwen 的 API 走 OpenAI 兼容格式,代码迁移成本极低。去千问 AI 平台(或阿里云百炼)拿 API key,模型名填 qwen3.8-max 即可:
1 | from openai import OpenAI |
100 万 token 上下文 + OpenAI 兼容格式,接进现有应用基本是改一行 base_url 的事。隐式缓存命中只要 ¥1.5/百万,重复查询场景(RAG、客服、代码补全)成本优势明显。
方式四:千问办公(企业 Agent)
如果团队要的不是单个模型,而是企业级 Agent 工作流——千问办公 8 月 3 日公测,Qwen3.8-Max 是基座。适合想把 AI 接进内部流程、协同办公场景的团队。
七、适合谁用
| 人群 | 推荐度 | 理由 |
|---|---|---|
| 程序员 | ⭐⭐⭐⭐⭐ | 自主编程 + Qoder CLI + 开源可部署 |
| Agent 开发者 | ⭐⭐⭐⭐⭐ | 长程任务、100 万上下文、多模态输入 |
| 企业(预算敏感) | ⭐⭐⭐⭐ | 12/36 元定价 + 开源 + 千问办公生态 |
| 想部署私有模型的团队 | ⭐⭐⭐⭐ | Max 级首次开源,有分布式推理能力就能跑 |
| 只偶尔用 AI 的普通用户 | ⭐⭐⭐ | Qwen Studio 免费够用 |
一个现实提醒:2.4T 参数的开放权重,不等于个人电脑能跑。它需要分布式推理集群——普通用户和大部分团队的实际价值在 API 调用,而不是自托管权重。想要本地部署的,等 Qwen3.8-27B 或更小尺寸的蒸馏版更实际。
八、和 DeepSeek / GPT-5.6 / Kimi K3 怎么选
| 模型 | 定位 | 价格(每百万 tokens 输入/输出) | 一句话点评 |
|---|---|---|---|
| Qwen3.8-Max | 开源旗舰、Agent 强 | ¥12 / ¥36 | 综合 + Agent 双强,权重开放 |
| DeepSeek V4-Flash | 性价比路线 | 低价(峰谷计费) | 便宜,但官方已预告涨价 |
| GPT-5.6 Sol | 闭源天花板 | $3 / $12(参考) | 编码/Agent 最强但贵 |
| Kimi K3 | 编程新贵 | 按量计费 | Agent + Coding 赛道直接竞品 |
选型逻辑很简单:要开源要部署 → Qwen3.8-Max;要绝对上限不差钱 → GPT-5.6 Sol;预算极敏感 → DeepSeek V4-Flash 或等 Qwen3.8-27B。
FAQ
Q1:Qwen3.8-Max 在哪里可以免费用? Qwen Studio(qwen.ai)网页版和 App 免费可用,模型默认是 Qwen3.8-Max。要编程体验用 Qoder CLI。
Q2:它真的开源了吗? 是的,这是千问 Max 级别旗舰第一次开源权重,官方承诺发布后约一周在 Hugging Face 和 ModelScope 放出,Qwen3.8-27B 同步开源。不过 2.4T 参数需要分布式集群才能跑,个人机器跑不动是正常的。
Q3:API 怎么调?很贵吗? 走 OpenAI 兼容格式,模型名 qwen3.8-max。国内输入 ¥12/输出 ¥36 每百万 tokens,缓存命中 ¥1.5。海外是 $2/$6。对比 Opus 5 约四成价格。
Q4:和 Qwen-Image-3.0 是什么关系? Qwen3.8-Max 是基座大模型(文本 + 视觉理解 + Agent),Qwen-Image-3.0 是图像生成模型,定位不同,可以配合使用。
Q5:Qoder 和 Claude Code 哪个好? Qoder 的优势是 BYOK 免折腾 + 阿里生态;Claude Code 的模型生态更成熟。如果主力模型是 Qwen,Qoder 是天然搭配。
Q6:用 Qwen3.8-Max 需要跨境网络吗? 国内用户直接用阿里云、Qwen Studio、Qoder 都无需特殊网络。但如果你需要同时访问 OpenAI、Anthropic、Google 的 API 做多模型对比,或者部署海外节点,稳定的国际网络环境能省很多事。
Q7:100 万 token 上下文实际能干什么? 长文档分析(整本书、整份代码库)、多轮 Agent 长任务、跨天项目维护。普通对话用不满,但做 Agent 开发是刚需。
写在最后
Qwen3.8-Max 的意义,不在于”又一个大模型”,而在于开源阵营第一次在旗舰级站到了闭源第一梯队面前:能力够强、权重开放、价格还低。对开发者来说是实打实的好消息——你第一次可以”拥有”一个接近 GPT-5.6 Sol 的模型,而不是只能租。
如果你想同时跑 Qwen、Claude、GPT 做多模型工作流,或者部署海外节点做国际业务,网络环境是绕不开的一环。下面是几家常青的跨境网络服务方案,按需选择:
| 方案 | 适合场景 | 特点 |
|---|---|---|
| 光速云 | 多设备、长期使用 | IEPL 专线 + IEPL专线 多路复用,性价比主力 |
| 飞猫云 | 入门体验 | IEPL 专线,经济型套餐起步 |
| SS-ID | 流媒体 + 办公 | IEPL 专线,流媒体解锁,5 设备 |
| MESL | 稳定备用 | IEPL 专线,中转入门,月付灵活 |
最后更新:2026-08-12
📖 相关教程:Qwen-Image-3.0 上手教程 · DeepSeek V4-Flash 指南 · Kimi K3 指南