一句话告诉你发生了什么
2026年8月13日上午,阿里千问团队第一次把Max级别的旗舰大模型——Qwen3.8-2.4T-A95B完整权重公开,所有人在Hugging Face和魔搭社区都能免费下载。在论文复现基准PaperBench、电脑操作基准OSWorld-Verified、CAD设计基准三项跑分上,这个2.4万亿参数的模型直接拿了全球第一,正式宣告国产开源AI从此能跟Fable 5、GPT-5.6 Sol正面掰手腕。
一、Qwen3.8到底牛在哪
先说几个关键数字,有个直观感觉:
- 2.4万亿总参数,每次激活950亿——典型MoE(混合专家)架构,模型体积巨大但每次推理只调用一小部分,既保证能力又兼顾速度。
- 原生26.2万Token上下文,可扩展到101万Token——一本百万字的长篇小说可以一次性塞进去分析。
- 92层深度架构,每层512个专家——把”专家”做细做精,需要哪种能力就唤醒哪个。
- 必须开启思考模式——Qwen3.8系列默认会先在内部”想清楚”再回答,这个模式无法关闭,但好处是思考过程能跨对话保留(preserve_thinking),对Agent续跑友好。
重点看跑分成绩(官方公布的,与同期顶级模型对比):
| 评测项 | Qwen3.8-Max | Fable 5 | GPT-5.6 Sol | Claude Opus 4.8 |
|---|---|---|---|---|
| 论文复现(PaperBench) | 93.0第一 | 略低 | 略低 | 略低 |
| 电脑操作(OSWorld-Verified) | 86.1第一 | 略低 | 略低 | 略低 |
| CAD设计(参数化CAD) | 91.5第一 | — | — | — |
| Terminal Bench 2.1 | 86.6 | — | 88.8 | — |
| SWE-bench Pro | 67.7 | 80.0 | — | 69.2 |
简单说:Qwen3.8在”耐力型”任务(长流程、跨系统操作、设计)上全球第一,在”单点冲刺”任务(单回合编码、终端命令)上略输Fable 5。综合实力已经是全球第一梯队,这是事实,不是吹。
二、为什么说”Max级首次开源”是个大事
开源模型过去一直有个尴尬:开源出来的往往是小杯、中杯,而真正最强的那一档旗舰模型(比如GPT-5.6 Sol、Fable 5)永远闭源,要订阅、要按Token付费,数据还得过他们的服务器。
现在阿里打破了这个格局——
- 完整权重公开,意味着任何人都可以下载下来本地部署、私有化运行、二次微调。不依赖阿里云,不受API限速,不用每月交费。
- 数据隐私可控,企业、医疗机构、政府部门都可以在自己机房跑,核心数据不出门。
- 推动整个行业降价,参考开源DeepSeek把GPT级别API价格压到原来的1/10,Qwen3.8开源后,Fable 5、Claude Opus这些顶级闭源模型的定价权估计要动摇。
据Hugging Face的2026年春季报告,中国自研开源模型下载占比已经达41%,首次超过美国。这次2.4万亿参数的Max级模型开源,意味着”开源阵营”这边的最强战力直接拉到顶级,全球AI格局正式进入”开源围剿闭源”阶段。
三、普通人能立刻用上的4种方式
开源不代表你必须买服务器、敲命令行。这四种方式,从零门槛到深度玩家全都有。
方法一:千问办公(qwenwork.cn)——0门槛,免费用
- 浏览器打开 https://qwenwork.cn(国内可直接访问)。
- 用阿里账号/钉钉/支付宝扫码登录。
- 对话框就是Qwen3.8驱动的,支持中文长文档分析、写PPT、做表格、查资料、写代码,跟现成的ChatGPT体验一样。
- 免费版就有不错的额度;付费版(月费十几到几十元)拿到更强的能力和更高并发。
适合:完全不懂AI、就想直接体验”全球最顶级国产AI”的人。这是目前最省心的方式。
方法二:通义千问官方Chat(qwen.ai)——网页/App/小程序多入口
- 访问 https://chat.qwen.ai,或下载”通义千问”App(应用商店搜”通义”或”千问”都能找到)。
- 用淘宝/支付宝账号登录。
- 默认就是Qwen3.8,支持语音输入、文件上传、多模态理解。
- 可以处理图片、PDF、Word、Excel,免费版够大部分日常使用。
适合:已经有阿里系账号、偶尔用AI的人。
方法三:阿里云百炼 API——想做副业/小工具的程序员
- 访问 https://bailian.console.aliyun.com,注册阿里云账号(免费)。
- 开通”百炼”服务,新用户有几百元免费调用额度,学生认证后额度更多。
- 在模型列表里选 “qwen3.8-max”,生成API Key。
- 用任何支持OpenAI格式的工具(Cherry Studio、Cline、Cursor等)接入,API地址填阿里云的endpoint。
- 价格:每百万Token输入12元、输出36元;命中缓存的话输入只要1.5元。
适合:想做AI副业、要把AI能力集成到自己的工具/网站里的开发者。
方法四:本地部署开源版本(高门槛,但完全私有)
- 访问 https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B 或魔搭社区 https://modelscope.cn/models/Qwen/Qwen3.8-2.4T-A95B,注册账号,签署协议。
- 原始权重4.9TB,需要企业级服务器(NVIDIA H100 8卡起步)。
- 如果是个人爱好者,推荐等Qwen3.8-27B(官方已预告在路上),27B参数单机RTX 4090就能跑。
- 下载Unsloth Desktop工具,把2.4T模型量化到397GB,需要总内存+显存410GB以上(Mac Studio M3 Ultra配192GB内存勉强可以试)。
- 用vLLM或SGLang推理引擎部署,启动后浏览器访问本地端口就能对话。
适合:有硬件资源、有数据隐私需求、想深度研究模型的硬核玩家。
四、对普通人的真实影响
这事不只跟程序员有关。对完全不懂技术的普通人,有三层意义:
- 第一层:用AI的成本接下来还会继续降。开源顶级模型后,各家闭源模型为了留住用户要么降价,要么扩免费额度;DeepSeek、阿里、字节已经在卷,OpenAI和Anthropic迟早跟进。
- 第二层:你用的AI会越来越强。开源后大量开发者会基于Qwen3.8出插件、套壳、行业定制版,以后你在钉钉、淘宝、千问办公里用到的AI能力,可能底层就是Qwen3.8。
- 第三层:数据更安全。当你用千问办公这类国内产品时,数据走国内服务器,不用担心海外大厂服务器出bug或被监管波及——尤其是做电商、写报告、处理敏感信息的人。
五、三个值得提醒的坑
- 开源不等于完全免费商用。Qwen用了自定义许可证,普通个人使用、学术研究OK,但如果是大型商业部署(月活百万以上)需要单独授权。普通用户影响不大,但创业团队要留意。
- 开源版 ≠ 云端最强版。本次开放的Qwen3.8-2.4T-A95B只有文本输入、必须开启思考模式;而云端的Qwen3.8-Max还多了视觉输入、非思考模式、1M默认上下文和官方工具调用。日常体验选千问办公/官方Chat就够了。
- 硬件门槛别高估也别低估。2.4T模型听起来吓人,但Unsloth已经做到397GB量化版、410GB内存可跑;不过这依然不是一般家庭电脑能消受的。普通人想体验,直接用方法一和方法二就好,本地部署留给有服务器的朋友折腾。
结尾
Qwen3.8这次开源只是一个开始——阿里已经预告Qwen3.8-27B”在路上”,这个27B的轻量版本才是真正能进普通人家里的旗舰级模型。再加上8月初已经有DeepSeek V4 Pro、Kimi K3、智谱GLM-5.2、MiniMax H3、字节Seedance 2.5——过去两周,国产开源AI已经连发五款顶级产品。
如果你之前一直只用ChatGPT或Claude,2026年下半年真的可以试试国产AI了。免费、私密、中文更地道,能力已经不输。这次开源潮之后,可能下一个改变你工作方式的AI,就是它。