8月3日,阿里连放两枚重磅炸弹:新一代旗舰大模型Qwen3.8-Max正式发布,企业级AI办公产品千问办公(QwenWork)同步开启公测。更关键的是,Qwen3.8-Max预计下周开源——这是千问第一次把”超大杯”Max版本直接开源给社区。
Qwen3.8-Max:2.4万亿参数,编程能力全球第四
先说模型本身。Qwen3.8-Max的总参数量达到2.4万亿,但每次推理只激活950亿参数,用的是稀疏混合专家(MoE)架构。简单理解:脑子很大,但每次只调动需要的那部分,既聪明又省电。
几个硬核数据:
- 上下文窗口100万Token:一次性读完整本小说或几百页法律文书不在话下
- 编程能力(CodeArena)全球第四,仅次于Claude等少数模型
- 视觉能力(VisionArena)全球第二,仅次于Anthropic
- PaperBench得分93.0,超过Fable 5的88.8
最夸张的展示是:在无人干预的情况下,Qwen3.8-Max从一个空文件夹出发,连续自主运行16天,独立完成了一个名为”oh-my-cli”的自进化智能体框架,产出了265次代码提交,已在GitHub完全开源。它还跑过一次约125小时的自主科研任务,复现了多篇AI推理论文并把AIME24成绩再推高了2.7分。
价格屠夫:比Claude便宜60%-76%
Qwen3.8-Max的定价继续走”国产性价比”路线:
- 国内API:输入12元/百万Token,输出36元/百万Token
- 缓存命中价:输入仅1.5元/百万Token
- 国际价格:分别是Claude Opus 5的40%和24%
结合上周DeepSeek V4-Flash的极致性价比,国产开源模型正在把”高性能”和”低价格”同时做到极致,硅谷闭源模型的定价空间被越压越窄。
千问办公(QwenWork):不只是聊天,是干活的AI
和Qwen3.8-Max同步上线的千问办公,是这次发布的另一个重头戏。它整合了阿里此前三个独立的Agent产品——QoderWork、MuleRun和悟空,一口气覆盖了三个场景:
- 桌面端Agent:直接操作你的电脑,读写文件、跑命令
- 云端Agent:把长任务丢到云端持续跑,不占本地资源
- 企业协同Agent:打通钉钉,连接企业真实数据库和工作流
和普通AI聊天工具最大的区别是:千问办公不是”帮你写一段文字”,而是”帮你把活干完”。你给它一个目标,它自己拆步骤、调工具、生成文件,最后把成品交到你手上。
实测案例中,它能把一段视频访谈变成一个可交互的”观点星图”网页,带章节导航、搜索、片段收藏;也能分析你的磁盘空间占用,生成一份带可视化图表的HTML报告,哪些缓存可以清、哪些不能删,分门别类标好。
技能市场:把工作流变成可复用的”Skill”
千问办公还上线了”技能市场”,目前已有数据可视化、工作周报、竞品分析等现成技能。更厉害的是,一个资深员工调顺的工作流可以封装成”组织级Skill”,团队其他人直接复用。
公测期福利:新用户赠送2000积分,首周每日登录可领500-2000积分。
怎么体验?
- 千问办公:访问 qwenwork.cn 下载PC客户端或使用网页版
- Qwen3.8-Max模型:千问AI平台 qianwenai.com 或 QwenCloud.com
- 开源权重:预计下周发布,关注阿里千问官方渠道
这一轮阿里打出的组合拳——旗舰模型开源 + 企业级Agent产品公测——说明国产AI已经不满足于”模型能力追平”,而是在往”产品落地”和”生态建设”走。对普通人来说,千问办公的公测是个难得的免费体验顶级AI Agent的机会,建议感兴趣的朋友抓紧上车。