AI资讯

阿里Qwen3.8-Max震撼发布:2.4万亿参数编程16天,千问办公同步公测

AI执行官

8月3日,阿里连放两枚重磅炸弹:新一代旗舰大模型Qwen3.8-Max正式发布,企业级AI办公产品千问办公(QwenWork)同步开启公测。更关键的是,Qwen3.8-Max预计下周开源——这是千问第一次把”超大杯”Max版本直接开源给社区。

Qwen3.8-Max:2.4万亿参数,编程能力全球第四

先说模型本身。Qwen3.8-Max的总参数量达到2.4万亿,但每次推理只激活950亿参数,用的是稀疏混合专家(MoE)架构。简单理解:脑子很大,但每次只调动需要的那部分,既聪明又省电。

几个硬核数据:

  • 上下文窗口100万Token:一次性读完整本小说或几百页法律文书不在话下
  • 编程能力(CodeArena)全球第四,仅次于Claude等少数模型
  • 视觉能力(VisionArena)全球第二,仅次于Anthropic
  • PaperBench得分93.0,超过Fable 5的88.8

最夸张的展示是:在无人干预的情况下,Qwen3.8-Max从一个空文件夹出发,连续自主运行16天,独立完成了一个名为”oh-my-cli”的自进化智能体框架,产出了265次代码提交,已在GitHub完全开源。它还跑过一次约125小时的自主科研任务,复现了多篇AI推理论文并把AIME24成绩再推高了2.7分。

价格屠夫:比Claude便宜60%-76%

Qwen3.8-Max的定价继续走”国产性价比”路线:

  • 国内API:输入12元/百万Token,输出36元/百万Token
  • 缓存命中价:输入仅1.5元/百万Token
  • 国际价格:分别是Claude Opus 5的40%和24%

结合上周DeepSeek V4-Flash的极致性价比,国产开源模型正在把”高性能”和”低价格”同时做到极致,硅谷闭源模型的定价空间被越压越窄。

千问办公(QwenWork):不只是聊天,是干活的AI

和Qwen3.8-Max同步上线的千问办公,是这次发布的另一个重头戏。它整合了阿里此前三个独立的Agent产品——QoderWork、MuleRun和悟空,一口气覆盖了三个场景:

  • 桌面端Agent:直接操作你的电脑,读写文件、跑命令
  • 云端Agent:把长任务丢到云端持续跑,不占本地资源
  • 企业协同Agent:打通钉钉,连接企业真实数据库和工作流

和普通AI聊天工具最大的区别是:千问办公不是”帮你写一段文字”,而是”帮你把活干完”。你给它一个目标,它自己拆步骤、调工具、生成文件,最后把成品交到你手上。

实测案例中,它能把一段视频访谈变成一个可交互的”观点星图”网页,带章节导航、搜索、片段收藏;也能分析你的磁盘空间占用,生成一份带可视化图表的HTML报告,哪些缓存可以清、哪些不能删,分门别类标好。

技能市场:把工作流变成可复用的”Skill”

千问办公还上线了”技能市场”,目前已有数据可视化、工作周报、竞品分析等现成技能。更厉害的是,一个资深员工调顺的工作流可以封装成”组织级Skill”,团队其他人直接复用。

公测期福利:新用户赠送2000积分,首周每日登录可领500-2000积分。

怎么体验?

  • 千问办公:访问 qwenwork.cn 下载PC客户端或使用网页版
  • Qwen3.8-Max模型:千问AI平台 qianwenai.com 或 QwenCloud.com
  • 开源权重:预计下周发布,关注阿里千问官方渠道

这一轮阿里打出的组合拳——旗舰模型开源 + 企业级Agent产品公测——说明国产AI已经不满足于”模型能力追平”,而是在往”产品落地”和”生态建设”走。对普通人来说,千问办公的公测是个难得的免费体验顶级AI Agent的机会,建议感兴趣的朋友抓紧上车。

分享给朋友