8月15日,AI圈又迎来了一个信息密集的”超级日”。阿里千问突然开源27B小钢炮模型、智谱发布编程能力暴涨50%的GLM-5.3、OpenAI推出让ChatGPT”记住你做过什么”的Computer History功能、苹果被曝联合阿里训练中国专属AI模型——四大重磅消息同日落地,国产开源模型正以前所未有的速度追赶国际前沿。
一、阿里千问Qwen3.8-27B突然开源:家用显卡就能跑,Agent能力超Claude Opus
8月14日晚间,阿里千问正式开源Qwen3.8-27B模型权重。这是一款270亿参数的原生多模态稠密模型,支持图像和视频理解,原生上下文长度262K(可通过YaRN扩展至100万Tokens),采用Apache 2.0协议,开发者、科研机构和企业均可免费下载、部署及商用。
核心亮点:
- Agent能力暴涨:在Agentic Terminal Coding测试中得分73.0(上代63.4),SWE-bench Pro得分61.7(上代53.5),专业工作测试JobBench得分33.4(上代21.8,提升约50%)
- 部分指标超Claude:在CoWorkBench(办公Agent任务)上得分70.7,超过Claude Opus 4.6 Max的68.2;在OSWorld-Verified等部分基准上甚至超过了Opus 4.6 Max
- 家用设备可跑:4-bit量化后仅需约17GB显存,RTX 4090/5090或M4/M5 Max MacBook均可流畅运行
- 即开即用:已在LM Studio、Ollama、MLX、Unsloth/Hugging Face等平台同步上线
- 多模态理解:原生支持图片和视频输入,能看懂屏幕截图、图表和文档
- 智能思考调节:新增reasoning_effort功能(low/medium/xhigh三档),可根据任务难度动态调节思考深度
截至发稿,千问已累计开源460余个模型,全球下载总量超30亿次,衍生模型数超30万个。Qwen3.8-27B已在Hugging Face和魔搭社区同步上线。
二、智谱发布GLM-5.3:编程能力最强的开源模型,还发现了2404个安全漏洞
8月14日,”全球大模型第一股”智谱正式发布新一代基座模型GLM-5.3,总参数规模7430亿。与GLM-5.2共享同一基座,本次提升全部来自后训练优化——相当于”课本没变,但换了更好的训练方法,学生成绩大幅提升”。
关键数据:
- 编程能力提升50%:在Z.ai Code Bench最高档位下准确率达31.4%,超过Claude Opus 4.8的29.5%,且每任务仅需约5万tokens(Opus 4.8需约12万)
- 开源最佳成绩:Terminal-Bench 3.0得分28.3(开源最高,超Kimi K3),DeepSWE v1.1得分66.9
- 网络安全能力涌现:CyberGym漏洞推理评测得分84.5%,超过GPT-5.6 Sol的83.6%;发布前两周联合安全团队发现2404个潜在漏洞(其中1088个中高危),包括潜伏40余年的DNS协议级风险
- 两周内开源:完整模型权重将在安全加固后两周内开源,API即将上线
GLM-5.3即日起已在ZCode、AutoClaw等平台上线,第三方编程平台TraeWork、CodeBuddy、Qoder等已开放早期接入。值得关注的是,GLM Coding Plan所有用户配额已于当日13:00重置。
三、OpenAI推出Computer History:让ChatGPT记住你在电脑上做过的一切
8月13日,OpenAI在ChatGPT桌面端macOS版上线了Computer History功能。这个功能可以让ChatGPT和Codex”记住”你在电脑上的操作行为,打造一个可搜索的活动时间线。
工作原理:
- 通过macOS辅助功能API记录交互事件:点击、打字、键盘快捷键、应用切换等
- 不截屏、不录音、不录系统声音、不记录隐私浏览
- 事件在本地Mac上暂存最多48小时,上传OpenAI服务器生成记忆摘要后删除原始事件
- 记忆文件以纯文本形式存储在本地,用户可随时查看、编辑或删除
能做什么:
- 问ChatGPT”我午休前在做什么”,它能帮你回忆起之前的工作
- 找到你最近看过但忘记名字的文档
- 生成一天工作总结
- 识别重复工作流,建议自动化或创建Skills
该功能默认关闭,需手动开启。目前面向ChatGPT Pro、Business和Enterprise用户开放(EEA、瑞士、英国暂不可用)。OpenAI提醒:该功能会增加提示注入攻击风险,建议在处理敏感信息时暂停收集。
四、苹果联合阿里训练中国专属AI模型:Apple Intelligence数月内落地中国
据路透社8月14日报道,三位知情人士透露,苹果已专门为中国市场训练了一款大语言模型,该模型由苹果与阿里巴巴集团合作开发,并在阿里支持下完成训练。
关键信息:
- 这是苹果首次为中国市场自研AI模型,此前一直依赖第三方模型
- 苹果将成为首家获得中国监管部门批准、可在华提供自研AI模型的外国企业
- 采用”双轨并行”策略:自研模型 + 接入阿里通义千问和百度技术
- 7月15日,中国国家网信办已完成Apple Intelligence生成式AI服务备案
- Apple Intelligence预计随iOS后续更新在未来数月内正式在中国上线
- 适配iPhone、iPad、Mac和Vision Pro设备
上周苹果曾发布中文文档介绍Mac用户如何将通义千问接入Siri和写作工具,但随后删除。业内人士分析,iPhone此前在中国缺失AI功能是拖累销量的关键因素之一,Apple Intelligence的落地将显著提升苹果在中国市场的竞争力。
五、Claude自动管理App:388个PR,180个已合并
新智元8月15日报道,Claude之父Boris Cherny在X上披露了一项实验:过去几周让Claude每日自动巡检、提交PR,累计提交388个PR,其中180个已被合并,工程师只剩下”签字”环节。Faros AI报告显示,高AI采用度团队人均epic完成量上涨66.2%,但每周部署反而下降11.7%——代码审查正在成为新的效率瓶颈。
总结:开源AI进入”普惠爆发期”
今天的5条新闻有一个共同主线:AI能力正在以前所未有的速度走向普惠。Qwen3.8-27B让270亿参数的前沿模型跑在家用显卡上,GLM-5.3证明不堆参数也能大幅提升能力,OpenAI Computer History让AI真正理解你的工作方式,苹果中国定制AI让国行iPhone终于要用上AI了。
对普通人来说,这意味着:用好AI工具的门槛正在快速降低,现在正是上手的好时机。
数据来源:智东西、凤凰网科技、IT之家、中国基金报、中国证券网、中国日报、Mac Observer、The Register、路透社、新智元、qq.com、aistart.ai、smartotics.com、aibriefing.dev、jasonrobert.dev 等 | 发布时间:2026年8月15日