今日AI圈重点关注
2026年8月21日,AI行业的主旋律是”AI长出手脚”。DeepSeek把”思考”和”快答”合并到同一个模型里,省钱又能干重活;阿里千问发布Qwen-UI-Agent,让AI能直接看懂屏幕、操作你的手机和电脑;字节把Seed-OSS 36B完全开源,免费可用;Grok Bot在硅谷爆火,被投资人称为”又一个Claude Code时刻”。这些变化都在指向一件事:普通人用AI干活的门槛,又一次被大幅降低。
一、DeepSeek V3.1正式发布:一个模型同时支持”思考”和”快答”两种模式
8月20日晚,DeepSeek官方宣布V3.1版本上线,定位是”迈向Agent时代的第一步”。这次最大的变化是:把过去需要手动切换的”快答模型”和”深度推理模型”,合并进了同一个权重文件。
- 双模式自由切换:在DeepSeek官方网页和App里,有一个”深度思考”按钮。打开它,模型会先在”草稿纸”里推演再回答;关掉它,模型直接秒回。
- API命名同步升级:deepseek-chat 对应非思考模式(日常聊天、写文案、翻译),deepseek-reasoner 对应思考模式(数学难题、代码调试、复杂推理)。
- 上下文翻倍:从原来64K提升到128K,能一次吃下整本中等长度的电子书或一份大型财报。
- Agent能力大涨:在编程智能体SWE-bench上达到约66%,命令行任务Terminal-Bench约31.3%,都明显领先上一代R1-0528。
- 思考更省token:V3.1思考模式输出token减少20%-50%,但任务表现与R1-0528持平,做复杂任务反而更便宜。
- 开源+兼容Anthropic:基础模型和后训练模型已上架Hugging Face和魔搭;API还兼容Anthropic格式,可以直接接入Claude Code。
对普通人的意义:日常问问题、翻译、写短文案,关掉”深度思考”就能秒回还省钱;遇到数学题、写代码、整理长文档,打开它让模型多想一会儿再答。一个账号两种用法,对零基础读者非常友好。
二、阿里Qwen-UI-Agent正式发布:AI能直接看懂屏幕、操作手机和电脑
8月20日,阿里千问正式发布Qwen-UI-Agent——一个能让AI”看一眼屏幕就替你操作”的GUI图形界面智能体基座模型。它不需要软件开放接口,像真人一样点按钮、输入文字、滑动屏幕。
- 跨设备覆盖:手机、电脑、网页浏览器、深度搜索四种环境都能用。
- 基准成绩全球领先:移动端MobileWorld 82.1%、真机基准MobileWorld-Real 92.2%、AndroidDaily高达97.5%;电脑端OSWorld-Verified 79.5%、网页端WebArena 73.6%、界面定位ScreenSpot-Pro 81.5%,全部刷新SOTA,超过GPT-5.6 Sol和Claude Opus 4.8。
- 安全设计:遇到违法或高风险请求直接拒绝;遇到支付、转账、删除文件、隐私授权等敏感操作,AI会主动停下请你确认。
- 混合动作:不只能点界面,还能跑命令行;支持一次输出多个批量动作,把电脑任务执行步数减少58%。
- 长程任务能力:能在超过100步的超长轨迹上稳定运行,例如170步的深度调研任务一气呵成。
对普通人的意义:以前AI只能”告诉你怎么做”,现在它可以”替你做”。对于没有API的传统软件、内部OA系统、政府网站,这是真正能落地的智能化方案。普通用户可以关注通义千问App的更新,预计2026年Q4会有更完整的消费级体验。
三、字节Seed-OSS 36B开源:原生512K长上下文+可控思考预算
8月20日,字节跳动Seed团队正式开源Seed-OSS-36B系列模型,采用Apache 2.0协议,已上线Hugging Face。
- 36B稠密模型,12T tokens训练,原生支持最高512K上下文窗口(约等于一本80万字小说长度)。
- 思考预算可调:以512 token为粒度调节模型”思考”长度,企业可以根据任务难度控制成本。
- 同尺寸领先:Instruct版本在数学、代码、推理、Agent任务上接近或达到同尺寸开源模型最好水平。
- 提供”无合成数据”基础版本,方便研究者做后训练实验。
对普通人的意义:开源+商业友好的协议意味着,任何人都可以在自己电脑上本地部署一个”用得起”的长上下文模型,对需要分析长文档、做长项目代码审查的用户特别有用。
四、Grok Bot走红硅谷:又一个”Claude Code时刻”
知名投资人Gavin Baker在社交平台称Grok Bot是”又一个Claude Code时刻”,表示个人AI使用量因此增长了约100倍,并以”15秒从零构建一个播客摘要器”为例。
- 零配置+强制云端虚拟机:打开即用,不用选模型、调参数。
- 多智能体原生协同:每个Bot在云端独立运行,多个Bot之间自动传递上下文、接力完成任务。
- 个人订阅约200美元/月,团队席位约120美元/月。
业内也有质疑:聊天式界面不够严肃、Token消耗大、底层模型尚未领先。但无论如何,AI Agent的产品化形态,正在从”跑分竞赛”转向”工作流封装”。
对普通人的意义:未来你可能不需要懂技术,只要说出想要的结果,多个AI Bot会自动接力完成一整套任务,例如”做一个关于XX的小红书账号并发布三篇笔记”。
五、其他值得关注的AI动态
- 字节跳动与美国电影协会签全球AI版权协议:好莱坞与AI公司首份知识产权协议,覆盖Seedance/Seedream等所有AI工具及TikTok/CapCut/Dreamina,成员包括Netflix、迪士尼、索尼等主流片商。
- OpenAI首批NVIDIA Vera Rubin机架上线:OpenAI基础设施团队负责人Uday Ruddarraju宣布开始运行训练栈,Vera Rubin是NVIDIA下一代GPU架构。
- Slack Code发布:在Slack频道里@Claude Code/Devin/GitHub Copilot,就能开一个”代码频道”让AI帮你改代码、生成预览,团队成员实时评论审批。
- 币安上线Agent OS:AI智能体通过MCP接入真实金融基础设施(行情、交易、钱包),代表用户分析市场并执行交易;通过”子账户”做沙箱隔离,提现默认锁定,兼容ChatGPT、Claude Code、Cursor等工具。
- 宇树发布7轴仿生机械臂R1,售价9900元起:自重5.5kg、最大臂展650mm、负载2kg、重复定位精度约0.1mm,可适配科研教育、轻工业装配、服务机器人开发,标志着桌面级力控机械臂进入万元时代。
- Anthropic二季度营收超115亿美元,首次反超OpenAI:同比增长约14倍,75-85%收入来自企业级API调用,Claude Code成为核心增长引擎,并首次实现调整后营业利润5.59亿美元。
- 当虹科技发布BlackEye Vision机器人多模态感知上装件:集成声光、通信、算力模块,支持气体/温湿度等外接传感器,应用于工业巡检的仪表识别、温度异常、气体预警等。
- 台积电1.6nm级A16工艺完成开发验证:目标今年Q4量产,采用背面供电技术”超级电源轨”,相比N2P在同等功耗下性能提升8%-10%、同等性能下功耗降低15%-20%。
- 小红书首次开源大模型dots3 note preview:280B总参数/16B激活,支持512K超长上下文,覆盖文本、视觉、语音多模态,针对复杂推理和长程Agent任务优化。
- DeepSeek Harness v0.1.0-rc.8更新:公测后首次重要升级,14项调整强化多模态与AI Agent协作,Claude Code与Codex可作为子代理按需安装。
六、今日小结
今天最明显的变化是三条主线:
- AI从”对话”走向”动手”:DeepSeek V3.1统一思考与快答、Qwen-UI-Agent看屏幕操作App、币安Agent OS让AI真交易、Slack Code让AI在团队频道里协作,都指向”端到端完成任务”才是下一阶段的主战场。
- 开源模型进入”工程实用主义”:字节Seed-OSS 36B的512K上下文、Apache 2.0协议、可控思考预算三件套,都在让开源变得”开箱即用”。
- 商业格局加速洗牌:Anthropic首次反超OpenAI、字节拿下好莱坞首份版权协议、台积电A16瞄准AI算力,行业集中度在提升,但应用层机会反而在变大。
对普通读者来说,记住一句话就够了:AI工具正在变得越来越像”会干活的同事”,你只要说出结果,它会越来越懂得怎么帮你做到。
数据来源:DeepSeek官方公告(api-docs.deepseek.com)、千问大模型官方公众号、IT之家、央广网、新京报、新浪财经、AIGC日报(微博)、AI智能体信息日报(腾讯新闻)、腾讯研究院AI速递20260821、Smartotics AI Daily Report、新智元等公开信息,截至2026年8月21日。