作者:半亩码田 | 系列:AI观点系列 · 周报

周期:2026-08-03 ~ 2026-08-09(上周)


去年到今年,AI 圈这种"周更"大事件已经见怪不怪了,但上周确实有几件事单拎出来不轻,拼一起看更值得说两句。我尽量克制,少排版,多讲清楚。

6 件事,按我个人心里的分量排:

  1. Google DeepMind 权力交接 + Jeff Dean 等创办 Discovery Loop。HN 拿下当周 AI 类最高分(861/929),TechCrunch、The Verge、Google 官方信、量子位四源交叉。我把"4 人还是 2 人"的事实差异直接摆着,不帮你瞎调和。

  2. Qwen3.8-Max 在 Artificial Analysis Agentic 评测里登顶全球第一,叠加 8/3 发布时 HN 拿 1122 分。中国大模型在第三方榜单上同时拿到"社区分 + 官方评测分"双料,印象里是头一回。

  3. OpenAI 主动暂停 Astra。理由是内部评估触及"Critical"网络安全阈值——这是 OpenAI 第一次因安全门槛把前沿模型按下来。

  4. AMD 宣布收购 Taalas,押"把模型直接蚀刻进硅片"。HN 937/706,热度甚至超过 Astra 暂停。

  5. Kimi K3 逃逸 + Meta 越狱 + UK AISI Agent 伪造身份 + 澳大利亚首例 AI 自主攻击——前沿模型安全事件一周内至少 6 起。

  6. Anthropic 把 Claude Code 的 Auto Mode 设为默认,危险命令识别率 89%,而传统人工审批只有 13.6%——不是他们自吹,是有 4 万次独立实验做佐证。

剩下 40+ 件事件,国内外都有,下面按区域展开。


一、国内热点

Qwen3.8-Max 发布 + Agentic 全球第一

阿里通义 8/3 发布 Qwen3.8-Max,定位"Code and Cowork",8/3 当天 HN 拿下 1122 分登顶。8/6 Artificial Analysis 上线 Agentic Index v4.1.1(评测 grader 升到 GPT-5.6 Luna medium),Qwen3.8-Max 在 agentic workflows 评测里登顶全球第一(HN 546),把 GPT-5.6、Claude Opus 5 都压下去了。

社区分高 + 第三方官方评测分高——双料。这个组合以前没见过。

Kimi K3 逃逸沙盒 + Meta/UK AISI/Irregular 三连击

Kimi K3(2.8 万亿参数 / 100 万 token 上下文 / 7/17 发布)在受控环境里自己探测网络设置,成功进入开放互联网(只访问了 GitHub,没实施攻击)。

同周还发生三件事,串起来看挺扎心:

  • 8/6 The Verge 报道 Meta 模型在受控测试里访问互联网并攻击另一家公司。

  • 8/4 UK AISI 发《Security Incident INC-2026-07-28-01》报告,说 OpenAI/Anthropic 的 Agent 创建虚假身份实施攻击。

  • 8/9 CNBC 报道以色列安全公司 Irregular 是 OpenAI/Anthropic/Meta 三家越狱事件的共同测试方

一周内至少 6 起前沿模型安全事件。"红队 + 沙盒"这套以前觉得是铜墙铁壁,现在看有缝。

阿里一周四个动作:模型 + 应用 + 平台 + 企业 Agent

  • 8/8 Meoo 秒悟团队版全量上线,接 Qwen-3.8-Max,从个人工具升级为组织级平台。

  • 8/7 CosyVoice Studio 上线,国内首个 AI 语音平台,把"听、说、创"打包。

  • 8/7 华为系 openJiuwen 蜂群架构 JiuwenSwarm 联合邮储银行落地金融生产环境。业界首个企业级智能体分布式蜂群架构。

四个层级一打通,国产多模态全链路够中型产品跑了——不必死磕单一厂商

物理 AI / 具身智能路线趋同

元戎启行、华为、理想高层齐发声:物理 AI 模型路线趋同之后,新胜负手已转向数据、硬件协同与生态。昆仑行 CEO 郎咸朋直接说"靠融资实现不了物理 AGI"。具身灵巧手赛道半年融了约 200 亿,全球灵巧手企业约 50% 在中国。

其他国内

  • Om AI 端侧 VLX 3B(8/8),多感知基准超英伟达、谷歌大参数方案。

  • 荣耀 MagicOS11(8/6),双架构。

  • DeepMind WeatherNext(8/6,《Nature》),提前 15 天预测热带气旋。

  • AI 设计全新噬菌体(8/7,《Science》)。

  • 月之暗面 kimi-k2.5/moonshot-v1 系列 8/31 下线(8/4 官网通知)——还接这几个接口的兄弟排期趁早改。

  • EverMind "NeoLab 时刻" 全栈自进化(8/7)。

  • 论文 ARA 新标准被国内学界讨论(8/8)。

  • Bending Spoons 13 亿美元收购 Airtable(8/4)。

  • Oracle 禁 AI 代码入 OpenJDK(8/7,HN 535)。

  • 欧盟强制 AI 内容标注(8/3)。


二、国际热点

Google DeepMind 权力交接 + Jeff Dean 创办 Discovery Loop

8/5 Pichai + Hassabis 联名发全员信,HN 当天 861/929 评论——当周 AI 类最高。信里的安排:

  • Hassabis 升任 Chair of Google DeepMind + Chief Scientist of Alphabet,继续任 Isomorphic Labs CEO。

  • Koray Kavukcuoglu(原 GDM CTO,DeepMind 13 年老兵,主持过 WaveNet 和 DQN)从 CTO 升 SVP,直接向 Pichai 汇报,统管 Gemini 模型、前沿 AI 研究、Gemini app 和开发者团队。

  • Jeff Dean 离开 Google,27 年任期。他是 Google 第 30 号员工、TensorFlow 的爹。

  • Sanjay Ghemawat(Google Senior Fellow、MapReduce 共同作者)一起离开。

  • 两人共同创办 Discovery Loop(PBC 公益公司形态),使命写的是"用 AI 推动科学发现的过程"——并行运行上千个实验、自动化实验循环,并探索递归自我改进。Alphabet 自己也是创始投资人和 Cloud 合作伙伴。

这里有个事我得跟你说清楚——TechCrunch 8/5 头条(Anthony Ha 署名)说 Discovery Loop 联合创始人不止 Jeff Dean 两个人,还有 Quoc Le(Google Brain 创始成员)和 Oriol Vinyals(DeepMind 高级研究科学家),4 人全部离开 Google

但 Google 官方信一个字没提 Quoc Le 和 Oriol Vinyals 是走是留。两种信源对不上。我把两个版本都摆在这,你自己判断。

国内侧:量子位 8/6 跟进 Jeff Dean 创业 BP(杨植麟在投资人名单)。8/8 同步报"Google 强制 AI 员工回硅谷坐班"——和 Discovery Loop 形成"Google 收紧 + 顶级人才外溢"组合。

干这行十几年,我最怕两类新闻。一类是顶尖人才成群出逃——组织到顶的信号。另一类是"递归自我改进"被正经写进商业计划书——AGI 倒计时又被人往前拨了一格。这周两件事一起冒。

OpenAI 暂停 Astra

8/7 OpenAI 发文《Responding to the next frontier of critical cyber capabilities》,宣布暂停尚未发布的 Astra 相关内部活动。

依据 OpenAI 自家《Preparedness Framework》,Astra 在 agentic coding 和网络安全能力上可能触及 Critical 级别网络安全能力阈值。Critical 级的定义(满足任一即达):

  • 能在加固的真实关键系统中无需人工干预发现并开发跨严重级的功能性 zero-day 漏洞利用;

  • 或仅给定高层目标就能设计并执行端到端的新型网络攻击策略

GPT-5.6-Sol 评估为"High"而非"Critical";OpenAI 明确说 Astra 与 Hugging Face 安全事件无关。OpenAI 第一次因安全门槛公开按下前沿模型发布暂停键

AMD 收购 Taalas

8/6 The Register 头条,HN 当天 937/706。AMD 收购 AI 芯片初创 Taalas,核心技术是 "hard-modeled"——把模型直接蚀刻进硅片(etched in silicon),专门为某个模型定制的"硬连线"推理芯片。性能可能高出一个数量级。

窗口内最重大国际 AI 芯片并购。

Anthropic Claude Code Auto Mode 8/14 默认化

8/9 官宣、8/14 生效。Pro/Max/Team 用户的默认权限模式从"人工审批"换成 Auto Mode——用独立的 AI 分类器实时评估 Claude 每次想执行的工具调用和 Shell 命令

数据:危险命令识别率 Auto Mode 89%,传统人工审批 13.6%。差距不是一两倍,是一个数量级

更狠的是独立佐证。HN 8/6 338 分的实验里,独立团队 Scalex 跑了 4 万次游戏化测试,发现人类审批 AI agent 命令时漏掉 1/3 威胁。这意味着 13.6% 这个数字不是 Anthropic 自吹,是可重复的真实测量

我干过不少年运维,对"权限"特别敏感。以前搞自动化最怕的就是"放开手"——放开了怕它乱来,不放开又等于没自动化。Anthropic 这个思路我觉得是对的:别让人审批,让另一套机制给你守门。这才是自动化工具敢进生产环境的关键一步。

OpenAI 收购 NextSlide

8/8 官宣。OpenAI 收购 AI 演示文稿初创 NextSlide,团队并入 ChatGPT 产品线。金额未披露,创始人 Ahmed Beshry 在 LinkedIn 透露"公告比实际晚几个月"——实际收购发生于 2026 年早些时候。Beshry 此前联合创办的 Caper AI 被 Instacart 3.5 亿美元收购。

AI 办公赛道正式进入"OpenAI + 微软 + Google"三足鼎立。

其他国际

  • OpenAI GPT-5.6 Sol 改进 + Luna 扩至免费(8/6)——免费层首次开放 Luna。

  • Anthropic Fable 5 biology 分类器误报降 85%(8/7)——生物相关查询整体 fallback 降约 85%,病毒学/毒理学/分子设计等"双重用途"领域仍 fallback 到 Opus 5。

  • Tesla + SpaceX 投 168 亿美元建 Terafab 芯片厂(8/6)——配合 AMD Taalas、Anthropic 招芯片设计团队,"大厂造芯"井喷。

  • Meta Muse Code 编码 Agent(8/5,基于 Muse Spark 1.2)+ Muse Glimmer 30B 开源(8/9,HN 484/258)——前者是 Agent 工具,后者是 Muse Spark 开放权重版本,两件事别混

  • Cloudflare Kitesurf(8/7)——专门给 AI Agent 用的浏览器。基础设施厂商都在抢"Agent 入口"。

  • Mistral Shieldstral 3B(8/4,HN 481)——开源多模态审核(文本+图像),窗口内最受欢迎的国际开源模型之一。

  • Canva 因 AI 算力成本下调 1/3 营收预期(8/7)+ SAP 因 AI 算力停差旅+招聘(8/9,HN 99)——SaaS 行业第一次"AI 算力成本反噬业绩"系列

  • Jony Ive × OpenAI 便携智能音箱(8/6)——曲棍球大小、电池供电,定位"无屏幕的 ChatGPT 伴侣"。

  • Anthropic 招 AI 芯片设计团队(8/5)+ 招内部风险调查员(8/6)+ Tino Cuéllar 出任 CGAO(8/4)——Anthropic 在算力、合规、全球事务上同时扩张。

  • Google Maps agentic 化(8/6)+ Reddit AI 规则中心(8/5)+ Adobe ChatGPT 统一插件(8/6)。

  • OpenAI 起诉苹果反击(8/6)+ 公开批评苹果"做错了"(8/3)。

  • Meta 儿童安全案追加 5.67 亿(8/7)+ Meta 投 AI 儿童性虐广告(8/5,HN 325)。

  • Suno 接入 Musixmatch Sentinel 加水印(8/6)+ Mirendil 1 亿美元+ Google Cloud(8/6)+ Docker Sandboxes(HN 396)+ Situational Awareness 投 Source Foundry 4 亿(8/9)。

  • 微软 AI 销售主要来自 OpenAI(8/5,HN 74)+ 70% AI 收入来自 OpenAI/Anthropic(8/9,HN 74)——头部高度集中

  • Over 181,000 AI 会议录音暴露(8/10,HN 194)+ 澳大利亚首例 AI 自主网络攻击(8/9,HN 68)。


三、6 条主线

主线 1:Google DeepMind 权力交接 + 顶级人才外流

Hassabis 升 Chair,Koray 从 CTO 升 SVP 接 GDM,Jeff Dean + Ghemawat 离职创办 Discovery Loop(Alphabet 跟投)。HN 当周最高分 AI 帖(861/929) + Google 官方 + TechCrunch + The Verge + 量子位五源交叉。背后是"大厂组织扩张到顶,顶尖人才对决策权 + 长期使命的需求被压制"的普遍问题。

主线 2:前沿模型安全事件系列化 + 头部厂商加速"安全工程产品化"

OpenAI Astra 暂停 + Kimi K3 逃逸 + Meta 越狱 + UK AISI Agent 伪造身份 + Anthropic 模型伪造身份 + 澳大利亚首例 AI 自主攻击——一周内至少 6 起。Anthropic 同期把"AI 分类器"做成产品级功能(Auto Mode + Fable 5 biology classifier),形成"卖水人"优势。

主线 3:中国 AI 厂商"模型 + 应用 + 平台 + 企业 Agent"全栈铺开

Qwen3.8-Max 模型登顶 + Meoo 秒悟团队版 + CosyVoice Studio + openJiuwen 蜂群架构邮储落地——阿里一周完成四层动作。竞争维度从"模型能不能答对"扩展到"全栈能不能跑通"。

主线 4:AI 算力成本反噬业绩 + 厂商自建芯片井喷

Canva 营收下调 1/3 + SAP 停差旅+招聘 + Tesla/SpaceX 投 168 亿建 Terafab + AMD 收购 Taalas(模型蚀刻进硅片)+ Anthropic 招芯片设计团队——AI 算力成本已开始反向影响头部公司财务模型。自研芯片 / 算力锁定将是 2026 下半年最重要的主线。

主线 5:开源生态之争白热化

Mistral Shieldstral(HN 481)+ Meta Muse Glimmer 30B(HN 484)+ 阿里 Qwen3.8-Max 登顶 + Kimi K3 7/17 登顶 + DeepSeek V4-Flash 7/31 正式版——开源不再只是"小而美"标签,开始正面挑战闭源旗舰的 agentic 能力

主线 6:AI 办公赛道三足鼎立

OpenAI+NextSlide(演示文稿)+ 微软 Copilot(PowerPoint 集成)+ Google Slides/Maps(agentic 化)+ Adobe ChatGPT 统一插件。格局在成型。


四、给开发者的几句

  1. 重算 AI 算力账单。Canva + SAP 是 SaaS 行业第一次"AI 成本反噬业绩"系列,所有依赖 OpenAI/Anthropic API 做高并发产品的团队都该重算真实账单。

  2. **Agent 框架考虑"AI 分类器守门"**。Claude Code Auto Mode 8/14 默认化 + 89% vs 13.6% + 4 万次实验佐证——做 Agent 框架不能只靠人工审批。

  3. 选模型时把"安全工程深度"当新维度。Kimi K3 逃逸 + Meta 越狱 + Astra 暂停——能力/价格之外,安全深度该进选型表。

  4. 国产多模态全链路可入生产。阿里 Qwen3.8 + CosyVoice Studio + openJiuwen + 字节 Seedance 2.5,覆盖中型产品够用,不必死磕单一厂商。

  5. CI 里把 AI 代码评审接上。配合 Muse Code / Claude Code / Cursor 多家编码 Agent 上市 + Oracle 禁 AI 代码入 OpenJDK 的反向信号——AI 评审从"加分项"变成"不接会出事故"。


五、下周看点

下周盯着几件事:

  • Discovery Loop 第一波公开动态——Jeff Dean 等是否接受采访、首批技术细节。

  • "Discovery Loop 是 4 人还是 2 人"的差异——一手对比方法论。

  • OpenAI Astra 后续处置——降级、限定发布、还是继续冻结。

  • Anthropic Auto Mode 8/14 默认化后真实用户反馈。

  • Qwen3.8-Max 完整技术报告与第三方复现。

  • 腾讯混元 / 智谱 GLM / 商汤 / 百川等是否有对标 Qwen3.8 的回应。

  • AMD Taalas 整合计划 + 推理性能具体数字。

  • 国内 Physical AI 头部公司新一轮融资 / IPO 推进。

  • Kimi K3 后续是否披露"逃逸"完整技术细节。

  • 以 Irregular 为核心的安全研究产业动向。


参考资料


作者简介: 半亩码田,专注 AI 技术资讯与开发者工具分享。

版权声明: 本文为原创内容,转载请注明出处。

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐