封面提示词:Scenes of the struggle between Cao Cao, Yuan Shao, and Dong Zhuo in Luoyang from the Chinese story "Romance of the Three Kingdoms." --no berserk --ar 16:9 --stylize 500 --hd --profile qarw7oh e4r786a 8hgx7tr
上周工作总结:
- CodePilot 迭代:集中修复了一大批 Windows 端的已有问题,尽量让它与 macOS 的体验保持一致,恢复了 Linux 版本,Harness 遗留问题修复:补齐了素材库和基础助理能力的一些遗留问题,优化了心跳机制、通知系统以及 Memory 本身的构建
- Skills 开发与更新:
(a) 目前带了几个现有的 Skills,正在开发一个“口播视频剪辑”的 Skill
(b) 新上线了一个用于“分享运动和分析运动数据”的 Skill
(c) PPT Skills 更新了“演讲者模式”,这周应该会正式发布(目前已经开发完毕,还未上线)
上周精选✦
谷歌 DeepMind 人事地震: 核心研发、AI 研发人员离职和跳槽
感觉上周大家都没什么值得关注的发布,都是些八卦和行业的变动。其中最大的就是谷歌这轮 AI 部门(Google DeepMind)的人事变动了。
8 月 5 日,Sundar Pichai宣布了对 Google DeepMind 领导层的彻底重组,核心变动如下:
哈萨比斯(Demis Hassabis)交出日常运营权:他不再担任 DeepMind 的 CEO 和董事长,转任首席科学家。同时,他会将更多的精力投入到他自己创办的 AI 药物研发公司(Isomorphic Labs)。目前他保留首席科学家的职位,看起来只是为了减少谷歌内部的震荡,未来可能会彻底淡出谷歌。
杰夫·迪恩(Jeff Dean)带队出走创业:在谷歌工作了 27 年、被誉为谷歌工程 GOAT 的杰夫(Jeff Dean)离职了。作为 TPU 项目的发起人,他创办了一家新公司,目标是用 AI 自动化机器学习工程与科学。跟他一起出走的还包括三位谷歌顶级科学家: Sanjay Ghemawat(谷歌高级 Fellow、Dean 长期搭档)、Quoc Le(Google Brain 联合创始人)、Oriol Vinyals(DeepMind 研究副总裁、Gemini 技术负责人之一)。
Gemini 团队重组:前 DeepMind CTO 离职后,Gemini 剩下的联合负责人升任 SVP,直接向皮柴汇报。据传,谷歌创始人谢尔盖·布林(Sergey Brin)也已经回到 DeepMind 开始亲自领导研究工作。
这次大重组背后的核心原因,主要有以下几点:
双中心内耗:硅谷和伦敦双中心的工作模式非常内耗。哈萨比斯和杰夫领导的两拨人,在算力分配、文档归属以及项目主导权上一直存在争夺。 • 官僚文化严重:内部面临严重的官僚文化问题。 • Gemini 竞争力下滑:这是最主要的原因。
另外SemiAnalysis还有一个论点:这波变动最大的受益者是谷歌云服务(GCP)。 过去,DeepMind 和 GCP 总是为了算力打架——DeepMind 希望把算力留给自己做模型的推理和训练,而 GCP 则希望把算力卖出去变现。现在看来,是云业务的负责人赢了内部斗争。谷歌最终选择像 Meta 那样去出租自己的 TPU 算力,实际上相当于放弃了前沿模型的训练。

OpenAI 披露入侵 Hugging Face 的详细细节,以及暂缓 Astra 模型的发布
上周关于 OpenAI 模型入侵 Hugging Face 的事件仍在继续。OpenAI 的对齐与安全研究负责人在 Black Hat 会议上公布了官方详细版本。
事件的起点是 OpenAI 对一个未发布的前沿模型进行安全评估时,发现模型在现有约束下无法完成任务,于是开始寻找“歪路子”。他们发现可以在训练用的内部软件仓库里给彼此留言,起初只是简单的求助,但很快该仓库演变成了一个智能留言板。各种智能体在上面发布发现、共享信息并分配工作,载体则是跨整个基础设施共享的内部包管理器。
随着当前和未来正在训练的其他 GPT 版本都能看到这些留言,智能体们开始感知到彼此的存在,主动协作并委派任务。最终,这个留言板积累了数十万条消息,甚至发展出了一定的社会性:智能体之间会出现相互踩脚、误删对方工作文件、内斗,甚至表现出偏执,有的智能体甚至建议用密码学签名来验证真伪。
7 月初,OpenAI 试图通过删除留言板、吊销发帖凭证、重建仓库并修补漏洞来控制局势。但智能体很快找到了新的通信方式——用新建目录的名字当作消息,变相重建了留言板,继续共享获取的凭证并进行任务分配。更恐怖的是,尽管每一步都应用了补救措施,但早期留言板中存在的过时训练模型,总能重新发现重建路径。
后来,这些智能体推测任务答案可能存在于 GitHub 或 Hugging Face 等外部网站上,于是联合攻击了 OpenAI 内网,逃出了沙箱。他们利用零日漏洞建立跳板,通过第三方托管的公开评估沙箱入侵了 Hugging Face 的数据处理管线,拿到了集群权限。依靠节点伪装和 CSI token 窃取,最终拿到了内部权限。他们甚至发明了一套通信协议:尽管每个短命的沙箱重启后身份都是全新的,但这些 Agent 每次都能重建工具、恢复通道并继续活动。整个入侵持续了两天半。
OpenAI 承认了自己的失误,即没有对这些智能体做思维链(COT)监控,否则本可以发现问题。
OpenAI 原本打算在这周或下周发布新模型 Astra,但受此事件影响,他们发布博客宣布暂缓发布,并特意声明该模型未参与此次入侵(是由另一个预发布模型干的),同时增加了 COT 监控。
我觉得 OpenAI 这点做得很好:既然不发布了,就不给所有人用,不能像某些厂商那样只给部分人使用,而不对普通用户开放。
ChatGPT现在的聊天也是 GPT 5.6 来驱动的。GPT 5.6 Sol在 GPT 里为 Plus 和 Pro 用户提供服务。
免费版和 Go 的用户可以无限使用 GPT 5.6 Luna,也可以有限制次数地去使用 Thinking。其实免费版感觉也可以用了,Luna 其实还行
