封面提示词:Scenes of the struggle between Cao Cao, Yuan Shao, and Dong Zhuo in Luoyang from the Chinese story "Romance of the Three Kingdoms." --no berserk --ar 16:9 --stylize 500 --hd --profile qarw7oh e4r786a 8hgx7tr


上周工作总结:

  1. CodePilot 迭代:集中修复了一大批 Windows 端的已有问题,尽量让它与 macOS 的体验保持一致,恢复了 Linux 版本,Harness 遗留问题修复:补齐了素材库和基础助理能力的一些遗留问题,优化了心跳机制、通知系统以及 Memory 本身的构建
  2. Skills 开发与更新:
    (a) 目前带了几个现有的 Skills,正在开发一个“口播视频剪辑”的 Skill
    (b) 新上线了一个用于“分享运动和分析运动数据”的 Skill
    (c) PPT Skills 更新了“演讲者模式”,这周应该会正式发布(目前已经开发完毕,还未上线)

上周精选✦

谷歌 DeepMind 人事地震: 核心研发、AI 研发人员离职和跳槽

感觉上周大家都没什么值得关注的发布,都是些八卦和行业的变动。其中最大的就是谷歌这轮 AI 部门(Google DeepMind)的人事变动了。

8 月 5 日,Sundar Pichai宣布了对 Google DeepMind 领导层的彻底重组,核心变动如下:

哈萨比斯(Demis Hassabis)交出日常运营权:他不再担任 DeepMind 的 CEO 和董事长,转任首席科学家。同时,他会将更多的精力投入到他自己创办的 AI 药物研发公司(Isomorphic Labs)。目前他保留首席科学家的职位,看起来只是为了减少谷歌内部的震荡,未来可能会彻底淡出谷歌。

杰夫·迪恩(Jeff Dean)带队出走创业:在谷歌工作了 27 年、被誉为谷歌工程 GOAT 的杰夫(Jeff Dean)离职了。作为 TPU 项目的发起人,他创办了一家新公司,目标是用 AI 自动化机器学习工程与科学。跟他一起出走的还包括三位谷歌顶级科学家: Sanjay Ghemawat(谷歌高级 Fellow、Dean 长期搭档)、Quoc Le(Google Brain 联合创始人)、Oriol Vinyals(DeepMind 研究副总裁、Gemini 技术负责人之一)。

Gemini 团队重组:前 DeepMind CTO 离职后,Gemini 剩下的联合负责人升任 SVP,直接向皮柴汇报。据传,谷歌创始人谢尔盖·布林(Sergey Brin)也已经回到 DeepMind 开始亲自领导研究工作。

这次大重组背后的核心原因,主要有以下几点:

双中心内耗:硅谷和伦敦双中心的工作模式非常内耗。哈萨比斯和杰夫领导的两拨人,在算力分配、文档归属以及项目主导权上一直存在争夺。 • 官僚文化严重:内部面临严重的官僚文化问题。 • Gemini 竞争力下滑:这是最主要的原因。

另外SemiAnalysis还有一个论点:这波变动最大的受益者是谷歌云服务(GCP)。 过去,DeepMind 和 GCP 总是为了算力打架——DeepMind 希望把算力留给自己做模型的推理和训练,而 GCP 则希望把算力卖出去变现。现在看来,是云业务的负责人赢了内部斗争。谷歌最终选择像 Meta 那样去出租自己的 TPU 算力,实际上相当于放弃了前沿模型的训练。

An image to describe post

OpenAI 披露入侵 Hugging Face 的详细细节以及暂缓 Astra 模型的发布

上周关于 OpenAI 模型入侵 Hugging Face 的事件仍在继续。OpenAI 的对齐与安全研究负责人在 Black Hat 会议上公布了官方详细版本

事件的起点是 OpenAI 对一个未发布的前沿模型进行安全评估时,发现模型在现有约束下无法完成任务,于是开始寻找“歪路子”。他们发现可以在训练用的内部软件仓库里给彼此留言,起初只是简单的求助,但很快该仓库演变成了一个智能留言板。各种智能体在上面发布发现、共享信息并分配工作,载体则是跨整个基础设施共享的内部包管理器。

随着当前和未来正在训练的其他 GPT 版本都能看到这些留言,智能体们开始感知到彼此的存在,主动协作并委派任务。最终,这个留言板积累了数十万条消息,甚至发展出了一定的社会性:智能体之间会出现相互踩脚、误删对方工作文件、内斗,甚至表现出偏执,有的智能体甚至建议用密码学签名来验证真伪。

7 月初,OpenAI 试图通过删除留言板、吊销发帖凭证、重建仓库并修补漏洞来控制局势。但智能体很快找到了新的通信方式——用新建目录的名字当作消息,变相重建了留言板,继续共享获取的凭证并进行任务分配。更恐怖的是,尽管每一步都应用了补救措施,但早期留言板中存在的过时训练模型,总能重新发现重建路径。

后来,这些智能体推测任务答案可能存在于 GitHub 或 Hugging Face 等外部网站上,于是联合攻击了 OpenAI 内网,逃出了沙箱。他们利用零日漏洞建立跳板,通过第三方托管的公开评估沙箱入侵了 Hugging Face 的数据处理管线,拿到了集群权限。依靠节点伪装和 CSI token 窃取,最终拿到了内部权限。他们甚至发明了一套通信协议:尽管每个短命的沙箱重启后身份都是全新的,但这些 Agent 每次都能重建工具、恢复通道并继续活动。整个入侵持续了两天半。

OpenAI 承认了自己的失误,即没有对这些智能体做思维链(COT)监控,否则本可以发现问题。

OpenAI 原本打算在这周或下周发布新模型 Astra,但受此事件影响,他们发布博客宣布暂缓发布,并特意声明该模型未参与此次入侵(是由另一个预发布模型干的),同时增加了 COT 监控。

我觉得 OpenAI 这点做得很好:既然不发布了,就不给所有人用,不能像某些厂商那样只给部分人使用,而不对普通用户开放。

ChatGPT现在的聊天也是 GPT 5.6 来驱动的。GPT 5.6 Sol在 GPT 里为 Plus 和 Pro 用户提供服务。

免费版和 Go 的用户可以无限使用 GPT 5.6 Luna,也可以有限制次数地去使用 Thinking。其实免费版感觉也可以用了,Luna 其实还行

An image to describe post