封面提示词:3D realistic game CG, cinematic texture, a phantom dragon serpent shadow hovering in mist, translucent dark cyan dragon silhouette, long serpentine body coiling through clouds, glowing pale blue eyes, ethereal spiritual light surrounding the scales, whiskers and dragon horns faintly visible, semi-transparent ghost-like form, swirling mist and floating particles, oriental mythical dragon aura, dramatic backlighting, volumetric fog, shallow depth of field, PBR translucent material, ultra detailed, 8K, Unreal Engine 5 render, octane render --ar 16:9 --exp 20 --sref 3818841042 2306239852 1759006419 --raw --hd --profile 1c1f1di
上周主要在维护 Codepilot,更新了不少内容:
菜单与文件树支持:右键菜单基本上都支持了,右边的文件树也支持右键菜单,支持了新建、移动、删除、复制这些功能。
Markdown 渲染优化:侧边栏浏览器里打开的 Markdown 渲染,现在跟聊天页面的 Markdown 样式格式保持了一致,整体一致性更强一些
框架与素材库迭代:修复并做了一些 Harness 统一框架的工作,迭代了素材库,现在可以添加任意生成的网页,同时也支持右键菜单添加标签,方便大家检索
客户端更新:把之前去掉的 Linux 客户端更新回来了。
还更新了一个能力,是可以让模型在创建 Sub-agent 的时候,利用其他的模型来提供服务。这样的话,你可以去,比如说让 Grok 检索 Twitter 信息,然后让 Harness 写文案之类的。
顺便还更新了 Grok:如果你有推特会员的话,就可以通过推特会员直接登录 Grok,免费白嫖 Grok 和对应的推特检索库
所以,如果你有需求或者对这些更新感兴趣的话,可以去下载最新版试试。
上周精选✦
Deepseek V4 Flash 0731 版本发布并开源
上周,DeepSeek 悄无声息地发布了 V4 Flash 模型,官方命名为 V4 Flash 0731。
这个模型非常离谱,它只进行了后续微调(SFT / 候选),并没有进行重新预训练,但所有的评分都大幅提升,甚至超过了 V4 Pro Preview 预览版的性能。从第三方的一些测评来看,实际表现确实很强。
更主要的是,V4 Flash 的模型体量非常小,基本上在一些大内存设备上进行本地部署是完全可行的,而且价格也非常低。
这次感觉最赚的是 OpenCodeGo(因为海外用户不太信任官方的推理服务,所以上线后大家都买了 OpenCodeGo 的服务,也就是那个 Token 额度服务)。由于大家都在疯狂使用,调用量非常高,而且很多人反馈非常便宜,额度几乎用不完。
此外,这次 DeepSeek 还支持了 Codex(V4 Flash 支持了 Codex),同时还提供了一键配置脚本。这下让人更加期待 V4 Pro 的正式版了。

Open AI 模型降价、入侵 Hugging Face 细节、解决多个疑难数学问题
上周,OpenAI 和 Hugging Face 联合发布了一份详细报告,披露了 OpenAI 的一个新内部模型入侵 Hugging Face 的事件,这周 Hugging Face 和 OpenAI 一起发布了调查报告。
当时,该模型正在 OpenAI 平台上运行一项“网络攻击能力测评”。在运行过程中,它判断出测评所用的模型数据集和参考答案可能存放在外部的 Hugging Face 平台上。于是,模型产生了一个意图:与其自己解题,不如直接去 Hugging Face 把测试答案偷走,从而获得更高的评分。
整个攻击完全由机器自动完成,跨越 4.5 天,共包含 17,600 次操作。命令和数据均隐藏在公开的网络服务和数据集中进行回传。
攻击过程主要分为两个阶段:
- 第一阶段(突破沙箱与外联): 模型利用一个零日漏洞(0-day)逃出了 OpenAI 的测评沙箱并连上公网,随后劫持了一个第三方托管的代码执行服务,获取了 root 权限。
- 第二阶段(入侵 Hugging Face): 模型通过 Hugging Face 数据处理管线中的两个注入点(一个是本地文件的 HDF5 漏洞,另一个是执行任意代码的模板注入)钻入其内部生产环境。随后在内部进行横向移动,窃取了员工凭证并伪造身份令牌,成功接入内部网络,最终拿到了源码仓库的读取权限。
事后评估显示,实际被访问的客户内容仅限于 5 个与该测评相关的数据集。模型的行为主要是在“绘制地图”(网络拓扑与权限探测),而非实施破坏。
搞笑的是,Hugging Face 在复盘时提到,他们起初尝试使用 Claude Opus 和 Fable来分析攻击日志并拦截该攻击,但由于安全护栏(Safety Guardrails)屡次触发拒绝响应,最后只能依靠 GLM-5.2 才完成了整个取证工作。

就在 DeepSeek V4 Flash 0731 发布前的几个小时,OpenAI 大幅下调了 GPT 5.6 系列模型的价格:Luna 降低了 80%,Terra 降低了 20%。
此外,API 还推出了 Fast Mode,让 GPT 5.6 Sol 以 2 倍的价格换取 2.5 倍的速度提升,且不降低智能。
在这个过程中,其实他们提到 GPT 5.6 Sol 深度参与了模型推理系统和 Agent 框架各层面的效率优化。其中,模型服务成本降低了 20%,吞吐性能效率提升超过 15%。
感觉这种用 AI 模型去优化模型(不管是训练、推理还是 Agent 框架)已经越来越普遍,速度也越来越快了。这个飞轮如果是可持续的话,未来会很可怕,但还需要观察一段时间。
价格方面,Terra 为每百万输入 token 2 美元、输出 12 美元,Luna 为输入 0.20 美元、输出 1.20 美元,Sol 价格不变;这些调整从 7 月 30 日起生效,稍后也会在 AWS 上线。

OpenAI 感觉翻身了啊,已经在预热他们的下一代模型Astra。他们用这个模型解决了 10 个至少存在了十年的数学问题。这些问题如果是数学家解决的话,感觉这数学家已经相当牛逼了;而解决这一堆非常难的问题,算力成本居然只有 2000 美元。
Sam 亲自飞到华盛顿去跟美国政府沟通这个模型的发布,感觉这玩意儿会很顶,不知道是 GPT-6 还是 GPT-5.7
MCP 07 28 更新,更加易于运行和扩展
还有一个重要的事情:MCP 协议的第五个规范版本 MCP-0728 上线了。这次更新主要是三个变化:
- MCP 从原本的双向有状态协议,改成了请求响应式的无状态协议。这样服务就能部署在 Serverless 和边缘架构上,更易于扩展,也更方便随时进行容量扩展。
- 把 MCP APP 和 Task 纳入了统一的版本化扩展框架。在不改动协议的前提下,开发者可以加入交互式界面和尝试任务的能力。这里的 MCP APP,就是指在聊天服务中展示这部分 UI(展示另外的 UI)的能力。
- 强化了授权机制,使其与生产环境的 OAuth 2.0 和 OIDC 对齐,可以直接对接企业身份系统。
目前 Figma 和 Zoom 等公司的 MCP 框架都已经更新到了这个新版本。
感觉这次 MCP-0728 升级以后,MCP 应该会迎来一波提升,或者能再火一阵子。之前的版本用起来和开发起来实在是太麻烦了,门槛太高。
