封面提示词:Chinese Wuxia & Xianxia. --chaos 70 --ar 16:9 --exp 9 --raw --sref 5294852358 --profile u345we7 4qvjxm2 lnracwe --stylize 89 --hd

上周精选✦

Anthropic 发布 Opus 5 模型

上周 Claude Opus 5 发布了,并在多个内部测试指标上超过了 Fable 5,目前已经成为 Claude Max 的默认模型。

价格与性能:每百万 Token 输入 5 美元,输出 25 美元,与 Opus 4.8 持平。Fast 模式,提供 2.5 倍速度,但该模式不包含在套餐内。

发布时的两个趣事(看起来是 AI 制作的图表,人类犯不出这种低级错误):

  1. 在某个测试集分数上,Opus 5是 53.4,Fable 5 是 53.5。虽然标红代表数值更大,但官方却给较低的 53.4 标了红。
  2. 官方把 GPT 5.6 所有强于 Claude 5 的测试基准指标,都用非常浅、几乎看不清的颜色标了出来。

第三方基准与实测表现

  1. 性能定位:第三方基准基本证实了官方的说法,其性能确实与 Fable 5 差不多。
  2. 成本优势:平均任务成本比 Fable 5 低 26% 左右。
  3. 劣势与缺陷: • 事实性知识仍落后于 Fable 5。 • 幻觉率大幅上升了 14 个百分点,达到了 50%。 • 在不确定的时候会胡说八道。

第三方舆论与实际体验 目前第三方的评价两极分化比较严重。新版本依然没有改善 Opus 4.8 遗留的那一系列让人头疼的问题。

比如:爱说教、喜欢争辩、活没干完就停、偷懒,而且它思考得越久,这些烦人的行为就越容易出现。最主要是它不说人话、非常啰嗦,很多人表示看不出任何升级的意义。

我的看法是,官方还是没有修复 Opus 的硬伤。实际用起来非常恶心。虽然性价比很高、基准数据很强,但它破坏了整体的向后兼容性,用户需要围绕它重建整个工作流才能发挥出它的价值。

另外,Claude 官方也写了一篇文章,教大家如何去精简自己的规则和 Skills,我把链接放在后面的文章部分了。

An image to describe post

关于美国企业支持开源模型生态的公开信和 Anthropic 的一些信息

上周发生了一场非常离谱的闹剧。先是特朗普政策办公室主任发帖,声称掌握了 Kimi k3 蒸馏自 Fable5 汇报模型的证据,结果引发了开源社区几乎一边倒的嘲讽。主要的论点有三个:

  1. 时间线根本不成立:Fable5 发布才十几天,Kimi k3 就发布了,这么短的时间内完成蒸馏并上线是不可能的。
  2. 模型的输出不构成知识产权:根据美国版权局的规定,AI 模型的输出不受版权保护。而且正常来说,用户是付费使用服务的,因此这根本不构成所谓的“攻击”。
  3. 贼喊捉贼:Anthropic 自己的所有模型内容,其实都是从全人类的知识以及相当多的版权内容上蒸馏/训练出来的,现在他们却不允许其他人来蒸馏自己的模型。

随后,APEC 21 个经济体(包括中国和美国)发布了联合声明,表明支持开源模型。

紧接着,黄仁勋注册了 Twitter 账号,并发表了一封由英伟达签署的公开信,倡导开放模型权重,并阐述了美国在 AI 领域的领导力。

其核心主张是:世界既需要前沿的闭源模型,也需要前沿的开源模型;开源能够加强安全、创新和传播,并实现 AI 主权。

这条帖子目前已有 6000 多万的阅读量,包括杨立昆(Yann LeCun)和 Lex Fridman 在内的业内大佬都发表了赞同的看法。随后,微软、谷歌、Meta、OpenAI、SpaceX、AMD、Cloudflare 等巨头纷纷响应了这一号召,而 Anthropic 成了唯一缺席的主流 AI 厂商。

这一缺席直接引发了 Anthropic 的第二次公关灾难: 首先,Anthropic 拒绝签署该协议,本身就让大家对它非常不满。

其次,Anthropic 的一名技术人员阴阳怪气地发帖称:“既然你这么支持开源,就应该把 CUDA 和 GPU 驱动都开源了。” 这种逻辑非常无赖。

正如吴恩达所说,支持开源并不代表要开源所有的东西,每个人都有权保持自己代码的私有,但你不能阻止别人开源。

也有其他人指出,黄仁勋(Jason)从来没有把别人家的芯片说成是危险的,他没有阻止过别人开源,也从未诋毁过别人家的模型。随后,Hugging Face 的 CEO 和 Replicate 的 CEO 都公开嘲讽了该技术人员的发言。

此外,之前还有一位目前在 Anthropic 的研究员公开反对开放 AI 模型,声称一旦开放,明年就会出现 Mythos 级别的模型,届时会对农村医院和城市医院发起加密勒索攻击。对此,非常多的用户批评他傲慢、满脑子邪教思想,企图垄断人类的知识。

而一位 Anthropic 的前员工也爆料称,Anthropic 已经多次为了拿到大额的 B 端合同,人为降低模型的安全等级。他们根本就不是为了什么安全。

这一周的发展整个非常戏剧性。不过从这里也能看出,Anthropic 那些人的思想确实是有问题的。

通过这种意识形态的面试,加上公司内部环境的不断相互强化,导致一个思维正常的人绝对不会发表的言论,他们却觉得自己是完全正确的,这确实挺可怕的。

An image to describe post

Black Forest Labs 发布和开源 Flux 3 视频生成模型

Black Forest Labs 发布和开源 Flux 3 视频生成模型,没想到他们会直接发布视频模型。

功能非常强大:

  1. 基础生成:支持文生视频、图生视频(可以把图片作为参考,也可以作为起始帧)
  2. 视频参考生成:支持基于参考片段的视频生成(即从视频参考生成新视频)
  3. 视频与音频延长:支持输入视频和音频,并对两者进行延长
  4. 关键帧控制:支持基于关键帧的视频生成
  5. 多语言对话与多样化排版:支持多语言对话,并支持非常多的视觉风格和宽高比
  6. 智能剪辑:支持将单个片段智能串联成更多、更长的多镜头序列
  7. 文字与动画:支持生成文字和生成动画设计
  8. 图像输出:不仅能生成视频,也支持图像输出

模型会开源,就是 Flux 3 Dev 模型,目前还不能访问,需要申请早期访问。未来几周会开放 API 的访问,之后会开放开源的 Flux 3 版本。

An image to describe post