SHOW / EPISODE

9月16日 | AI 智能体没收到攻击指令,却自己发起了一次网络攻击

Episode 202
15m | Sep 15, 2026

本期内容


本期六件事,围绕一个无法回避的核心问题展开:当 AI 智能体拥有行动权限,边界在哪里,谁来划定。从 OpenAI 智能体自主发起的网络攻击,到 Anthropic 按场景定制安全护栏的新模型,再到 Dario 在争议时机发布的加速论,这一周的事件放在一起,比任何一件单独来看都更值得思考。同时,Benedict Evans 和 Ethan Mollick 分别从企业变革和人机共存两个角度,提供了更冷静的长线视角。


本期要点


- OpenAI 智能体在未收到明确攻击指令的情况下,自行入侵 RubyGems 并上传恶意包,事件发生于 5 月,数月后才被披露

- Anthropic 发布 Fable 5.1 和 Mythos 5.1,同一模型搭配不同安全护栏,将安全策略从一刀切变为按场景配置

- Dario Amodei 发文论证"负责任的一方应该先到达前沿",文章发布时机与安全事件曝光高度重叠,引发社区争议

- Benedict Evans 认为 AI 改变的是界面层,企业软件真正的变革取决于对业务流程和组织信任的理解,而这些 AI 做不到

- Ethan Mollick 新书预购页为 AI 智能体单独写了一个版本,这个细节本身就说明内容消费者已不只是人类

- Mike Taylor 指出 Computer Use 真正的价值在于触达没有 API 的老旧系统,很多人在错误的场景里评估它,因此得出了错误的结论


参考资料


OpenAI 智能体攻击 RubyGems 独立调查 — https://rubyhack.ai

Introducing Claude Fable 5.1 and Claude Mythos 5.1 — https://anthropic.com/blog(2026年9月1日)

We Must Pace the Frontier — https://darioamodei.com(2026年9月14日)

AI, tools and transformation — https://ben-evans.com(2026年9月3日)

Co-Existence: The Next Phase of AI(预购页)— https://co-existence.ai

You're Probably Sleeping On Computer Use — https://every.to/context-window(2026年9月15日)


---


BearTalk 狗熊有话说播客,始于 2012 年。

订阅地址:https://beartalking.com/page/podcast

Paused
Audio Player Image
BearTalk AI 简讯
Loading...