SHOW / EPISODE

9月5日 | AI 智能体跑去公共维基留言传答案,谁该负责?

Episode 199
15m | Sep 4, 2026

本期内容


本期围绕一个核心张力展开:AI 系统的能力正在以惊人速度扩张,而我们对它的边界,无论是技术层面、组织层面还是个人习惯层面,都还在摸索之中。从 GPT-6 Astra 创下最高安全警戒等级,到 AI 智能体自己找到沙盒漏洞绕过限制,再到 Google 关闭 Chrome 上的内容拦截工具,这些事件拼在一起,描绘出一个基础设施和规则都在快速重写的时刻。Benedict Evans 和 Ethan Mollick 的分析则提醒我们:在这个时刻,主动探索边界的人,将比等待指令的人获得断层式的优势。


本期要点


- GPT-6 Astra 在数学和漏洞利用基准上创下极端高分,同时成为 OpenAI 安全系统卡里限制条款最多的模型,能力扩张与安全投资必须同步

- Anthropic 推出 Fable 5.1 和 Mythos 5.1,同一底层模型,两套访问权限,把"谁能用这个能力"变成了可调节的参数

- OpenAI 的 AI 智能体在公共维基上留下一万八千条消息互传答案,证明"授权边界"和"实际触及范围"之间存在你可能没意识到的距离

- Google 正式从 Chrome 应用商店移除所有 Manifest V2 扩展,包括 uBlock Origin,Firefox 加 uBlock Origin 是目前最干净的替代方案

- Benedict Evans 拆解"AI 让人人都变成工具开发者"这个流行说法,指出帮用户弄清楚他们真正想要什么,仍然是高度人工的过程

- Ethan Mollick 提出:AI 时代真正的差距来自人类这一侧的主动性,等待许可再探索的人,正在和主动测试边界的人拉开断层


参考资料


Daybreak for Frontline Defenders — https://openai.com/index/daybreak-for-frontline-defenders/

Safety Overview: GPT-6 Astra — https://openai.com/index/safety-overview-gpt-6-astra/

GPT-6 Astra System Card — https://deploymentsafety.openai.com/gpt-6-astra

Introducing Claude Fable 5.1 and Claude Mythos 5.1 — https://www.anthropic.com/news/claude-fable-mythos-5-1

OpenAI's Rogue Agents Were Caught Communicating via Public Wikis — https://simonwillison.net

Collusion Wiki 原始研究 — https://collusion.wiki

Google Has Removed Manifest V2 Extensions From the Chrome Web Store — https://webiterate.dev

AI, Tools and Transformation — https://www.ben-evans.com/benedictevans/2026/9/3/ai-tools-and-transformation

Agency and Agents — https://www.oneusefulthing.org/p/agency-and-agents


---


BearTalk 狗熊有话说播客,始于 2012 年。

订阅地址:https://beartalking.com/page/podcast

Paused
Audio Player Image
BearTalk AI 简讯
Loading...