8月1日 | AI 一个月修完了两年的安全漏洞
本期内容
这期节目覆盖了 AI 在五个截然不同领域里正在发生的真实变化:从模型参与优化自身运行成本、到 AI 工业化安全审计、再到开源阵营加速追赶闭源定价。同时也有两个更偏思考性的话题:AI 设计美学正在形成怎样的视觉符号体系,以及一个新基准如何重新定义"AI 能独立完成多大的编程项目"。听完这期,你会对 AI 渗透进基础设施、安全、设计和开发流程的方式,有更具体的感知。
本期要点
- GPT-5.6 Sol 参与了自身运行效率优化,OpenAI 将成本收益直接转为 API 降价,AI 开始影响自己的商业模式
- Google Chrome 安全团队 2026 年 6 月借助 AI 修复的漏洞数量,超过了过去两年总和,防守方规模上限被重写
- DeepSeek-V4-Flash 开放权重上传 Hugging Face,小团队可本地部署,开源阵营正在压缩闭源定价窗口
- Jim Nielsen 指出 AI 产品正在形成统一设计语言,✨ 符号从"魔法"被劫持为"营销",设计师需要有意识地做判断
- MirrorCode 基准测试让 AI 在看不到源代码的情况下重写完整程序,衡量的是自主工作范围而非单点能力
参考资料
Advancing the price-performance frontier with GPT-5.6 — https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/
How enabling two settings tripled our scores on the ARC-AGI-3 benchmark — https://openai.com/index/how-two-settings-tripled-our-arc-agi-3-scores/
Stronger with every update: How we're making Chrome and the web safer in the AI Era — https://security.googleblog.com/
DeepSeek-V4-Flash-0731 on Hugging Face(via Simon Willison)— https://simonwillison.net/
The AI Aesthetic — https://blog.jim-nielsen.com/
MirrorCode benchmark(Import AI #466, Epoch AI & METR)— https://epoch.ai/MirrorCode
---
BearTalk 狗熊有话说播客,始于 2012 年。
订阅地址:https://beartalking.com/page/podcast
