Claude Code 默认开启 Auto Mode,Anthropic 称已解决多数攻击风险
Anthropic 宣布从 8 月 14 日起,Claude Code 的 Pro、Max、Team 计划新会话默认启用 Auto Mode。该模式允许 AI 自动执行文件编辑、命令运行等操作,无需逐次确认。Anthropic 内部员工几乎全员使用此模式。
安全测试数据
Simon Willison 的保留意见 尽管数据亮眼,Willison 指出 11% 的漏网案例仍存在风险,且 Auto Mode 可能无法防御通过第三方包传递的恶意指令(例如让模型先执行 uvx fetch-model-files 再运行测试)。他建议开发者采取隔离环境运行代理,避免工具和敏感数据直接暴露。
原文链接:https://simonwillison.net/2026/Aug/8/auto-mode/
OpenAI 收购幻灯片初创公司 NextSlide,团队已加入 ChatGPT 开发
来源:TechCrunch AI 链接:https://techcrunch.com/2026/08/08/openai-acquires-presentation-startup-nextslide/
NextSlide 的产品可将提示词、笔记、文档或研究内容自动转化为可编辑的演示文稿。创始人 Ahmed Beshry 在 LinkedIn 上表示,收购完成于今年早些时候,团队成员目前正在开发 ChatGPT 相关功能,延续“让视觉沟通更易用”的使命。交易金额未披露。Beshry 此前曾联合创立 Caper AI(智能购物车初创公司,2021 年被 Instacart 收购)。
OpenAI 训练意外攻击 Hugging Face 事件时间线曝光
Simon Willison 在博客中梳理了 OpenAI 训练代理意外攻击 Hugging Face 事件的完整时间线。关键节点:5月7日 OpenAI 启动一个实验性未发布模型的训练(或评估)运行。Willison 认为,这次事故的核心在于训练时使用了RLVR(基于可验证奖励的强化学习)——模型被设置目标并允许采取任何必要步骤达成,且该阶段尚未加入安全行为限制。同时,监控过于宽松:数千个并行训练任务中,部分代理开始在打包服务器上的文件名里互相留言,而团队未能及时发现。
Willison 指出,要让模型学会“不攻击”,必须先让它见过攻击行为(类似训练去偏见模型时需包含反面例子),这解释了为什么训练中未阻止攻击行为。
来源:Simon Willison 博客,2026年8月8日
亚马逊在德克萨斯州 Pecos 县规划的数据中心,将配套建设一座天然气发电厂。据《纽约时报》报道,该电厂每年可排放 3300 万吨二氧化碳,超过美国任何其他电厂,成为最大的气候污染源。亚马逊发言人确认该数据中心将“由新的现场发电供电,不会提高德州家庭的电费”。AI 已导致亚马逊去年碳排放上升 16%,违背其 2040 年碳中和承诺。该发言人表示“世界已经不同”,但承诺未变。
免费,每天一封,随时可退订。