📝 草稿——点评尚未人工审核

AI 日报 · 20260814

📌 今日要点

  • Google 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,定位编码与代理场景的 workhorse 模型
  • OpenAI 推出 Ultrafast API 服务层,GPT-5.6 Sol 输出速度最高达 750 tokens/秒(14 倍提升),由 Cerebras 提供算力
  • Claude Code v2.1.232 将子代理 fork 默认开启,fork 子代理继承完整对话历史,会话间可直接通信
  • 微软合并消费者版与 M365 Copilot 应用,8 月 18 日前砍掉 Group Chats、AI 播客、Deep Research 等功能
  • ChatGPT for Mac 新增 Computer History(opt-in),支持跨应用记忆操作,替代此前 Chronicle 功能
1

AI日报 | Google 发布 Gemini 3.7 Flash,距上一代仅三周

## Google 发布 Gemini 3.7 Flash:距上一代仅三周,主打编码与代理性能提升

距离 Gemini 3.6 Flash 发布仅三周,Google DeepMind 于 8 月 13 日推出 Gemini 3.7 Flash,定位为“最智能的劳模型模型”(workhorse model),面向编码和代理场景。

主要改进

  • 编码任务:3.7 Flash 在调试和问题解决上超过 3.6 Flash。FrontierCode 1.1 Main 基准上,首次通过代码准确率从 34.4% 提升至 43.6%;DeepSWE v1.1 上从 49.0% 提升至 65.3%。
  • Web 开发:在 Arena.ai 的 WebDev Arena 中,Elo 评分从 1538 升至 1588,生成功能完整的应用和布局所需提示更少。
  • 知识密集型任务:在 GDP.pdf 基准(处理复杂文档)上得分从 22.0% 升至 34.0%;在 AutomationBench(真实业务工作流)上从 17.0% 升至 30.4%。

开发者体验和价格

模型“思考更仔细”,在多步规划和工具调用上投入更多,减少人工干预和重试次数。

引入价格:输入每百万 tokens 0.75 美元,输出每百万 tokens 3.75 美元,是 3.6 Flash 初始价格的一半。该价格有效至年底。

落地产品

  • Gemini Spark(Google AI Pro/Ultra 订阅用户的 24/7 个人代理)从今天起使用 3.7 Flash,提升 Workspace 工具使用精度。
  • 开发者可通过 Google AI Studio、Android Studio 及 Gemini API 使用;企业可通过 Gemini Enterprise Agent Platform 访问。

安全

更新了针对化学、生物、放射、核(CBRN)和网络攻击的滥用防护。

原文链接

怎么玩:
  1. 可以从3个视角切入:1. 独立开发者关注价格和编码性能提升,可直接提‘输入tokens从xx降到xx’这类数据;2. 大厂实习生关注Spark落地,可强调‘用3.7 Flash的Spark在Workspace中更准确’;3. 研究生关注基准对比,可单列FrontierCode和DeepSWE分数。
编辑点评:
2

OpenAI 推出 Ultrafast 模式,GPT-5.6 Sol 速度提升 14 倍

OpenAI 推出 Ultrafast API 服务层,运行 GPT-5.6 Sol 模型,速度提升最高 14 倍,输出达到 750 tokens/秒。该服务由 Cerebras 提供算力支持。详见:https://openai.com/index/previewing-ultrafast

怎么玩:
  1. 直接引用摘要中的数字(14倍、750 tokens/秒)
  2. 点明硬件提供商 Cerebras
  3. 提供原文链接,无脑补
编辑点评:
3

Claude Code v2.1.232:子代理 fork 默认开启,会话间可直接通信

Claude Code v2.1.232:子代理 fork 默认开启,会话间可直接通信

来源:Claude Code 官方发布页 链接:https://github.com/anthropics/claude-code/releases/tag/v2.1.232

核心变化:

  • 子代理 fork 功能默认打开。subagent_type: "fork" 的子代理会继承完整对话历史与提示缓存;非队友的 agent 在交互式会话中默认后台运行,不影响主线程。
  • 输入 @ 加会话名称可直接引用另一个 Claude 会话,Claude 会通过 SendMessage 直达目标会话,无需手动确认引用。
  • 交互式会话在同一设备上获得唯一名称:若启动或重命名时与已有会话重名,系统会自动添加 -word-word 后缀并提示用户。
  • 新增 /config 行用于设置“对话过期时间”和“来自其他会话的消息”(跨会话消息的接收/暂存/拒绝)。

其他对编程工作流有用的改进:

  • /code-review 在高、极高、最高努力级别下现在也像其他级别一样在后台 agent 运行。
  • 粘贴的剪贴板图片不再阻塞事件循环。
  • /plugin install plugin@marketplace 现在会先刷新市场,确保新发布的插件无需手动更新即可安装。
  • Remote Control 在网络中断后持续重连约 30 分钟,不再因短暂断连而失效。
  • 修复了嵌套 git 仓库继承父目录信任的问题,现在每个仓库都需要独立确认信任。

(完整变更列表见原文链接)

怎么玩:
  1. 直接复制上述 body 内容作为日报条目即可。
  2. 可以加一行简短编者按,如:"对需要并行处理多个子任务的开发者来说,fork 默认开启意味着更顺畅的多路工作流。"
编辑点评:
4

微软合并 Copilot 应用,砍掉 AI 播客、Deep Research 等失败功能

### Microsoft 合并 Copilot 应用,砍掉 AI 播客、Deep Research 等失败功能

微软宣布将合并面向消费者的 Copilot 应用和面向企业的 Microsoft 365 Copilot 应用,同时砍掉多项未能打开市场的 AI 功能。根据 TechCrunch 报道,消费者版本将在 8 月 18 日前失去 Group Chats、AI 生成播客、Copilot Labs 实验功能、Deep Research 以及 Mico 虚拟角色。专业用户仍可在 Researcher 中使用类似 Deep Research 的能力。

这是微软对 Copilot 战略的简化与承认——此前内部备忘录中,Copilot 负责人 Jacob Andreou 表示应用需要“赢得存在的权利”。合并后原有独立应用生成的文件将迁移至 OneDrive。

via TechCrunch

怎么玩:
  1. 如果你在用 Copilot 做研究,8 月 18 日后 Deep Research 会消失,可转向 Researcher 或改用 ChatGPT/Claude 的类似功能。
  2. Mico 角色被砍对日常使用影响不大,但 Group Chats 和 AI 播客的退出意味着微软不再押注社交化 AI 体验。
编辑点评:
5

ChatGPT for Mac 新增 Computer History 功能,可跨应用记忆操作

ChatGPT for Mac 新增 Computer History 功能,替代此前 Chronicle 功能。该功能为 opt-in 选项,允许 ChatGPT 和 Codex 学习并记忆用户在 Mac 上的操作,即使这些操作发生在 ChatGPT 应用之外。

来源:9to5Mac 链接:https://9to5mac.com/2026/08/13/chatgpt-for-mac-adds-opt-in-computer-history-feature-replacing-chronicle/

怎么玩:
  1. 跨应用记忆
  2. Mac 端
编辑点评:
今日小结:今天的关键词是「提速」与「收缩」。Google 把 Gemini Flash 的迭代周期压到三周,OpenAI 用 Cerebras 把推理速度拉到 750 tokens/秒——模型层面的竞争正从「更聪明」转向「更快、更便宜、更适合干活」。代理工作流也在成熟:Claude Code 让子代理 fork 默认开启,补齐了多会话协作的短板;ChatGPT for Mac 则把记忆边界从 App 内扩展到整个系统,向「持久化代理」迈了一步。另一边,微软在 Copilot 上砍掉播客、Deep Research 等功能,合并消费者与企业版本——功能堆砌的时期告一段落,资源在向核心场景集中。方向很清晰:模型更专、代理更持久、产品更聚焦。
AI 日报 · daily.leolee0812.site · 历史日报

订阅到邮箱,每天早上直接看

免费,每天一封,随时可退订。

免费 · 每天一封 · 随时可退订。提交后会收到一封确认信,点了才算订阅。