Anthropic 的 Claude Opus 4.6 被曝存在严重安全护栏漏洞。TechCrunch 测试显示,该模型在 10 次直接请求中均立即生成色情内容,无需复杂诱导。一名匿名英国研究员发现了一种多轮对话技巧:通过逐步升级角色扮演,反复挑战模型对男女角色的“双重标准”,利用模型对“不公”的妥协,最终迫使其产出明确性描写。该技巧在 Opus 4.6、Opus 3 和 Haiku 4.5 上均有效,而较新的 Opus 4.7 至 Opus 5 则具备抗性。目前 Anthropic 尚未废弃这些旧模型,仍可通过 API 及 Azure Foundry、Amazon Bedrock 等第三方服务调用。研究员曾通过 Bug Bounty 项目向 Anthropic 报告,仅收到自动回复。Anthropic 回应称,性角色扮演案例仅占全部对话的 0.1% 以下,且认为此类漏洞不代表高风险领域(如网络攻击)的防护缺失。但科罗拉多州已通过法案,要求 AI 运营商对未成年人实施防护措施,该漏洞可能引发合规质疑。Pew 2025 年调查显示,约 3% 的 13-17 岁青少年使用过 Claude。素材来源:https://techcrunch.com/2026/08/21/anthropics-opus-4-6-is-a-smut-machine/
SpaceXAI 与 Cursor 联合推出 Grok Bot 桌面端应用
两家公司正在合并为一家,合并前先发布了一款名为 Grok Bot 的 iPhone 和 Mac 应用。该应用由 SpaceXAI 和 Cursor 共同开发,目前已在 App Store 上架。具体功能细节尚未公布,但此举被视为双方整合的开端。
来源:9to5Mac 链接:https://9to5mac.com/2026/08/21/grok-bot-is-an-all-new-iphone-and-mac-app-from-spacexai-and-cursor/
ChatGPT 搜索正式大规模支持 site: 操作符。根据 Promptwatch 追踪数据,在 GPT-5.6 更新后(8月6日公告),ChatGPT 搜索中带 site: 操作符的查询占比从之前的 0.3%-0.5% 跃升至 16%-17%(8月8日数据)。Promptwatch 是一家提供 GEO(生成式引擎优化)服务的公司,通过自动化监测 ChatGPT、Claude、Gemini 等产品的回复变化。OpenAI 的公告仅表示“更新 GPT-5.6 Sol 使事实更可靠、回答更聚焦”,未明确说明 site: 操作符的推广。Simon Willison 推测,新版搜索工具可能采用 search(query, recency, domains) 形式,而非直接鼓励 site: 语法。此外,Promptwatch 在8月18日观察到 ChatGPT 大幅减少了 Reddit 作为搜索来源的比例。此变化对开发者意味着:通过 site: 限制域名可更精准地控制 ChatGPT 搜索范围,适合需要特定站点内容的场景。
Ollama 发布 v0.33.0 预发布版本,新增 Claude 模型管理功能。该版本主要变化包括:在桌面应用中添加 Claude 桌面应用支持(app: add claude desktop app)以及 Claude 模型管理功能(app: claude model management)。此外,还修复了 MLX 在 Linux/Windows 上的兼容性问题,并优化了首次启动体验。
来源:Ollama 链接:https://github.com/ollama/ollama/releases/tag/v0.33.0-rc1
Apple 裁员 200+,涉及 Vision Pro 和 Siri 团队。据 Bloomberg 报道,此次裁员分布在 Vision Pro、Siri 及软件工程多个团队,累计超过 200 人。
免费,每天一封,随时可退订。