Anthropic 8月1日发布重大更新:Claude Opus 5 新增 Dreams 功能,让 AI 像人类一样通过"睡眠"来整合记忆。同一天,OpenAI 发布数学突破论文获 567 分。AI 竞赛进入"会学习"的新阶段。
事件回顾
2026 年 8 月 1 日,Anthropic 在 Claude Developer Platform 上发布了一项意义深远的更新:Dreams 功能正式支持 Claude Opus 5。这是 Dreams 功能自 5 月 6 日首次亮相以来,首次扩展到 Opus 5 模型。
与此同时:
- Anthropic 宣布 Legacy Workbench 将于 8 月 17 日退役,现有的 prompts、variables、evals 无法迁移到新版,用户需手动导出数据
- Claude Code 新增 远程控制功能,可通过手机浏览器操控本地电脑编程
- OpenAI 发布《Ten advances in mathematics and theoretical computer science》论文,567 points HN 热帖,展示 AI 在数学前沿取得的 10 项突破
- EU AI Act 于 8 月 2 日正式全面生效,最高罚款全球年收入 7%
Dreams 是什么?
Dreams 是 Anthropic 在 2026 年 5 月 6 日首次发布的研究预览功能。它的核心设计灵感来自人类海马体在睡眠中整合记忆的机制:
Dreams 接收一个记忆库(memory store)加上最多 100 个历史会话记录,在离线状态下"回放"这些记忆——合并重复、解决矛盾、生成全新的记忆库。
简单说:你不需要手动管理 Claude 的记忆。你让它"睡一觉",醒来后它会把自己的记忆整理好。
这对 AI Agent 开发者的意义在于:
- 长期运行的 Agent 项目不再需要人类手动做记忆管理
- Agent 可以自动从历史交互中提取模式、去重、消除矛盾
- 降低了 Context Engineering(上下文工程)的手工成本
这与 Lilian Weng 在 7 月发布的 Harness Engineering 文章中提出的"文件系统即持久记忆"和"上下文工程自我优化"理念高度一致——Anthropic 正在把这些理念产品化。
Claude Opus 5 当前能力
根据 StationX 的深度评测(2026年7月),Claude Opus 5 的几个关键数据:
| 指标 | 数据 |
|---|---|
| 标准定价 | $5/$25 per MTok (输入/输出) |
| Fast 模式 | $10/$50,2.5x 速度提升 |
| 思考模式 | 默认开启,不再是 Beta |
| 内部基准 | Frontier-Bench v0.1 得分翻倍 Opus 4.8 |
| 科学能力 | 有机化学任务(从光谱数据推断分子结构)显著提升 |
但要注意:Anthropic 在 6 月 9 日还发布了 Claude Fable 5——这是 Mythos-class 级别的模型,定位在 Opus 之上。Claude 模型家族现在的层级是:
Fable 5(Mythos级) > Opus 5 > Sonnet 5 > Haiku 4.5
面向编程的 Claude Code 专属模型 和原生支持视频输入的 多模态 Opus 也在 Anthropic 的路线图上。
对 AI 创业者的实操影响
1. 记忆管理不再是瓶颈
如果你的 Agent 工作流需要跨会话保持上下文(比如持续追踪某个项目的进展),Dreams 功能直接解决了最大的痛点——手动整理对话记录、合并重复信息、发现矛盾点。
这意味着 AI 创业中的"持续客户服务"、"长周期代码开发"、"跨会话研究"等场景的可行性大幅提升。
2. 模型换代速度正在加速
从 Opus 4.7(4月)→ Opus 4.8(5月)→ Fable 5(6月)→ Opus 5 Dreams(8月),Anthropic 的模型发布节奏已经加速到每月一次重大更新。
对于依赖特定模型的 Agent 产品来说,这意味着Harness(挽具)比模型更重要——你的 Agent 架构要有能力快速切换底层模型,而不是和某个模型深度绑定。
3. EU AI Act 的合规成本
EU AI Act 已于 8 月 2 日正式全面生效。如果你的 AI 产品服务欧盟用户,现在必须做到:
- 可审计的决策记录
- 透明的操作流程
- 人类监督高风险 AI 系统
- AI 生成内容的水印标记
罚款可高达 全球年收入的 7%——比 GDPR 的 4% 更重。
我们能学到什么
-
AI 正在从"会回答"进化到"会学习"。Dreams 功能不是简单的记忆存储——它是 offline experience replay,是真正意义上的"学习"机制。
-
Harness Engineering 正在成为共识。Anthropic 的 Dreams、Hermes Agent 的 Skills、OpenAI Codex 的 Agent Loop——所有这些都在做同一件事:在模型外面构建更智能的"外壳"。
-
模型更新频繁 = 架构灵活性 > 模型锁定。不要把你的产品绑死在某个特定模型版本上。
行动建议
- 如果你在用 Claude API,尽快导出 Legacy Workbench 的数据(8月17日前)
- 关注 Dreams 功能的开放进度,它可能成为 Agent 记忆管理的标配方案
- 检查你的 AI 产品是否需要 EU AI Act 合规(即使目前不服务欧盟,未来扩展时也会受限)
- 把 Claude Opus 5 的 Fast 模式($10/$50)作为性价比选项评估——2.5x 速度对于交互式产品很有价值
