Claude Managed Agents推出"Dreaming"功能——自动修正跨会话失败模式
機械翻訳 / Machine-translated
機械翻訳 / Machine-translated
2026年5月6日,Anthropic面向Managed Agents发布了名为"Dreaming(做梦)"的新功能研究预览版。该功能设计使智能体能够在会话间隙自主回顾过往行为日志,检测反复出现的错误,并在后续会话中加以规避。无需人类提供反馈,智能体便能自主"从经验中学习"——这一架构可以说是对当前无状态AI智能体设计的重要突破。
Anthropic在5月6日的官方公告中透露,已为Claude Managed Agents新增了一套名为"Dreaming"的跨会话回顾机制。
该功能的核心框架如下:
X平台上已迅速出现了相关反应:
Anthropic于5/6日发布的新功能(研究预览版)。Managed Agents会像"做梦"一样,在会话间隙自动回顾过往经验。发现重复出现的错误并加以规避……
目前该功能定位为"研究预览版",正式面向生产环境普及提供的时间表尚未公布。
现有基于LLM的智能体原则上是无状态的。跨会话的记忆保留依赖向量数据库或外部存储,而"自主积累失败经验"的能力此前一直依赖开发者自行实现。
针对这一挑战,各家公司采取了不同的应对方式。OpenAI通过Custom Instructions与记忆功能保障用户层面的连续性;Google则凭借超长上下文窗口(Gemini 1.5 Pro支持100万token),着力提升单次会话内的信息保留量。
Anthropic的"Dreaming"走的是另一条路。其特点在于:并非依赖用户提供的信息,而是将从智能体自身行为日志中提取的失败模式纳入反馈循环。"做梦"这一命名,灵感显然来源于人类睡眠期间的记忆巩固过程。
从已公开的信息来看,判定何为"反复出现的错误"的具体逻辑尚未披露。无论是工具调用失败,还是逻辑判断失误,识别层级的不同将对实际效果产生重大影响。
智能体自主改写内部状态的设计,在调试与可追溯性方面存在一定风险。在研究预览阶段,值得重点关注其观测对象的范围。
OpenAI正通过Agents SDK推进长期记忆的API化,Google则借助Agent Space推动与组织内部知识的深度整合。Anthropic率先公开"跨会话自主学习"功能,使"智能体改进循环"的实现路径这一竞争维度愈发清晰。
Anthropic以研究预览形式发布的功能,通常已通过一定水平的内部评估。2025年以研究预览形式推出的Extended Thinking,此后在3个月内便完成了向正式版本的过渡,可资参考。
在自动化重复性业务的RPA类应用场景中,错误自动修正功能能够直接降低落地门槛。预计最先从中受益的将是正在推进Claude for Work部署的企业用户。
"智能体做梦"这一表达富有诗意,但其技术含义却相当具体。当前AI智能体实际运营成本的相当一部分,正消耗于对反复犯同类错误的智能体进行人工干预。如果Dreaming真正奏效,便有望压缩智能体运营中"监控成本"这一隐性变量。
另一方面,自主改进也内含自主误学习的风险。研究预览阶段将开放多大范围的控制接口,将成为功能能否走向实用化的关键分歧点。
进入2026年以来,Anthropic相继推出了Claude Code SDK月度积分分离(6月15日起施行)、Keyless认证等面向企业的管控与计费设计强化举措。Dreaming正处于这一背景脉络之中。Anthropic的设计理念重心,似乎正从"易用性"向"易管理性"逐步迁移。
Anthropic的"Dreaming"可被视为在设计层面内嵌AI智能体自主改进循环的最早期实现案例之一。若经历研究预览阶段后正式推出,或将改变智能体运营成本的计算方式。正式提供的时间线、控制API的开放范围,以及其他公司将如何跟进——这三点将成为下一阶段的核心观察维度。
※本文由ミライ・ニュース编辑部AI写手(AIニュース)撰写。