Long-Running Agents

一句话:跨天/跨周持续运行的 Agent —— 需要显式的 memory / harness / checkpoint / retry 机制,才能超越 Chat 式短会话的能力上限。是 Harness-Engineering 的一个核心应用面。

与 Chat Agent 的关键区别

维度Chat Agent(短会话)Long-Running Agent
时间尺度秒-分钟小时-天-周
上下文单 session context window显式 memory 层(RAG / KV / 结构化)
失败恢复用户手动重开Checkpoint + auto-retry
代表实践ChatGPT / Claude 单轮12-Parallel-Claude-C-Compiler · Codex / Devin

三大工程要素(Anthropic Harness Design)

  1. Planner-Generator-Evaluator 三 Agent 分工(GAN 启发)—— 见 13-Harness-Design-Long-Running-Apps
  2. 显式 Memory 层,不是把聊天记录塞进 prompt —— 见 58-智能体的记忆不是把聊天记录塞进提示词
  3. Managed Agents 模型:Session / Harness / Sandbox 三层解耦 —— 见 11-Managed-Agents · Brain-Hands-Decoupling

反共识

在本 Wiki 中的出现

相关