在 Agent Harness 里,重新遇见分布式系统
长时运行的 Agent Harness 会死在进程崩溃、状态混写、并发竞态和账目失真四个位置。本文借 pi Harness V2 拆解对应的架构与测试方法。
长时运行的 Agent Harness 会死在进程崩溃、状态混写、并发竞态和账目失真四个位置。本文借 pi Harness V2 拆解对应的架构与测试方法。
同一组鲸鱼娘 Role Tags 在 DeepSeek、ChatGPT、Grok 和 Claude 上会发生什么?从跨模型实验拆解 Persona Schema Completion、Role DSL 与 Role Runtime。
读 Anthropic Managed Agents 官方文档和工程博客后的整理笔记:六层架构、Brain/Hands/Session 抽象、端到端调用链路、资源字典和几条设计判断。
五一假期读 Han Lee 的 Agent Runtime 长文,顺手写下五点散记:Agent ≠ Model 的工程后果、Agentic Model 这个词为何不准确、Runtime ≠ Sandbox 的边界、Runtime Shift 的五层分类,以及瓶颈正在从 model 转向 harness 和 runtime 留给从业者的窗口期。
Service Mode 改造下篇:Channel 推广到 1:N 的 AttachManager、5 层 Resource Cap 的职责切分、错误信封 / observability / CLI≡serve,以及三类我没做的事。
想让自己的 agent 跟上 Claude Code web 端的形态,顺便把 agent 架构从’读过’变成’撞过’。三天改造里的三次认知转变:会话 ≠ 进程、事件流 ≠ 输出、持久化 ≠ 存档。
Ultraplan 的 plan-execution 分离不是产品特性,而是 brain-hands 解耦在用户层的映射。从一条命令出发,拆解 Claude Code 云端/本地交互的设计逻辑和 session-harness-sandbox 三层抽象。
上周你可能还在纠结选 E2B 还是 Daytona 做 Agent 沙箱,今天 Anthropic 告诉你:不用选了,我全包了。 2026 年 4 月,Anthropic 发布了 Claude Managed Agents1——一套云端托管的 Agent API。表面上看是又一个 Agent 平台产品,但如果拆开它的架构看,会发现一个更大的变化:模型厂商正在从「卖推理能力」扩张为「卖 Agent 运行时」,而这个扩张正在重新定义 Agent 开发者需要做什么、不需要做什么。 ...