[HITL 5/5] 别让人类盲审
Automation Bias 是 HITL 的隐形杀手。五个审批界面设计原则:展示为什么、暴露风险、增加认知摩擦、提供对比基线、支持编辑。
Automation Bias 是 HITL 的隐形杀手。五个审批界面设计原则:展示为什么、暴露风险、增加认知摩擦、提供对比基线、支持编辑。
有状态 Agent vs 无状态 Web 的结构性矛盾,Checkpoint 的四层状态,异步审批的 12 步流程,状态膨胀治理,滑动自主性的工程实现。
用三层模型对 LangGraph、AutoGen、CrewAI、Semantic Kernel、MS Agent Framework、Claude Code 做 HITL 体检。结论:Checkpoint 是分水岭。
三层模型拆解 HITL:Layer 1 定义人类角色(把关人/协作者/纠正者),Layer 2 定义工程机制,Layer 3 定义基础设施(Checkpoint/滑动自主性)。
Agent 能调工具就有外部副作用,有副作用就需要控制机制。System Prompt 不够——生产环境需要模型侧软控制和框架侧硬控制双层防御。
自顶向下拆解推理框架:延迟构成、上下文成本、模型路由、多模态代价、韧性设计——面向 Agent 架构师的推理层指南。
预训练压缩知识、SFT 教会格式、RLHF 对齐偏好、Function Calling 赋予工具能力——面向 Agent 开发者的模型训练全景指南。
从 Tokenization 到自回归生成,用一句「帮我查一下北京明天的天气」走完 LLM 处理全流程。面向 Agent 开发者的灰盒认知指南。
经验贬值的非对称性、成长路径的梯子断裂、精英化悖论、工程严谨性危机——基于团队实践的四个观察。
Context Rot 的物理现实、三层压缩策略、文件系统作为延展记忆、CLAUDE.md 最佳实践,以及从 Prompt Engineering 到 Context Engineering 的范式转变。