Agent 工程的四层解法——Harness、多 Agent、记忆、Instinct——方向都对,但没人念给你听的是每层背后那张账单:校验器合谋放行、token 暴涨约 15 倍、记忆投毒、坏习惯被固化。该加哪层、什么时候加,先看价签。
大家都在搭 harness——测试/CI/review/guardrail。但有个更前置的问题被跳过了:你确定知道系统该往哪儿走?讲清方向(attractor)和围栏(harness)的真实关系——它们是双螺旋,不是先后。
Agent 表现不好,直觉反应是换更强模型、加更多工具、写更长提示词——但加法常是负优化。代码替代对话链、Sub-Agent 空间隔离、压缩做时间隔离、Skill 按需加载,四把手术刀给模型更精准的而不是更多的。
AI Agent 不靠谱?多半不是模型变笨了,而是 Harness 没做好。一文搞懂 Harness 在 Claude Code 这类工具背后到底干了哪三件事。
2026年5月11日AI AgentHarnessClaude Code工程实践