01 · 框架分层与评测坐标系
在比较任何两个 Agent 框架之前,先回答一个问题:它们在同一层吗?
一、Agent 的本质:Model + Harness
先把「Agent」这个词拆掉。工程上,一个 Agent 只有两部分:
- Model:会思考、会决定调什么工具的那个大脑。你换不换框架,它都在那儿。
- Harness:模型周围的一切 —— 提示词、工具、循环、上下文裁剪、状态存储、失败重试、人工审批。
框架卖的从来不是模型能力,卖的是 Harness。 所以「LangChain 和 GPT-5.5 哪个强」是个错误问题,「LangChain 的 Harness 比我自己手写的 while 循环强在哪」才是。
Harness 通常包含这些能力,你可以拿它当 checklist 去对每个框架:
图片来源:LangChain Docs