惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
小众软件
小众软件
博客园 - 三生石上(FineUI控件)
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
博客园_首页
Last Week in AI
Last Week in AI
美团技术团队
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Apple Machine Learning Research
Apple Machine Learning Research
WordPress大学
WordPress大学
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
博客园 - Franky
The Cloudflare Blog
罗磊的独立博客
月光博客
月光博客
N
Netflix TechBlog - Medium
C
Check Point Blog
Microsoft Security Blog
Microsoft Security Blog
F
Fortinet All Blogs
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
Microsoft Azure Blog
Microsoft Azure Blog
IT之家
IT之家
Jina AI
Jina AI
J
Java Code Geeks

博客园 - 若-飞

电商订单为什么要存「交易快照」 Git Submodule Sync 完整技术文档 企业AI Agent落地的核心逻辑与路径 基于langchain,Function Call的成功率怎么解决? LangChain Checkpoint(检查点)是什么?—— Agent 的"存档机制" RAG 设计:Embedding 如何切分 AI 客服系统设计:RAG 知识库设计 Go 百万连接服务器设计:从网卡到业务的全链路解析 深度解析 sync.Pool:从设计哲学到生产实践 Goroutine 泄漏:原因、检测与防范 Go Channel 关闭与超时机制完全指南 Go Map 无限增长问题解决方案 LangChain 聊天记录压缩:原理、机制与实战 揭开 sklearn 文本分类的核心原理:从词袋到逻辑回归 大模型“胡说八道”怎么办?一张图读懂检测、评估与修复全方案 企业级AI知识库权限隔离设计:让AI“懂规矩”比“懂知识”更重要 RAG系统设计全解析:从架构到多模态的核心知识图谱 RAG召回率提升全攻略:7大核心方法让检索更精准 RAG召回率提升秘籍:Metadata过滤的底层原理与实践 构建更好的RAG系统:深入理解混合搜索 一文搞懂 RAG 中 Retriever 和 Reranker 的区别 一文搞懂 RAG 的召回率(Recall)是什么? Agent Harness 技术笔记:从 Trajectory 到 Function Calling Loop BLEU 是什么?——从原理到工程实践 一文讲清:Approve / Permit / Permit2 的本质区别 分库分表后跨分页查询的完整方案 ai如何处理私有数据 ai幻觉是啥,以及如何解决 别再让大模型“凭空瞎猜”了!带你认识AI最强外挂:ChromaDB 用 useQuery 管请求:TanStack React Query 入门小结
LangChain / LangGraph、MCP、Harness Engineer 与 Claude Co...
若-飞 · 2026-06-22 · via 博客园 - 若-飞

先记一张「层次图」

三者不在同一层,不是互相替代,而是 构建 → 连接 → 评测 的关系。


1. 各自核心区别

LangChain vs LangGraph(常一起出现,但职责不同)

  • LangChain:偏 构建块(一次调用、链式组合)
  • LangGraph:偏 运行时(Agent 循环、条件路由、持久状态)

L4 里手写的 run_fc_loop,在工程上相当于 极简版 LangGraph 节点循环

MCP vs LangChain/LangGraph

  • MCP 不是 Agent 框架,管 loop、不管 state
  • MCP 只定义:Tool / Resource / Prompt 怎么 标准化暴露和调用

Harness Engineer vs 上面三者

Harness 工程师关心:

  • 给定 Task + Dataset → 自动跑批
  • 记录 trajectory → 自动打分
  • 出 JSON/CSV/HTML → 跨版本 regression

不是框架,是职责 + 一套工程能力(你做的 L3/L4 就是这套能力的 mini 版)。


2. Claude Code 对应起来是什么

Claude Code 是一个 Agent 产品(coding agent),不是 Harness,也不是 MCP 本身。可以这样拆:

更直观的映射


3. 用「Claude Code 修 bug」走一遍四层


4. 和 Cursor Agent 的类比(你正在用的)

你现在的 L4 Agent Harness,是在 学习 Harness Engineer 做的事 —— 用 mini 数据集和 rule metrics,复现「测 Agent」而不是「造 Claude Code」。


5. 一句话对照表


6. 核心结论

  • Claude Code ≈ 一个已经造好的 Coding Agent 产品(内含 LangGraph 式 loop + LangChain 式 tool 封装 + 可选 MCP)
  • Harness Engineer ≈ 不负责写 Claude Code,负责证明 Claude Code 好不好、改 prompt/模型后有没有变差
  • MCP ≈ 给 Claude Code 加新能力的外接协议,不是 Agent 本身
  • LangGraph ≈ 若你自己从零写 Claude Code,用来实现「循环 + 状态 + 路由」的那一层

学 L4 Harness 的价值:即使将来 Agent 跑在 LangGraph 上、工具接 MCP,评测层(trajectory + metrics + regression)依然需要,而且往往要你自己建——这就是 Harness Engineer 的核心工作。