LangSmith 调试与评估:看清 Agent 的每一步决策
专栏导航:本文是「LangChain 30 篇精讲」系列的第 10 篇。Agent 能记住对话了,但新问题浮现——它\”想\”了什么,你看不到。
写在前面:比\”报错\”更可怕的,是\”不报错但结果不对\”
程序报错其实是好事——错误信息告诉你哪里出了问题。
Agent 最难受的情况是:它没报错,但结果就是不对。
用户:帮我查一下北京明天的天气,如果下雨就提醒我带伞
Agent:北京明天天气晴,25 度。
看起来挺正常。但如果 Agent 其实调用了错误的工具(比如查的是上海),或者传错了日期参数(查的是今天),甚至根本没调用工具、只是编了一个答案——你从输出里完全看不出来。
这就是 Agent 的\”黑盒问题\”。

一、Agent 的黑盒困境
当 Agent 输出错了,




