欢迎光临
我们一直在努力

十、LangSmith 调试与评估:看清 Agent 的每一步决策

LangSmith 调试与评估:看清 Agent 的每一步决策

专栏导航:本文是「LangChain 30 篇精讲」系列的第 10 篇。Agent 能记住对话了,但新问题浮现——它\”想\”了什么,你看不到。


写在前面:比\”报错\”更可怕的,是\”不报错但结果不对\”

程序报错其实是好事——错误信息告诉你哪里出了问题。

Agent 最难受的情况是:它没报错,但结果就是不对。

用户:帮我查一下北京明天的天气,如果下雨就提醒我带伞

Agent:北京明天天气晴,25 度。

看起来挺正常。但如果 Agent 其实调用了错误的工具(比如查的是上海),或者传错了日期参数(查的是今天),甚至根本没调用工具、只是编了一个答案——你从输出里完全看不出来。

这就是 Agent 的\”黑盒问题\”。

在这里插入图片描述


一、Agent 的黑盒困境

当 Agent 输出错了,

赞(0)
未经允许不得转载:171主机测评 » 十、LangSmith 调试与评估:看清 Agent 的每一步决策
分享到: 更多 (0)

评论 抢沙发

  • 昵称 (必填)
  • 邮箱 (必填)
  • 网址