跳到主要内容

1 篇博文 含有标签「LLM」

查看所有标签

ReAct 是什么:让模型「边想边做」的范式(含零依赖手写实现与 4 个实测坑)

· 阅读需 23 分钟

在写用前端技术栈写 Agent那几篇时,我把「工具调用循环」讲清楚了,但一直没单独讲它的出处。这个循环不是工程实践中自然长出来的,它有篇明确的论文:ReAct

这篇把 ReAct 讲透:它是什么、为什么重要、格式长什么样,然后用零依赖的纯 Node 手写一个真的能跑的 ReAct 智能体。最后是重点——我在本机真实跑出来的四个坑,其中有两个非常隐蔽:一个是不报错、只是静默返回空,另一个是模型会伪造工具的返回结果,然后基于伪造值自信作答

声明:本文所有代码均在本机真实运行,走 DeepSeek 的 Anthropic 兼容端点(deepseek-v4-flash,一个推理模型)。所有输出、stop_reason、token 数都是实测值,不是我编的示意。