控制循环 核心概念
别名:
control loop
Agent 最小定义的三要素之一(另两个是模型与环境):指「感知 → 决策 → 行动 → 观察」四步闭路。关键点是循环的每一次「下一步做什么」由模型根据当前观察自主决定,而不是程序员预先写死——这是 Agent 与普通程序的分水岭。
它是什么
控制循环是 Agent 最小定义的三要素之一(另两个是模型与环境):指「感知 → 决策 → 行动 → 观察」四步闭路。感知读到当前状态(用户消息、工具结果),决策由模型做出(要不要调工具、调哪个、还是直接回答),行动执行工具,观察把结果回填给模型——然后回到决策,直到模型认为任务完成,或命中最大轮数等硬性停止条件。
与普通程序的区别
关键不是「有循环」,而是循环的每一轮「下一步做什么」由模型根据当前观察自主决定,而不是程序员预先写死——这是它与普通 while 程序、与 workflow 的分水岭。同一个任务,模型这次先调工具再回答,下次可能直接回答,路径是运行时动态产生的。
与 ReAct 的关系
「感知 → 决策 → 行动 → 观察」正是 ReAct(Reasoning + Acting)范式的中文写照:先想(thought)→ 再动(action)→ 看结果(observation)→ 再想。第 07 章用 think → act → observe 三步实现最小 agent-loop(见 think-act-observe 词条),而 ReAct 原论文就是这套循环的源头。
小结
控制循环是 Agent 的「心跳」:没有它,模型加工具只是一堆零件,永远不会自己动起来。