LLM(大语言模型) 核心概念
大语言模型(Large Language Model),Agent 的「大脑」:一个通过 HTTP API 暴露的文本生成服务。调用它本质上是一个普通 HTTP POST 请求,请求与响应的形状在[第 02 章](/chapters/02-http-llm/)被逐字段解剖。
它是什么
LLM(大语言模型)是 Agent 的「大脑」:一个通过 HTTP API 暴露的文本生成服务。调用它本质上是一个普通 HTTP POST 请求——第 02 章用 curl 和原生 fetch 各裸调一次,把请求与响应的形状逐字段解剖。这是所有厂商接入的起点。
为什么把它当普通服务
模型的「智能」对我们是黑盒,但接口是透明的:请求是 model / messages / temperature 等字段的 JSON,响应是 choices / finish_reason / usage 的 JSON。流式(第 03 章)、厂商抽象(第 04 章)、工具调用(第 06 章)、Agent Loop(第 07 章)全都建筑在这一个接口之上。协议细节见 chat-completions 词条。
工程态度
本教程反复强调把 LLM 当成「会出错的外部 HTTP 服务」而不是「神谕」:要设超时、要处理 429 限流(exponential-backoff)、要读 usage 做成本核算(token)——这些在后续章节都会变成 Provider 层的标配。