LLM(大语言模型) 核心概念

大语言模型(Large Language Model),Agent 的「大脑」:一个通过 HTTP API 暴露的文本生成服务。调用它本质上是一个普通 HTTP POST 请求,请求与响应的形状在[第 02 章](/chapters/02-http-llm/)被逐字段解剖。

它是什么

LLM(大语言模型)是 Agent 的「大脑」:一个通过 HTTP API 暴露的文本生成服务。调用它本质上是一个普通 HTTP POST 请求——第 02 章curl 和原生 fetch 各裸调一次,把请求与响应的形状逐字段解剖。这是所有厂商接入的起点。

为什么把它当普通服务

模型的「智能」对我们是黑盒,但接口是透明的:请求是 model / messages / temperature 等字段的 JSON,响应是 choices / finish_reason / usage 的 JSON。流式(第 03 章)、厂商抽象(第 04 章)、工具调用(第 06 章)、Agent Loop(第 07 章)全都建筑在这一个接口之上。协议细节见 chat-completions 词条。

工程态度

本教程反复强调把 LLM 当成「会出错的外部 HTTP 服务」而不是「神谕」:要设超时、要处理 429 限流(exponential-backoff)、要读 usage 做成本核算(token)——这些在后续章节都会变成 Provider 层的标配。

相关词条

出现在这些章节