Agent 实现方法论
From Scratch
学习地图
练习
术语表
← 返回首页
本章教程
本章练习
第 02 章测验
第 02 章测验
对应章节:最底层:用 HTTP 裸调 LLM
共 8 题,答对率 ≥ 80% 即通过。请完成全部题目后点击「提交」。
Q1
调用 LLM 时,请求体中哪个字段是「必填」的对话历史数组?
model
messages
temperature
max_tokens
Q2
响应中 finish_reason 为 length 表示什么?
模型认为回答完毕,正常结束
输出达到 max_tokens 上限被截断
请求被限流
鉴权失败
Q3
为什么多轮对话时每次请求都要把全部历史消息重发一遍?
因为模型会忘记之前的对话
因为服务端是无状态的,对话状态完全由客户端维护
因为协议要求每次只能发一条消息
因为历史消息越多响应越快
Q4
关于 temperature 的作用,下列说法正确的是?
控制模型生成的文本长度
控制输出结果的数量
温度越高输出越发散多样,温度越低输出越稳定保守
温度越高输出越确定
Q5
遇到 429 状态码时,为什么不能立即无间隔地重试?
因为 429 表示参数错误,重试没有意义
因为限流说明请求太快,不退避会持续撞墙甚至加剧限流
因为 429 是永久性错误
因为 429 不需要处理,会自动恢复
Q6
裸 fetch 调用 LLM 时,为什么必须显式设置超时?
因为服务端默认不会响应
因为 fetch 默认没有超时,一个卡死的请求可能无限期挂起
因为超时能提高响应速度
因为超时能节省 token 费用
Q7
响应中的 usage 字段主要用来做什么?
标识模型的版本号
记录 token 用量明细(prompt/completion/total_tokens),用于成本核算
标识响应是否被缓存
记录生成文本的字符数
Q8
对 400 与 429 两种状态码,正确的处理策略是?
两者都可以无限重试
两者都应立即抛错
400 立即抛错(改代码才能好),429 退避重试(等一等就能好)
400 退避重试,429 立即抛错
提交