Agent 岗面试问题整理:规划、工具调用、记忆与评估的连续追问
- 时间
- 2026-09
- 来源
- 牛客网
《面试题目》
一、开场从项目经历切入
- 你在之前的 Agent 项目里,最复杂的一次工具调用是怎么处理的?
- 如果工具返回的结果与用户原始问题无关,你怎么处理?
- 重试一次还不够呢?要如何避免系统一直重试?
二、概念题
- Agent 和普通大模型调用最大的区别是什么?
- 如果是一个接入了插件的问答机器人,它算 Agent 吗?
三、规划与工具调用
- 让 Agent 帮你整理本周邮件并生成摘要,你会怎么设计规划模块?
- 如果筛选条件太宽,导致第三步输入过长怎么办?
- 工具返回格式不一致怎么兼容?
- 工具超时如何处理?
- 返回内容过大如何防止上下文被占满?
- 如果 Agent 反复调用同一个搜索工具,但结果一直为空,要如何终止?
四、记忆设计
- 短期记忆和长期记忆你怎么区分?长期记忆一般存什么?
- 追问:长期记忆的更新策略是什么?
五、多 Agent 与评估
- 两个 Agent 协作写一份行业报告,一个负责资料收集,一个负责排版,怎么避免上下文错乱?
- 追问:任务中断后如何恢复?
- Agent 完成得好不好,你怎么定义指标?
六、开放设计题
- 设计一个能自动处理售后工单的 Agent,你会怎么拆?
- 追问:转人工的标准是什么?
《参考解析》
-
工具调用要讲成一个带预算的闭环,不是「失败就重试」:完整链路是意图判断 → 选工具 → 校验参数 → 执行 → 结果相关性检查 → 不相关则丢弃、记录原因、重试或改策略。防止无限重试靠三样叠加:最大步数与总时长上限(任一起过就降级)、重复调用检测(同工具同参数连续 N 次直接打断)、状态评估(判断当前结果是否已经能回答用户)。还要分清工具性质——只读工具可以放心重放,写操作必须有幂等键或先落意图再执行,否则重试会重复下单、重复发信。把失败原因写进上下文是对的,但要有淘汰策略,否则上下文很快被失败日志占满。
-
「它算不算 Agent」考的是边界,不是定义:四个判据是目标驱动、反馈闭环、工具使用、自主决策——尤其是能不能做多步规划、能不能根据中间结果调整下一步动作。接入插件的问答机器人是单次调用的扩展:它可能调了一次检索或一个 API,但没有拆解任务、没有基于中间结果改路线,所以不算。答这类题最好给一个反例和一个正例并说清分界线,而不是罗列名词。
-
规划模块的答法:拆步 + 定契约 + 标失败点:以「整理本周邮件并生成摘要」为例,拆成读取邮件、筛选重点、按主题分组、生成摘要、输出结果五步,每一步都交代输入输出是什么、要不要调工具、失败了怎么退。面试官立刻会追「某一步输入太长怎么办」,标准解法有三种可组合:设长度阈值,超限先做摘要或分批,或者让 Agent 向用户回问把条件收窄(时间范围、只处理有附件的、只处理未读)。关键是先给阈值再给动作,别说「模型会自己处理」。
-
工具层的三个工程问题各有一套标准答案:格式不一致要靠适配层——每个工具定义 JSON Schema,返回值统一归一成约定结构,缺字段给默认值并在日志里记一条告警,不要让它变成提示词里的随机文本;超时要有超时上限、指数退避重试和熔断(同一工具连续失败就暂时摘掉,避免拖垮整轮);结果过大要做字段裁剪加摘要,超大产物落到外部存储只在上下文里留引用和摘要,别整段回灌。这三条本质是同一个原则:工具的输出要变成受控的结构化输入。
-
「一直为空怎么终止」要答机制组合:最大步数或 token 预算打底,重复结果检测(把每轮的检索结果取指纹,连续相同就判定空转),任务状态评估(判断这条路径已经不可能产出答案)——三者任一触发就换策略或收尾,并明确告诉用户「没找到,原因是 X」。单独设
max_iterations挡不住「每轮都合法但原地打转」,这是面试官最想听到的差别。 -
记忆要按用途分层,并说清写入门槛:短期记忆是当前会话的临时上下文,管理手段是窗口截断、按轮次摘要、把稳定内容前置吃前缀缓存;长期记忆存的是用户偏好、历史任务结论、常用工具配置这类跨会话有用的东西,检索时才召回,而不是每次全量塞进去。写入侧要有规矩:定期汇总而不是每轮都写,写入前做去重与冲突检测(新偏好与旧偏好矛盾时以新的为准并留版本),重要信息(比如涉及账号、地址、金额)需要用户确认。这部分没有标准答案,面试官看的是方案能不能在真实系统里落地。
-
多 Agent 协作与评估都要落到可验证的机制上:两个 Agent 不共享全部对话,只通过结构化产物交接——用固定字段(标题、正文、引用来源、状态)表达,各自的中间推理留在自己上下文里,这样才不会互相污染;中断恢复靠 checkpoint:保存中间产物与任务状态,恢复时从最近检查点继续,已完成的步骤靠幂等或产物校验跳过。评估指标可以从任务成功率、工具调用次数、耗时、用户反馈起步,但一定要补上错误恢复率(中间出错后能不能自己纠回来)和人工接管率,否则「成功率高」可能只是因为简单任务占了多数。