面灵AI→

浩鲸科技二面:Agent 项目深挖与文档引用处理

轮次
二面
时间
2026-09
来源
牛客网

《面试题目》

  1. Agent 项目的背景是什么?
  2. 介绍一下简历里 Agent 项目的技术难点
  3. 如果给了一份技术文档,用户需要文档中引用的某个文档的内容,这时候怎么处理?
  4. 期望薪资是多少(并反问薪资结构组成)?
  5. 为什么实习去了深圳?
  6. 是否可以提前实习?
  7. 自我介绍

《参考解析》

Agent 项目的背景怎么讲:一段话把三件事说清——业务场景与用户价值(谁在什么场景下用它,替代了什么手工流程)、为什么是 Agent 而不是普通工作流或规则引擎、核心链路(规划 / 工具调用 / 记忆 / 结果校验)。然后交代自己的角色和量化结果,比如覆盖多少场景、准确率或人工工时下降多少。背景讲不清,后面的技术难点会显得没有落点。

Agent 项目的技术难点怎么答:准备四条能讲透的主线,按自己真实做过的挑 1~2 个展开。① 工具调用的可靠性:参数幻觉、调用失败与超时、幂等与重试,解决方式是把参数约束写进工具 schema + 调用前后校验;② 上下文与记忆:长文档切分检索、多轮指代消解、会话压缩与状态机,避免上下文无限增长;③ 效果评估:离线评测集 + 线上埋点,做 A/B 与回归,否则改 prompt 全靠感觉;④ 成本与延迟:模型分级路由(简单任务走小模型)、缓存、流式输出、并发限流。讲法固定成”现象 → 怎么定位 → 方案对比 → 指标变化”,这是面试官唯一能判断你真做过的部分。

文档中引用的其他文档怎么处理:这是多跳检索(multi-hop retrieval)问题,答案是”解析阶段建引用图 + 检索阶段按需展开”。① 解析时保留文档内的引用标记、章节号与外链,抽成 (doc_id, ref, 上下文) 的引用关系存下来;② 一次检索命中文档 A 后,从问题与命中片段里识别用户要的是哪一处引用,再按引用关系取文档 B;③ 取 B 时按同样方式分块、只取相关段落,不要整篇塞进上下文;④ 限制跳数(1~2 跳)并设 token 预算,防止链式展开把上下文撑爆;⑤ 必须做权限校验,用户的可见范围之外不能因为”被引用”就取出来;⑥ 引用取不到(外部文档、无权限、链接失效)要明确告诉用户,不能编造内容;⑦ 工程上加 doc_id → chunks 缓存、并发取文去重,prompt 里给每段标来源便于引用回填。如果追问”引用关系怎么识别”,可以答:正则抽编号与链接 + LLM 抽取兜底,并对抽取结果做抽样校验。

期望薪资与反问:给区间而不是单点——同城同岗校招区间 + 自己的依据。反问薪资结构是很值得做的一步:base 乘几薪、绩效系数怎么算、公积金比例、补贴、调薪与晋升周期。把结构问清楚比多要 1k base 更实际。

为什么去深圳与提前实习:地域问题考察稳定性,回答给具体理由(机会集中、实习期间已适应当地、家人支持)并给出长期信号。提前实习要先问清三件事:起止时间与每周天数、是否折算试用期或影响转正、和毕业答辩 / 论文时间是否冲突;如果确实去不了,直接说明客观原因并给出可替代方案(如线上参与或毕业后提前入职),比含糊答应更好。