面灵AI

字节跳动飞书二面

时间
2026-08
来源
牛客网

《面试题目》

  1. 在得物实习只有3个月,没有长期实习是什么原因?
  2. 挑一件你实习中挑战最大的事情讲一下。
  3. 数据清洗这块除了策略模式剔除meta信息,具体都做了哪些清洗工作?
  4. 公司内部论坛文档,为什么不通过正规渠道申请接口,反而选择爬虫爬取?
  5. 爬取外部Linux Do、Stack Overflow等技术网站内容的项目背景是什么,为什么要爬外网数据?
  6. 这套内部AI工具最终落地效果如何,有哪些量化指标、具体收益数据?
  7. 怎么评估chunk划分效果,如何做优化?
  8. 下游任务AI回答的正确性是如何判断、评估的?
  9. 用户反馈量大概有多少,反馈不好时如何处理数据集?
  10. Milvus有哪些索引类型?
  11. HNSW索引的结构、构建原理是什么?
  12. HNSW索引有什么缺点?对比IVF索引优劣?
  13. 进程和线程的区别?
  14. 线程会共享进程哪些资源?
  15. 什么是虚拟内存?虚拟内存如何分配?
  16. 在浏览器输入域名到页面展示完整流程是什么?
  17. DNS解析出单个IP,如何映射到后端服务集群?Nginx是单机还是集群部署?
  18. B+树和B树的区别?

《参考解析》

  1. Redis常用于缓存、分布式锁和计数。缓存与数据库更新通常采用“先写数据库、再删除缓存”,并通过重试、延时双删或消息补偿处理删除失败。
  2. MySQL索引通常使用B+树,叶子节点按顺序连接,适合范围查询;设计索引时结合选择性、最左匹配原则和执行计划,避免无效索引与回表开销。
  3. 并发问题应先明确共享状态和一致性边界,再选择锁、CAS或队列。线程池需要根据任务是CPU密集还是IO密集设置核心线程数、队列容量和拒绝策略,并监控活跃数与队列长度。
  4. 算法题先写出不变量和边界条件,再分析复杂度;常见数组、链表和树问题可分别使用双指针、哈希表、递归或迭代遍历,目标是在线性或对数复杂度内完成。