面灵AI

字节面经-字节跳动后端开发岗面经-10

时间
2026-08
来源
牛客网

《面试题目》

  1. 这个OS开源社区我之前没太了解过,你能详细说一下吗?
  2. 现在有哪些场景在使用?
  3. 这个社区是哪里主导发起的?
  4. GitHub链接和你的主页链接?
  5. 数据结构和方法是参考什么来判断的?
  6. 介绍一下RAG,RAG的具体过程
  7. RAG系统是如何评估的?
  8. 你的文档上传是怎么确保高质量的?
  9. 文本切分你是怎么做的?
  10. 介绍一下BM25算法
  11. 讲一下对大模型底层实现的理解
  12. Q;毕业届次、课程安排、实习时长及到岗时间?
  13. Q;简历项目是借鉴的开源项目还是自己做的?
  14. Q;视频上传提音到送大模型的完整链路?
  15. Q;视频转音频功能如何实现?
  16. 但是,毕业进高校的时代早已过去,无意义的科研又让我一度陷入迷茫?
  17. 我的简历整整两页,教育背景部分却只有三行,本硕学校+英语六级(570+)?
  18. 只是把 HTTP 改成 WebSocket,那内部处理流程或编排具体有什么变化?
  19. 关键是怎么把完整音频基于什么维度切割?
  20. 延迟从 800ms 降到 200ms,这个 800ms 是处理完成返回的时间吗?
  21. 是发起请求之后,完整响应吗?
  22. 确认一下延迟口径:是接口请求维度,从发起网络请求到数据全部接收完成?
  23. 端到端的链路流程说一下?
  24. 用的什么模型,用的飞书aily知识库存在哪,了解知识库的底层架构吗?
  25. 整个项目的链路是怎样的,怎么评判回答效果,召回率如何,知识文档有没有做加工?
  26. 用过OpenClaw吗,了解OpenClaw和其他agent的区别吗,它的架构是怎样的?
  27. 规则树,责任链怎么设计的,规则树有哪些规则节点,怎么流转的?
  28. 常见的处理redis和mysql数据不一致的手段有哪些?
  29. ps:年底深圳的实习怎么这么难找?
  30. 说一下rag流程
  31. 介绍自己负责的一个模块?
  32. 怎么保证MySQL和ES的一致性?
  33. 实习项目对公司的价值?
  34. setNx有什么缺点?
  35. 怎么根据aop和mdc实现全链路日志追踪的?
  36. 介绍一下Java集合框架(介绍了ArrayList,LinkedList,HashSet,HashMap)
  37. 如何实现高并发下,基于地理位置、热度与模型的实时混合排序?
  38. 如何协同“元数据落库”、“转码审核”、“推荐池准入”等多个异步操作?
  39. 面对百亿级点赞、评论关系,如何通过数据分层、缓存策略、异步聚合,实现毫秒级查询与高性能写入?
  40. 如何通过数据异构(如向量索引+倒排)、查询拆分与融合,平衡搜索延迟、相关性与系统开销?
  41. 内容审核服务接口有随机超时,但其自身监控正常。你的排查假设与验证步骤是什么?
  42. 视频播放页的“基础元数据”、“实时计数”、“动态状态”,分别适合采用本地缓存、分布式缓存还是直接读存储?
  43. 手撕: 求一个字符串中不含有重复字符的最长子串的长度
  44. 能再详细介绍一下这个项目的难点或复杂点吗?
  45. 这个智能系统的智能点及降本增效的点在哪里?
  46. 整体系统分几个大的功能模块?
  47. 项目中还有哪些觉得难的地方?
  48. 如果再负责这个项目,有哪些想优化的地方?
  49. 为什么通过Kafka实现服务通信?
  50. Kafka的Rebalance机制你了解吗?
  51. Java 中如何等待多个线程执行完成?
  52. 如何排查慢 SQL?
  53. MySQL 数据迁移有哪些方式?
  54. 介绍一下什么是索引?
  55. MySQL都有哪些索引?
  56. 举一个项目中的例子,使用MySQL做的查询,依据什么去做的查询?
  57. 有遇到过一些慢查询的场景吗?
  58. 有遇到过选错索引的情况吗?
  59. 介绍一下MySQL的事务的隔离级别。
  60. Golang的栈增长机制?
  61. sync.Mutex的实现原理:(;18前后版本差异)?
  62. Golang中for range 遍历 slice/map 时,变量的内存地址是否变化?
  63. Golang的interface{}空接口的底层实现?
  64. 分布式 ID 生成方案?
  65. 高并发场景下,如何保证接口的幂等性?
  66. 场景题:抖音直播间弹幕每秒百万级,如何设计一个高可用的弹幕推送系统?
  67. 数组第k大的数怎么实现?
  68. 稳定排序有什么作用场景?
  69. 排序的理论最快时间复杂度是多少?
  70. 有哪些?这些排序有什么限制吗?
  71. 联合索引。联合索引(a,b,c)如果a全是一个值我select*fromtwhereb=1andc=1能走索引吗?
  72. 手撕:一道递归题
  73. 如何实现的,详细介绍一下流程
  74. 项目和实习的来源?
  75. 介绍一下实习中做了哪些事情?
  76. 举例子说明一下你做的优化对bug排查效率的提升?
  77. 记录的日志数据存储在哪里了?
  78. 冷数据都直接存储在mysql会导致性能问题,有没有其他更好的方法?
  79. 说一下mysql存储引擎有哪些
  80. update s set x=5 where id>5 会用什么锁?

《参考解析》

  1. 这类问题建议结合自己的项目经历和岗位要求准备具体案例,突出思考过程而非死记结论,面试官更看重解决问题的逻辑。
  2. 算法题先明确边界条件与不变量,再选择合适的数据结构;双指针、哈希表、递归/迭代是常见工具,目标是把复杂度控制在线性或对数级别。
  3. 回答AI相关问题时应结合具体项目说明如何设计Prompt、评估效果以及处理边界情况(如幻觉、超时),并展示对模型能力边界的清晰认知。
  4. 介绍项目时应说明背景、个人分工、遇到的技术难点及解决方案,并量化收益(性能提升、成本下降等),便于面试官追问细节。
  5. CPU飙高排查一般先用top/htop定位进程,再用jstack/pstack抓线程栈,结合火焰图找到热点方法,常见原因是死循环、频繁GC或锁竞争。
  6. 进程是资源分配的基本单位,线程是CPU调度的基本单位,协程是用户态的轻量级调度单位,切换成本远低于线程,但需要语言/运行时支持。