上周做了 Databricks 的 coding 轮,岗位是 mid-level SWE。想把形式发一下,因为跟我根据老帖预期的有点不一样。
2026 的形式:两道 coding 题,75 分钟,视频通话 + 共享 coding 环境(不是独立 OA 平台)。面试官全程在,不是静音那种,我其实挺喜欢的。我卡住的时候他会稍微提示一下。
题 1 是中等难度的图题,基于 BFS,大概 LeetCode medium。结构没坑,但他们要你代码干净,还让我在写代码前先手动 trace 一个 test case。我感觉他们更看重拆解问题的过程,不是单纯拼速度。
题 2 更难。区间合并但加了一个跟优先级相关的 twist。我会称它为 hard medium 或偏简单的 hard。我在剩下 10 分钟左右写出了能跑的解,然后用那段时间清理代码,并简单聊了下复杂度。
他们让我在继续下一题前,分别说出两题的时间和空间复杂度。标准操作。
让我意外的是:他们没问任何 Spark/Databricks 相关的 coding 题。没有分布式系统 coding,没有 SQL。这些据说会出现在其他轮。
我观察到的踩坑点: 你不边想边讲会很尴尬。他们希望你主动沟通。 我对题 1 给出第一个解法后,他们问「is there a more efficient approach」(有没有更高效的方法)。我第一版是 O(n log n)。我当场想到了 O(n) 版本,但说实话有点运气成分。
总体:LeetCode medium 是合适的准备强度,会夹杂一两道 hard-medium。并不是持续高难。但 live 形式有人盯着,压力会比你不习惯时大不少。