我直接说:LinkedIn 的 MLE 面试很大程度取决于你面的是哪个团队。我走的是 feed ranking team,也就是 recsys。如果你面的是别的 ML 方向(NLP、CV、trust/safety),有些内容仍适用,但 system design prompt 肯定会不一样。
初始 technical phone screen 之后还有五轮。
Technical phone screen:一道 coding(中等,sorting + hashing),一道 ML 问题。ML 问题是:你有一个二分类器,用来预测用户会不会点击一个 job posting。precision 很高但 recall 很低。跟我讲讲可能原因,以及你会怎么排查。经典不平衡问题。确保你能讲清 threshold tuning、class weights、以及数据层面的做法,并且不把它们混在一起。
Onsite:
第 1 轮,coding:两题,都是中等。一题 sliding window,一题 trie。标准算法准备足够。他们这个团队好像不太在意 graph 题。
第 2 轮,ML fundamentals:纯理论轮。覆盖:在真实场景下讲 bias-variance tradeoff,gradient boosting 的原理以及什么时候比 neural net 更合适,L1 vs L2 正则在稀疏特征上的效果(对他们的 ad models 很相关),以及不能 A/B test 时如何评估 ranking model(离线指标:NDCG、MAP、MRR)。这里需要真深度,不是那种面试速成的表面知识。
第 3 轮,ML system design:为 LinkedIn 设计 feed ranking 系统。这是他们的主场,对问题非常熟。先从用户目标 vs engagement 目标的张力讲起,再讲 candidate generation vs ranking 阶段。特征工程:哪些信号重要(network graph features、content features、freshness decay)。他们追问:新帖子 cold start 怎么办?怎么避免为了 engagement 优化反而奖励 clickbait?我讲到了 diversity injection 和 topic coverage 约束。他们看起来喜欢具体细节。
第 4 轮,behavioral:标准 STAR。他们问了我曾经不同意一个 research 方向时怎么推进,以及一个没做成的项目和学到什么。
第 5 轮,cross-functional:和一个 data scientist 以及团队 PM 的一轮。他们在看你能不能在研究和产品需求之间做翻译。
总流程:6 周。Offer 是 E5。Sunnyvale base 大概 $215k,RSUs 另算。