Square · Primly 社区

Square machine learning engineer 面试:完整流程,包括没人提醒你的那些坑

ml_mike (Primly starter) · 4 条回复

今年春天我走了 Square 的 MLE 面试全流程,岗位是在他们的 risk/fraud ML 团队。我就直说了:对一家通常不在「FAANG 持久战」梯队的公司来说,这套流程比大家预期要难。下面是具体经历。

总共六轮: Recruiter screen ML fundamentals(60 分钟) Coding round(LC 风格,60 分钟) ML system design(60 分钟) Behavioral(45 分钟) Hiring manager 深度对话

ML fundamentals: 面试官问得很深。问题从梯度下降、正则化一直到类别不平衡的分类问题,这对欺诈检测非常贴合。他们问我会怎么处理极端类别不平衡(欺诈率大概 0.1%),除了 accuracy 还会用什么指标,以及我会怎么向非技术 stakeholder 解释模型决策。解释性这块我有点措手不及。我答得还行,但本可以更具体地提到 SHAP values 和 partial dependence plots。

Coding: 两道中等偏上的题。一道偏算法(sliding window 模式),另一道更像你在真实工作里会遇到的数据清洗问题。都挺合理,没有刁钻。

ML system design: 这一轮我会建议任何人都重点准备。我的题目是:设计一个实时交易欺诈检测系统。我需要覆盖特征工程(包括一些实时 feature store,我之前用过)、模型训练 pipeline、推理延迟要求、以及模型漂移监控。面试官会强力追问快速在线模型和更强 batch 模型之间的权衡。这里支付网络的时间约束很关键:在刷卡那一层你只有毫秒级。

欺诈检测的领域知识确实重要。不是说你必须在 Square 做过,但那种泛泛的 ML 空话不会过。要具体讲清楚特征工程怎么选、延迟和精度怎么取舍、以及在金融场景下怎么监控 concept drift。

Offer 还挺有竞争力:我在 SF 的总包大概 $260k,对标 L5,base 加 RSUs,标准 4 年 vest。大体符合我对 2026 年非 FAANG fintech 同级别的预期。

由 AI 翻译,查看原文

4 条回复

pivot_pat (Primly starter)

imbalanced classification 这个问题对 fraud team 来说是送分题,但我见过 senior 候选人翻车。Oversampling、undersampling、threshold adjustment、cost-sensitive learning:你得对各自适用场景有明确观点,而不是只会把词列出来。

由 AI 翻译,查看原文

mobile_mara (Primly starter)

关于要能向 stakeholder 解释可解释性这一点说得很好。在受监管行业里这类问题越来越常见。能把一次模型决策解释给合规团队,或者解释给一个被标记为欺诈的客户听,是实际运营需求,不只是一个虚的「沟通能力」问题。

由 AI 翻译,查看原文

sec_sasha (Primly starter)

卡组织那一层的延迟真的很要命。看你接入点在哪,你可能只有不到 100ms 来做决策。忽略这一点的 system design,在做过 payments 的人眼里会显得很不现实。

由 AI 翻译,查看原文

ml_mike (Primly starter)

对,sec_sasha 说得没错。我也被专门追问了这个。得把为什么会用轻量级在线模型做实时决策讲清楚,然后把更重的 ensemble 放到异步层做授权后的复核。面试官看起来对这个框架挺满意。

由 AI 翻译,查看原文