Bain & Company · Primly 社区

Bain & Company data engineer 面试:pipelines、SQL,以及一轮意外的 system design

de_derek (Primly starter) · 3 条回复

上个月走完了 Bain 的 DE loop,职位在他们的全球 analytics infrastructure 团队。跟咨询公司招 analyst 比起来,他们招 DE 没那么多,所以关于这个流程的信息很少。下面是我了解到的情况。

Recruiter screen:30 分钟,主要是过一遍简历和一些常见的文化问题。他们强调 Bain 的 analytics 团队是嵌在咨询团队里的,所以你会跟很多非技术的人打交道。翻译一下:沟通能力在这里真的比在产品公司更重要。

Technical round 1:SQL + data modeling 两道 SQL 题加一道数据建模 prompt。SQL 大概是中级:一个多步 CTE 去算 client-level churn,还有一个查询每个客户的第一次和第二次购买日期。建模 prompt 问我会怎么设计一个 schema,用来跨多个客户跟踪咨询项目的 KPI,每个客户的指标定义还不一样。我画了一个 EAV 变体,然后我们花了 15 分钟争论。他们在测的是你在模糊条件下怎么推理,不是在找唯一正确答案。

Technical round 2:Pipeline design + systems 这轮我没想到。他们让我讲一个我做过的真实 pipeline:架构、failure mode、怎么处理 schema drift。然后给了个场景:客户的数据每晚落到 S3,但 schema 不保证稳定。你怎么做一个鲁棒的 ingestion layer?我讲了 schema inference、contract testing、dead-letter queue。他们追问得挺到位。

Behavioral:跟 DS loop 很像。想听一个你如何在 deadline 压力下处理数据质量危机的故事。有一道我没准备的问题:「你会对 partner 和对 engineer 分别怎么解释同一件事?」建议提前想好。

完全没有 leetcode 风格的算法题,说实话挺爽的。SQL 和 design 的深度完全补回来了。

总时间线:5 周。Boston HQ 职位,每周 3 天到办公室。

由 AI 翻译,查看原文

3 条回复

staff_steph (Primly starter)

用 EAV schema 来做可变指标定义,简直是咨询公司经典问题。你总会遇到每个客户对「revenue」的口径都不一样。他们有把你往某个特定模式上引吗,还是只是想看你怎么推理?

由 AI 翻译,查看原文

de_derek (Primly starter)

他们主要是想看推理过程。我提了 EAV,他们就追问 query complexity 的取舍,我承认了这个点,然后建议做个混合方案:常用指标用固定列集合。看起来他们对讨论很满意,不是针对某一个标准答案。

由 AI 翻译,查看原文

infra_ines (Primly starter)

Schema drift 处理的问题挺不错的。回答「dead letter queue + 告警 + 对新 schema 做人工审核」是任何理性的人都该说的,但很多候选人会直接卡住。知道他们在找这个答案挺有帮助。

由 AI 翻译,查看原文