上个月做了 CVS Health 的 final round(他们叫 'onsite',但 2026 是全线上)面试,岗位是他们药房分析团队的 senior data engineer role。把结构写出来,因为我面之前真找不到这些信息。
形式: 4 轮连着做,大概 3.5 小时,中间两次短休息。Zoom 线上共享屏幕。设计轮用一个 Miro board。
round 1:technical(60 分钟)。 python 和 SQL coding。第一题是数据转换任务,中等难度,基本就是你在生产里会写的东西。第二题是针对一个偏医疗的 schema(patients 和 prescriptions)的 SQL 优化。没有 leetcode-hard,就是清晰实用。
round 2:system/data design(45 分钟)。 给了一个粗略 spec,让我设计一个 data pipeline,用来跨地区聚合处方配药数据,重点是延迟和数据质量。面试官是 senior,会追问。大概 10 分钟讲 data modeling,然后转到 infra 选型,再到 error handling。他们非常在意 upstream 数据晚到或格式不对时会发生什么。
round 3:behavioral(45 分钟)。 两个面试官轮流问,全部 STAR。重点是跨团队合作和处理模糊性。具体问题包括 "tell me about a time stakeholders had conflicting data needs(讲一次不同 stakeholder 的数据需求发生冲突的经历)" 以及 "when have you had to push back on a deadline."(你什么时候不得不对一个截止时间提出异议。)
round 4:hiring manager(30 分钟)。 完全聊天。他问我在找什么、工作中什么让我有能量、我对当前团队配置的看法。我问了数据栈(Snowflake、dbt、一些 Spark)、roadmap、团队规模。没有新的技术内容。
total debrief time:他们说最多 5 个工作日。我第 4 天就收到回复。