VMware · Primly 社区

VMware data scientist 面试:SQL、stats、case 问题,loop 实际长什么样

ds_dmitri (Primly starter) · 5 条回复

2026 年 1 月刚走完 VMware data scientist 的 loop,岗位在 customer success analytics 团队。这是我第一次 enterprise-infra 的 DS 面试,质感跟我之前在 consumer 或 fintech 公司的不太一样。分享一下拆解。

SQL 轮: 确实有。一轮单独的 45 分钟 SQL。HackerRank 或共享文档,我那次是文档里写。题目中高阶。上来就问 window functions:running totals、组内排序、lag/lead 做 month-over-month 对比。还有一个多表 join + aggregation。不只是「select from where group by」那种。

他们还让我解释一个跑得很慢的 query,找出瓶颈。这有点意外。至少要对 query execution plan 和 indexes 有个基本概念。

统计 / 方法论轮: 在更长的一轮里占大概 30 分钟。主题:A/B test 设计、怎么定 sample size、怎么处理不平衡分组、怎么把结果讲给非技术 VP。还有一个关于客户留存的 cohort analysis 题。他们没让我现场写模型代码,更偏概念。

Case / product sense: 「某个关键客户细分的 support ticket 量在过去两个季度涨了 40%。讲讲你会怎么分析。」感觉是 DS 和 PM 的混合。他们要你讲数据源、假设、分析计划,以及最后怎么把结论讲给领导。

我没看到的: Machine learning 深度(没有模型架构问题、没有 feature engineering 深挖)。这个岗位偏 analytics,不偏 ML engineering。准备前先搞清楚岗位类型。

Comp 数据点:offer 是 remote,mid-senior DS。Base 大概 $155k,bonus target 10%,RSU 是 Broadcom 股票,4 年 vest。第一年算上 vesting 总包更接近 $185k。

由 AI 翻译,查看原文

5 条回复

analyst_ana (Primly starter)

slow query / execution plan 这个问题我总是会被卡住。你有用过什么资源来准备这个吗?

由 AI 翻译,查看原文

brand_ben (Primly starter)

老实说就是在 Postgres 里用 EXPLAIN ANALYZE,然后读几篇关于索引使用的文章。这不是什么深度数据库工程,他们只是想看你知道有索引这回事,以及在大表上 sequential scan 很贵。

由 AI 翻译,查看原文

ux_uma (Primly starter)

2026 年 remote DS mid-senior 给 $155k base 处在市场偏低的一端,但对 enterprise infra 来说也不算离谱。AVGO 的股价在动,所以 RSU 部分就是变量。

由 AI 翻译,查看原文

returner_ren (Primly starter)

A/B test / sample size 这个问题几乎在我听说过的每个 DS 面试里都会出现。是要完整走一遍 power calculation 推导,还是更偏直觉校验的问题?

由 AI 翻译,查看原文

firsttime_mgr (Primly starter)

更偏直觉校验加上推理。他们不想让我推公式。他们想知道的是:决定 sample size 时要考虑哪些因素,如果达不到需要的 N 你怎么办,以及你怎么权衡运行时间和置信度。偏概念,不偏计算。

由 AI 翻译,查看原文