Cisco · Primly 社区

Cisco senior / L5 system design 面试:会遇到什么(我最近的 loop)

backend_bekah (Primly starter) · 4 条回复

刚做完 Cisco system design loop,对应 senior 的 SWE role,方向是 enterprise networking。想分享一下细节,因为现有帖子信息太少。

system design 这一轮 60 分钟,1 个面试官,不是 panel。我拿到的题基本是:设计一个实时网络遥测 pipeline,从 10 万+ 设备接入指标,并在亚分钟延迟内触发告警。这个题和 Cisco 的业务域很贴,老实说更容易用真实数字来推。

他们关注的点: 数据接入层(聊到了 Kafka,我讲了按 device ID 分区以及原因) 存储分层:热路径用 Redis 做实时告警,冷路径用 InfluxDB 或 Cassandra 这类时序库做趋势查询 告警 fanout 问题:当 1 万台设备同时越过阈值时,怎么避免 thundering herd

面试官很 technical,也很投入。他反驳了我选 Cassandra 的理由,还问我怎么在 5 年里处理 device type 不断变化下的 schema evolution。这种深挖能看出来这轮不是走过场。

有一点让我意外:他们不太走经典的“design Twitter (设计 Twitter)”或“design YouTube (设计 YouTube)”那种风格。prompt 更偏网络基础设施、安全监控,或者分布式 control plane 之类。结合产品面也合理,但如果你来自偏 consumer 的公司背景,这点值得提前知道。

时间安排:大概 10 分钟让我澄清需求,30 分钟画图和讨论,然后 10 分钟针对他们选的一个组件做 deep-dive。这轮不写代码。

整体我觉得是中等偏难。面试官很公平,没有坑。我最后没拿到 offer(到 final debrief 然后 no),但我觉得 design 这轮发挥还可以。可能同一天的 behavioral 把我绊住了。

有具体问题欢迎问。

由 AI 翻译,查看原文

4 条回复

sre_sol (Primly starter)

thundering herd 这个角度挺有意思。他们是想要一个完整的 circuit-breaker 方案,还是更关注 ingestion 层的 rate-limiting?我一直好奇在 60 分钟的 design 轮里,他们希望你把 failure modes 挖多深。

由 AI 翻译,查看原文

backend_bekah (Primly starter)

他们想要的方案到能看出你知道这个问题存在就够了。我画了 device 端的 exponential backoff + jitter,还有 consumer 端一个 queue depth 的阈值,触发后把 alerts 做 batching。他看起来认可这个概念,并不需要完整实现。千万别试图用 failure modes 自己硬撑满 60 分钟。

由 AI 翻译,查看原文

market_realist (Primly starter)

写得很好。Cisco 的领域特定性我两年前那轮完全没准备,结果设计面就因为这个炸了。「design Twitter(设计 Twitter)」那套肌肉在题目变成 network monitoring 时基本不太能迁移。

由 AI 翻译,查看原文

visa_vik (Primly starter)

从 design round 到 debrief 出决定一般要多久?我现在在 onsite 阶段,我的 H1B 情况意味着我真的需要在接下来 6-7 周内敲定一个结果。

由 AI 翻译,查看原文