Platform / DevOps Tech Lead — интервью
75 минут, tech lead. Platform engineering, SRE, IaC, процессы, инциденты, команда.
- Вопросов
- 17
Разогрев: роль и контекст
Scope platform team
Какую platform/infrastructure команду вели? Сколько product teams обслуживали?
Рубрика оценки (0–10)
3–5: «DevOps один на всех». 6–8: Team size; internal customers; on-call model; key platforms (K8s, CI, observability). 9–10: Product mindset for platform; roadmap; cost accountability. Красный флаг: ticket-driven ops без strategy.
Подсказки интервьюеру
5 минут.
Platform strategy
Golden path
Как строили golden path для product teams (deploy service за N минут)?
Рубрика оценки (0–10)
3–5: «Helm chart shared». 6–8: Templates; docs; self-service portal; sensible defaults. 9–10: Metrics time-to-production; feedback loop; optional escape hatches documented. Красный флаг: platform team as gatekeeper only.
Подсказки интервьюеру
5 минут.
SLO program
Как внедряли SLO/error budget на уровне организации, не только одной команды?
Рубрика оценки (0–10)
3–5: «Uptime dashboard». 6–8: SLI catalog; tiering services; error budget policy; exec review. 9–10: Reliability council; investment vs feature trade-offs; customer-facing SLOs. Красный флаг: 100% availability target org-wide.
Подсказки интервьюеру
5 минут.
FinOps
Cloud bill вырос 2× за год. Как platform lead подходит к оптимизации?
Рубрика оценки (0–10)
3–5: «Выключить dev clusters». 6–8: Cost allocation tags; right-sizing; reserved instances; idle resources. 9–10: Unit economics per team; autoscaling policies; architectural cost review. Красный флаг: blame product teams без tooling/visibility.
Подсказки интервьюеру
4 минуты.
IaC governance
Terraform/OpenTofu в 15 командах: как избежать хаоса state и модулей?
Рубрика оценки (0–10)
3–5: «Shared repo» без boundaries. 6–8: Module registry; state per env; PR review; drift detection. 9–10: Policy as code (OPA/Sentinel); blast radius; staged applies. Красный флаг: local terraform apply on prod.
Подсказки интервьюеру
5 минут.
Operations и инциденты
Incident management program
Как выстроили incident management: severity, roles, comms, postmortems?
Рубрика оценки (0–10)
3–5: «PagerDuty шлёт SMS». 6–8: SEV definitions; incident commander; status page; blameless postmortem template. 9–10: Game days; toil tracking; action item SLA; trend analysis. Красный флаг: postmortem = поиск виноватых.
Подсказки интервьюеру
5 минут.
Здоровье on-call
On-call burnout в platform team. Что меняли в процессах?
Рубрика оценки (0–10)
3–5: «Наняли ещё одного». 6–8: Rotation fairness; runbooks; alert tuning; follow-the-sun optional. 9–10: Error budget ties to ops investment; auto-remediation; management escalation. Красный флаг: permanent hero on-call for one person.
Подсказки интервьюеру
4 минуты.
K8s upgrades
Major Kubernetes upgrade на prod. Как планируете и минимизируете риск?
Рубрика оценки (0–10)
3–5: «kubectl upgrade». 6–8: Staging parity; API deprecation scan; node pool rolling; rollback plan. 9–10: Blue/green control plane; workload compatibility matrix; comms window. Красный флаг: skip minor versions «экономим время».
Подсказки интервьюеру
5 минут.
Люди и процессы
Partnership с разработкой
Product team обходит platform и деплоит «свой» K8s. Ваши действия?
Рубрика оценки (0–10)
3–5: «Запретить» или «пусть делают». 6–8: Understand need; offer paved path; set guardrails; timeline to migrate. 9–10: Internal marketing of platform; embed SRE; executive alignment on standards. Красный флаг: territorial war without user outcome focus.
Подсказки интервьюеру
5 минут.
Закрытие
Провести интервью по этому шаблону
Зарегистрируйтесь бесплатно: скопируйте шаблон в организацию, назначьте интервью и проведите его в комнате с live-coding.
Начать в FlashTalk