О ВАС
Мы ищем Site Reliability Engineer (Monetization) — прагматичного product-minded специалиста, который одинаково уверенно пишет код и эксплуатирует production systems, — в SRE-команду Infrastructure department. Вы будете end-to-end отвечать за application-level infrastructure и reliability высоконагруженного Monetization domain: deploy pipelines, Kubernetes manifests, SLO, capacity planning и production readiness.
Нужны сильные Kubernetes, observability и software engineering skills, опыт cloud production GCP/GKE или аналогов и тесная работа с product development teams. Важно понимать и developer delivery, и требования надёжной infrastructure и подключаться к design decisions заранее.
Это hybrid embedded роль: вы остаетесь частью SRE organization с её practices, standards и duty rotation, но функционально встроены в Monetization product domain. Вы выстроите долгосрочные отношения с engineering teams, возьмёте значимую часть application infrastructure execution и будете совместно определять company-wide reliability practices.
Если вам нравится делать сложные distributed systems предсказуемо надёжными и строить monetization backbone для разработчиков игр, будем рады познакомиться.
О КОМПАНИИ
Xsolla — глобальная commerce компания для игровой индустрии. Подробнее: xsolla.com.
ОБЯЗАННОСТИ
- Отвечать за application-level infrastructure Monetization domain: Helm, Terraform, Kubernetes deployments, runtime config, networking и integrations.
- Отвечать за observability: SLO/SLI, monitors, alerts и dashboards Datadog/OpenTelemetry.
- Развивать CI/CD GitLab CI/GitHub Actions с deploy/rollback automation.
- Capacity planning, load testing и performance tuning перед launches, sales events и regional rollouts.
- Production Readiness Reviews и стандарты production-ready.
- Поддержка incident response, post-mortems, reliability improvements и runbooks.
- Domain automation: runbook automation, deploy helpers, recurring scripts.
- Reliability roadmap вместе с product engineering leads.
- Участие в planning, refinements и architecture reviews до фиксации design decisions.
- Совместная разработка company-wide SLO/SLI, capacity и operational standards и улучшение shared SRE systems.
- SRE duty rotation.
КВАЛИФИКАЦИЯ И НАВЫКИ
- 3+ года SRE/DevOps/platform engineering с on-call, SLO/monitoring, deploy pipelines и infrastructure production services.
- Backend development background и способность читать application code и писать production automation на Go/PHP или другом языке.
- Hands-on Kubernetes: Helm, manifests, deploy strategies, performance/network debugging.
- Observability Datadog или Prometheus/Grafana, OpenTelemetry.
- Terraform/Terragrunt.
- GCP IAM/networking/managed services.
- GitLab CI/GitHub Actions.
- Python/Go/Bash automation.
- Incident response/post-mortems и follow-up reliability improvements.
- Сильные collaboration и communication skills.
- Payments, fintech, e-commerce или gaming/high-traffic transactions.
БУДЕТ ПЛЮСОМ
Kubernetes, Google Cloud Platform и HashiCorp certifications.
ПРЕИМУЩЕСТВА…
Текст вакансии длинный, здесь показана его часть. Полностью — на сайте студии.
Отклик принимает студия на своём сайте. LOOTWORK только показывает вакансию.