About the Role:BOSS Revolution helps millions of people around the world stay connected with family and friends through international calling, mobile top-up, ...
Site Reliability Engineer
Описание вакансии
Мы ищем SRE-инженера в группу Data and Storage, который возьмёт на себя надёжность баз данных, распределённых хранилищ и связанных с ними инфраструктурных сервисов.
Обязанности:
- Обеспечение надёжной работы кластеров Cassandra, ClickHouse и PostgreSQL: отказоустойчивость, репликация, масштабирование, обновление и восстановление после сбоев.
- Эксплуатация Cassandra Reaper: планирование и контроль repair-процессов с учётом нагрузки на кластеры и pending compactions.
- Эксплуатация и развитие S3-совместимых хранилищ, включая развёртывание SeaweedFS в Kubernetes.
- Миграция с MinIO на SeaweedFS.
- Обеспечение надёжной работы Kafka.
- Развитие собственной системы раздачи игровой статики на базе S3-хранилища, CDN и Nginx: маршрутизация, кэширование и диагностика.
- Поддержка других систем хранения данных и инфраструктурных сервисов.
- Автоматизация инфраструктуры с помощью Ansible, Jinja2 и Shell, развитие GitOps-подхода с Helm и ArgoCD.
- Автоматизация резервного копирования, восстановления и аварийного переключения.
- Проведение HA-тестов, написание runbook-ов и участие в разборе инцидентов.
Требования:
- Опыт работы DevOps / SRE / Platform-инженером от 2–3 лет.
- Практический опыт эксплуатации Cassandra в production.
- Понимание архитектуры Cassandra: replication, consistency levels, repair, compaction и data distribution.
- Опыт эксплуатации PostgreSQL или ClickHouse.
- Опыт работы с распределёнными файловыми или объектными хранилищами.
- Понимание Kubernetes и особенностей эксплуатации stateful-сервисов в нём.
- Опыт работы с Helm и Ansible, умение читать и изменять YAML/Jinja2-конфигурации.
- Опыт автоматизации эксплуатационных задач с помощью Shell/Bash.
- Linux на уровне advanced: systemd, networking, файловые системы, дисковая подсистема и диагностика производительности.
- Понимание принципов высокой доступности, резервного копирования и восстановления данных.
- Опыт управления инцидентами: troubleshooting, root cause analysis и post-mortem
Будет плюсом:
- Опыт эксплуатации крупных Cassandra-кластеров и Cassandra Reaper.
- Опыт работы с SeaweedFS или MinIO.
- Опыт эксплуатации Kafka.
- Опыт построения систем раздачи статического контента на базе S3, CDN и Nginx.
- Опыт работы с GitOps и ArgoCD.
- Умение использовать AI-инструменты в инженерной работе.
Ссылка на Общереспубликанский банк вакансий на информационном портале государственной службы занятости не размещается на основании абз. 5 ст. 34 закона Республики Беларуси "О занятости населения"
О компании «ГеймТек»

ООО "ГеймТек" является одним из ведущих международных разработчиков многопользовательских игр для браузера, социальных сетей и мобильных платформ. В 2017 году мы достигли цели и исполнили свою мечту: открыли подразделение PC/Console разработки! В данный момент две команды активно работают над сессионным MMO файтингом в стиле dark-fantasy и прототипированием наших новых игр!
НАШ СТАНДАРТНЫЙ НАБОР РАДОСТЕЙ:
- причастность к созданию игр, в которые ежедневно играют миллионы людей во всём мире;
- медицинское страхование;
- внутрикорпоративные курсы рисования и английского языка;
- внутренние/внешние семинары и конференции;
- компенсация спорта Allsports platinum;
- небольшой, но очень приятный бонус ко дню рождения;
- корпоративные мероприятия: день рождения компании, релизы и дни рождения проектов, Новый год и др.;
- игровая комната с огромной плазмой, джойстиками, рулями, педалями, настольным теннисом для быстрой перезарядки.



