Детальная страница вакансии
Работа в IT
ООО МТС Веб Сервисы
Москва
Гибкий график
Гибридный
3-6 лет
Lead Product SRE в Скоринг [Big Data, МТС Веб Сервисы]
Описание вакансии
Скоринг - это коммерческий B2B продукт для уменьшения рисков и затрат B2B-клиентов. Скоринг состоит из 2-х направлений: рисковый и антифрод.
Чем предстоит заниматься
- Управлять сервисами и практиками надежности ИТ-продуктов: формировать бэклог, определять стратегию SRE для продуктов;
- Внедрять единую методологию управления надежностью (SLA/SLO/SLI) совместно со смежными Big Data продуктами, обеспечивая сквозную стабильность инфраструктуры и приложений кластера;
- Проектировать и развивать общие стандарты отказоустойчивости распределенных систем;
- Лидировать кросс-продуктовые рабочие группы по надежности: внедрять создание единых стандартов мониторинга, алертинга и распределенной трассировки для Big Data инфраструктуры;
- Управлять эффективностью использования ресурсов (Capacity Planning) высоконагруженных кластеров в масштабах всей экосистемы продуктов;
- Выстраивать общую культуру разбора инцидентов со смежными командами, превращая аварии на стыке систем в общие инженерные практики и системные улучшения;
- Менторить команды разработки и аналитики, помогая им проектировать сервисы с учетом нефункциональных требований и продуктовых SLO.
Что мы ожидаем
- Опыт работы в роли SRE / Infrastructure / Platform Lead или Technical Product Manager (Platform) от 3 лет в крупных высоконагруженных или Big Data проектах;
- Продуктовое мышление: умение собирать требования у внутренних клиентов (разработка, дата-инженеры), приоритизировать бэклог и оцифровывать надежность в бизнес-метрики;
- Практический опыт выстраивания общих технических стандартов и процессов в кросс-продуктовой среде;
- Отличное понимание специфики надежности Big Data решений и Highload-архитектуры: принципы работы аналитических БД (Hadoop, Clickhouse) распределенных брокеров (Apache Kafka), и микросервисов;
- Экспертные знания в области построения систем сквозного наблюдаемости (Observability: Prometheus, VictoriaMetrics, OpenTelemetry, Grafana) на стыке инфраструктуры и бизнес-метрик;
- Глубокое понимание архитектурных паттернов отказоустойчивости распределенных систем и жизненного цикла поставки ценности;
- Сильные коммуникативные навыки: умение договариваться, защищать продуктовые метрики перед стейкхолдерами и мягко внедрять инженерные изменения.
Что мы предлагаем
- Собственную платформу MTS Ocean для получения ИТ-ресурсов, а это значит, что деплой, мониторинг, observability — не будут для тебя проблемой, ты сможешь сосредоточиться на фичах;
- Профессиональные гильдии инженеров, где мы поддерживаем друг друга и помогаем стать лучше;
- Внутреннюю площадку TechTalks для обмена опытом, дискуссий, развития навыков самопрезентации;
- Участие во внешних IT конференциях. Мы выступаем на HighLoad++, DataFest, Mobius, Test Driven Conf, Joker, DevOps, Матемаркетинг и даже проводим собственную конференцию по архитектуре True Tech Arch;
- Полезные курсы и вебинары в корпоративном университете и электронную библиотеку.
- А еще:
- ДМС с первого месяца работы, включая стоматологию;
- Страхование от несчастных случаев с 1 месяца работы. Материальную помощь в сложных жизненных ситуациях;
- Отпуск 28 календарных дней;
- Прием врачей общей практики и массаж в офисе;
- Мобильная связь за счет компании и льготные тарифы для близких;
- Подписка на онлайн-кинотеатр KION, сервис МТС Музыка, книжный сервис Строки от МТС, безлимитные мессенджеры и соцсети.