ПАО «Сбербанк»
Наша команда создает линейку продуктов на основе мультимодальной нейросетевой модели GigaChat, которая является одной из самых мощных и продвинутых моделей искусственного интеллекта, доступных на сегодняшний день. Мы создаем удобный и понятный сервис, позволяющий людям использовать GigaChat для решения повседневных задач и развлечения: поиск ответов на вопросы, работа с документами, создание контента, изучение языков, общение с персонажами и многое другое. Мы ищем опытного Senior-инженера SRE, который возглавит развитие front-инфраструктуры. Вы будете отвечать не только за техническую реализацию, но и за менторство команды, архитектурные решения и стратегическое развитие надежности сервиса. Ваша ключевая задача — построение и развитие системы Observability для высоконагруженной micro-frontend архитектуры, обеспечение ее отказоустойчивости, масштабируемости и безопасности. Вы будете напрямую влиять на SLA/SLI/SLO сервиса и качество продукта, которым пользуются миллионы. Место работы: г Москва Требуемый опыт: От 3 до 6 лет Обязанности: * проектирование, внедрение и поддержка отказоустойчивой front-инфраструктуры giga.chat. * построение сквозной системы мониторинга, логирования и трейсинга (Observability) для micro-frontend систем. * организация процесса управления инцидентами (Incident Management), поиски (Root Cause), внедрение превентивных мер. * развитие инфраструктуры как кода (Infrastructure as Code), автоматизация процессов развертывания, масштабирования и управления конфигурациями. * наставничество Middle-инженеров, code-review инфраструктурного кода, развитие инженерных практик в команде. Требования: * Уровень: Senior (от 5 лет опыта в SRE/DevOps), наличие подтвержденного опыта на позиции Team Lead или готовность к руководящей роли. * Архитектура и сети: * Глубокое понимание принципов построения высоконагруженных и отказоустойчивых систем. * Экспертное знание сетевого стека (модель OSI, TCP/IP, BGP, DNS). Опыт диагностики сложных сетевых проблем в production-среде. * Экспертный уровень владения балансировщиками: NGiNX (включая Lua/NJS для сложной логики), HAProxy, Traefik. Опыт их тюнинга под экстремальные нагрузки. * Observability: * Успешный опыт построения комплексных систем Observability "с нуля" для микросервисных и micro-frontend архитектур. * Экспертиза в стеке Prometheus + Grafana: написание сложных PromQL-запросов, проектирование дашбордов и алертов. * Глубокое знание систем логирования (ELK Stack) и распределенной трассировки (Jaeger, Zipkin). Умение коррелировать метрики, логи и трейсы для быстрого поиска аномалий. * Безопасность: * Глубокие знания в области информационной безопасности. Опыт внедрения Zero Trust архитектуры, настройки WAF, защиты от DDoS-атак на уровне L7, управления секретами (Vault). * Инфраструктура: * Экспертный уровень администрирования Linux. * Экспертиза в Kubernetes: управление кластерами в production, написание Helm-чартов, диагностика проблем на уровне Control Plane и Data Plane. * Уверенное владение IaC-инструментами (Terraform, Ansible) на уровне написания модулей и ролей. Будет плюсом: * Опыт работы с облачными провайдерами (Sber Cloud, Yandex Cloud, AWS) на уровне построения гибридных инфраструктур. * Опыт работы с Service Mesh (Istio) * Опыт работы с базами данных (PostgreSQL, Elasticsearch, ClickHouse, Mongo) * Опыт работы с системами очередей и кеш-серверами (Kafka, Ignite, Redis) Условия: * стабильный оклад и премии по результатам работы, ежегодный пересмотр зарплаты * комфортный современный офис рядом с м.Кутузовская * гибридный формат работы: встречаемся очно в офисе 1 раз в неделю * корпоративный спортзал и зоны отдыха * уникальная система обучения Сбера для профессионального и карьерного развития * программа адаптации и помощь руководителя на старте * расширенный ДМС и льготное страхование семьи * гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ * бесплатная подписка СберПрайм, скидки на продукты компаний-партнеров * вознаграждение за рекомендацию друзей в команду Сбера * корпоративная пенсионная программа
Зарплата
Не указано