О компании
Мы команда Yandex Global Network, часть Yandex Infrastructure — одной из крупнейших в стране и мире. Мы проектируем, строим и эксплуатируем сетевую инфраструктуру, которая обеспечивает работу абсолютно всех сервисов Яндекса и Yandex Cloud. Наша команда автоматизации отвечает за инструменты и платформы, которые делают сеть Yandex Cloud управляемой, предсказуемой и масштабируемой.
Обязанности
- Эксплуатация физической инфраструктуры: работа с «железными» серверами, на которых развёрнуты виртуальные сетевые функции и высокопроизводительные системы обработки трафика. Задачи включают наливку серверов, их обновление, диагностику и обеспечение отказоустойчивости.
- Поддержка и развитие инфраструктуры Kubernetes: администрирование кластеров, развёрнутых на физических серверах и в Yandex Cloud, обеспечение их стабильности, выполнение обновлений и масштабирование.
- Автоматизация операционных процессов: разработка и поддержка скриптов, Helm-чартов и инструментов для автоматизации развёртывания приложений и управления конфигурациями.
- Совершенствование мониторинга и надёжности: работа над улучшением системы мониторинга, логирования и алертинга.
Требования
- Администрировали Linux-системы больше трёх лет.
- Работали с Kubernetes: разворачивали и администрировали кластеры.
- Имеете опыт работы с IaC (Terraform, Ansible) и CI/CD-процессами.
- Умеете писать скрипты для автоматизации (bash), уверено читаете код и способны делать небольшие доработки в существующих приложениях (Python и Go).
- Хорошо знакомы с observability-системами (логами, метриками, трейсами, алертами).
- Понимаете основы сетевых технологий (L2/L3, TCP/IP) и не боитесь сетевой терминологии.
Условия
- Гибридный формат работы или офис в Москве.