Обязанности Мониторинг состояния инфраструктуры и сервисов: Grafana/Prometheus, Kubernetes, Linux-серверы и инфраструктурные компоненты; Работа с логами и мониторингом: поиск ошибок и аномалий, обработка алертов, первичный анализ возникающих проблем; Первичная диагностика инцидентов: сбор и анализ логов и метрик, локализация проблемы, выполнение базовых действий по устранению или эскалация; Сопровождение Kubernetes-кластеров и работающих в них сервисов, выполнение типовых эксплуатационных операций; Работа с инфраструктурными компонентами: PostgreSQL/Patroni, Redis/Sentinel, Ceph, HAProxy/Keepalived; Сопровождение тестовых окружений и участие в проверке изменений перед внедрением в Production; Работа с CI/CD и GitLab Runner: первичный анализ проблем сборки и деплоя; Выполнение повседневных Linux и сетевых задач: диагностика сервисов, дисков, DNS, сетевой связности, сертификатов и доступности систем; Участие в разборе инцидентов и подготовке post-mortem; Ведение и актуализация технической документации, инструкций и инфраструктурных схем; Работа с IaC и постепенная автоматизация повторяющихся эксплуатационных операций; Взаимодействие с разработчиками и смежными техническими командами при решении инфраструктурных вопросов. Требования Базовое понимание Linux и желание развиваться в системном администрировании / DevOps / SRE; Умение работать с Linux CLI и понимание базовых команд диагностики системы; Базовое понимание компьютерных сетей: TCP/IP, DNS, HTTP/HTTPS, порты и сетевое взаимодействие; Понимание принципов работы клиент-серверных приложений; Базовые знания Git; Способность читать техническую документацию и самостоятельно искать информацию; Готовность разбираться в незнакомых системах и технологиях; Внимательность при работе с инфраструктурой и понимание необходимости согласования потенциально опасных изменений; Умение последовательно диагностировать проблему: собрать информацию, сформировать гипотезу и проверить её; Адекватная коммуникация и готовность своевременно сообщать о проблемах и задавать вопросы. Будет плюсом: Практический опыт работы или домашние проекты с Docker и Kubernetes; Знакомство с Grafana, Prometheus или другими системами мониторинга; Знакомство с GitLab CI/CD; Опыт работы с Ansible, Terraform или другими IaC/automation-инструментами; Базовое знакомство с PostgreSQL, Redis, HAProxy, Ceph; Опыт написания Bash/Python-скриптов; Понимание принципов High Availability и отказоустойчивых систем; Опыт работы системным администратором, инженером технической поддержки или эксплуатации; Глубокий практический опыт со всем перечисленным стеком не требуется — ищем junior-специалиста с хорошей технической базой, системным мышлением и желанием развиваться в направлении Infrastructure / DevOps / SRE. Условия Конкурентная заработная плата — обсудим по итогам интервью; Удаленный формат работы; График 5/2: с 09:00 до 18:00 или с 10:00 до 19:00; Предоставляем мощный рабочий ноутбук; 100% компенсация больничных; Скидка на изучение английского языка в Skyeng.
Похожие вакансии