Ищем инженера, который будет отвечать за инфраструктуру хранения данных, виртуализацию, Linux и сети MLOps-платформы. Основной фокус роли - Ceph, Proxmox, Linux и сети. Около 30% задач будут связаны с Kubernetes и DevOps. Обязанности: Развивать и сопровождать Ceph: OSD, PG, CRUSH, RBD, RGW/S3, Erasure Coding. Заниматься балансировкой, производительностью и планированием ёмкости Ceph. Диагностировать проблемы с дисками, сетью, восстановлением и распределением данных. Развивать кластеры Proxmox/KVM и инфраструктуру виртуализации. Работать с физическими серверами, SSD/NVMe, файловыми системами и блочными устройствами. Развивать и диагностировать сети: VLAN, bonding, маршрутизация, MTU, 10/25/100 GbE. Диагностировать и оптимизировать производительность Linux, сети и дисковой подсистемы. Планировать обновления и миграции с учётом отказоустойчивости и возможности отката. Автоматизировать типовые инфраструктурные операции. Участвовать в эксплуатации Kubernetes и подхватывать DevOps-задачи команды. Требования: Сильные знания Linux и опыт эксплуатации производственной инфраструктуры. Практический опыт эксплуатации Ceph. Хорошее понимание архитектуры Ceph: OSD, PG, CRUSH, MON, MGR. Опыт работы с RBD и RGW/S3. Опыт эксплуатации Ceph Erasure Coding. Опыт работы с Proxmox VE/KVM и кластерами Proxmox. Хорошее понимание блочных устройств, файловых систем, SSD/NVMe. Хорошее понимание TCP/IP, VLAN, bonding, MTU и маршрутизации. Опыт диагностики производительности Linux, сети и хранилищ. Практический опыт работы с Kubernetes. Опыт автоматизации инфраструктуры с Ansible. Умение работать с мониторингом инфраструктуры и метриками Prometheus/Grafana. Будет плюсом: Опыт эксплуатации сетей 25/40/100 GbE. Опыт с Terraform. Опыт работы с Cilium. Опыт эксплуатации GPU-серверов. Опыт глубокой оптимизации Linux, сетевой и дисковой подсистем. Опыт построения резервного копирования и аварийного восстановлени. Опыт работы с инфраструктурой для Spark, Data Platform или ML Platform. Что важно для нас: Ищем не только администратора Ceph и не только Kubernetes/DevOps-инженера. Нужен специалист, способный видеть инфраструктуру целиком: серверы -> сеть -> Linux -> виртуализация -> хранилище -> Kubernetes и самостоятельно находить причины сложных инфраструктурных проблем, оценивать риски и предлагать надёжные решения. Условия: Команду инженеров, которые умеют решать сложные задачи и делиться опытом. Официальное трудоустройство в соответствии с ТК РФ в аккредитованную IT-компанию. ДМС и страхование от несчастных случаев с первой рабочей недели, оплату больничных за первые 10 дней до 100% от оклада. Гибкий формат работы: Удаленная работа по РФ, либо гибридный формат работы в самом центре Москвы, в офисе по ул. Мясницкая, 16. Современная техника для работы (Macbook, мониторы, и все что вам нужно для комфортной работы. Возможность поработать в атмосфере небольшой уютной дружной компании, где все решается быстро, в дружеской обстановке и без бюрократии. Ежегодные корпоративы с компенсацией дороги и проживания. Конкурентную зарплату по результатам собеседования.
Похожие вакансии
Senior Network Infrastructure Engineer
Договорная
Москва. Станции метро: Кузнецкий мост, Лубянка, Тургеневская, Китай-город
Ventra
Senior Software / Infrastructure Engineer
Договорная
Москва. Станции метро: Кузнецкий мост, Лубянка, Тургеневская, Китай-город
EYES OF WONDER SOFTWARE LLC
Senior Infrastructure Security Engineer
Договорная
Москва. Станции метро: Кузнецкий мост, Лубянка, Тургеневская, Китай-город
DatsTeam
Infrastructure NetOps Engineer
Договорная
Москва. Станции метро: Кузнецкий мост, Лубянка, Тургеневская, Китай-город
DatsTeam
Infrastructure Security Engineer
Договорная
Москва. Станции метро: Кузнецкий мост, Лубянка, Тургеневская, Китай-город
НОРСИ-ТРАНС
MLOps / ML Infrastructure Engineer
Договорная
Москва. Станции метро: Кузнецкий мост, Лубянка, Тургеневская, Китай-город
X5 Tech