Старший инженер-разработчик (Сопровождение СХД TATLIN.UNIFIED)
Мы разрабатываем флагманский продукт компании YADRO – TATLIN.UNIFIED. Это современное хранилище данных (СХД), созданное для решения задач традиционных корпоративных приложений, больших данных и аналитики. Продукт развертывается в ЦОД, публичных и частных облаках, сочетая высокую надежность, масштабируемость и простоту эксплуатации.
Команда L4 осуществляет сопровождение продукта со стороны отдела разработки. Мы отвечаем за решение комплексных задач на стыке разработки и эксплуатации, развитие диагностических инструментов и упрощение сопровождения продукта.
Обязанности:
- поддержка платформенных сервисов на базе Linux (механизмы инициализации и обновления системы, управление службами, сетевая подсистема, управление кластером) и управляющей подсистемы;
- проведение расследований инцидентов, анализ отказов, поиск корневых причин (RCA);
- исправление ошибок, поступающих от Заказчиков и сервисных команд. Выпуск хотфиксов и срочных исправлений;
- разработка скриптов автоматизации, диагностических утилит и мониторинга;
- развитие механизмов обновления и инсталляции, оптимизация сервисных процедур;
- платформенная отладка: анализ поведения Linux (ядро, сервисы, syscalls, память, сеть);
- экспертная поддержка: консультирование L3, документирование RCA, менторство, улучшение ремонтопригодности системы.
Требования:
- уверенное знание Linux: внутреннее устройство, syscalls, управление памятью, процессы/потоки, базовые сервисы, файловые системы, инструменты отладки, работа с ядром и модулями;
- владение Go и/или настойчивое желание глубоко развиваться в этом языке;
- понимание особенностей работы многопоточного и конкурентного кода;
- знание базовых алгоритмов и структур данных, принципов организации и обработки данных в памяти/на диске;
- знание сетей и протоколов передачи данных (TCP/IP, маршрутизация, QoS, диагностика сетевого стека);
- владение Python и Bash для написания скриптов автоматизации, диагностики и взаимодействия с инфраструктурой;
- способность самостоятельно разбираться в новых областях, умение быстро погружаться в чужой код и работать с большой кодовой базой и кросс-зависимостями;
- готовность к дежурствам с фокусом на анализ, профилактику и улучшение процессов, а не только на оперативное восстановление.
Будет плюсом, если вы:
- владеете языком C;
- имеете опыт работы с ETCD, Clusterlabs Pacemaker, Docker, NATS;
- знакомы с особенностями серверного оборудования и аппаратными; подсистемами: CPU/RAM, NVMe/SATA/SCSI, RAID/HBA, BMC/IPMI, PCIe, interconnects (RDMA/FCoE/Ethernet);
- знакомы с протоколами SCSI / NVMe;
- имеете представление об iSCSI / Fibre Channel;
- работали с диагностическими инструментами глубокого анализа.
Мы предлагаем
Анкета кандидата
Пожалуйста, заполните эту анкету, чтобы мы могли познакомиться с вами поближе.- 01ОткликПодача резюме
или заполнение анкеты - 02ОтборПрохождение интервью
и/или выполнение тестового задания - 03ОфферПолучение обратной связи
и предложения о работе