Фоновое изображение

Старший инженер-разработчик (Сопровождение СХД TATLIN.UNIFIED)

Мы разрабатываем флагманский продукт компании YADRO – TATLIN.UNIFIED. Это современное хранилище данных (СХД), созданное для решения задач традиционных корпоративных приложений, больших данных и аналитики. Продукт развертывается в ЦОД, публичных и частных облаках, сочетая высокую надежность, масштабируемость и простоту эксплуатации.

Команда L4 осуществляет сопровождение продукта со стороны отдела разработки. Мы отвечаем за решение комплексных задач на стыке разработки и эксплуатации, развитие диагностических инструментов и упрощение сопровождения продукта.

Обязанности:

  • поддержка платформенных сервисов на базе Linux (механизмы инициализации и обновления системы, управление службами, сетевая подсистема, управление кластером) и управляющей подсистемы;
  • проведение расследований инцидентов, анализ отказов, поиск корневых причин (RCA);
  • исправление ошибок, поступающих от Заказчиков и сервисных команд. Выпуск хотфиксов и срочных исправлений;
  • разработка скриптов автоматизации, диагностических утилит и мониторинга;
  • развитие механизмов обновления и инсталляции, оптимизация сервисных процедур;
  • платформенная отладка: анализ поведения Linux (ядро, сервисы, syscalls, память, сеть);
  • экспертная поддержка: консультирование L3, документирование RCA, менторство, улучшение ремонтопригодности системы.

Требования:

  • уверенное знание Linux: внутреннее устройство, syscalls, управление памятью, процессы/потоки, базовые сервисы, файловые системы, инструменты отладки, работа с ядром и модулями;
  • владение Go и/или настойчивое желание глубоко развиваться в этом языке;
  • понимание особенностей работы многопоточного и конкурентного кода;
  • знание базовых алгоритмов и структур данных, принципов организации и обработки данных в памяти/на диске;
  • знание сетей и протоколов передачи данных (TCP/IP, маршрутизация, QoS, диагностика сетевого стека);
  • владение Python и Bash для написания скриптов автоматизации, диагностики и взаимодействия с инфраструктурой;
  • способность самостоятельно разбираться в новых областях, умение быстро погружаться в чужой код и работать с большой кодовой базой и кросс-зависимостями;
  • готовность к дежурствам с фокусом на анализ, профилактику и улучшение процессов, а не только на оперативное восстановление.

Будет плюсом, если вы:

  • владеете языком C;
  • имеете опыт работы с ETCD, Clusterlabs Pacemaker, Docker, NATS;
  • знакомы с особенностями серверного оборудования и аппаратными; подсистемами: CPU/RAM, NVMe/SATA/SCSI, RAID/HBA, BMC/IPMI, PCIe, interconnects (RDMA/FCoE/Ethernet);
  • знакомы с протоколами SCSI / NVMe;
  • имеете представление об iSCSI / Fibre Channel;
  • работали с диагностическими инструментами глубокого анализа.

Мы предлагаем

Анкета кандидата

Пожалуйста, заполните эту анкету, чтобы мы могли познакомиться с вами поближе.
  • 01
    ОткликПодача резюме
    или заполнение анкеты
  • 02
    ОтборПрохождение интервью
    и/или выполнение тестового задания
  • 03
    ОфферПолучение обратной связи
    и предложения о работе

Резюме

Выберите файл или перетяните его сюда

Не более 10 МБ (pdf, doc, docx)