Найду дата-инженера, который строит надёжные пайплайны данных: ETL, хранилища, потоки. Чтобы аналитика и ML работали на чистых данных, а не на ручных выгрузках.
Инженер данных (Data Engineer) отвечает за инфраструктуру данных: собирает, очищает и доставляет данные из разных источников в хранилища, строит пайплайны ETL/ELT, на которых работают аналитика и ML.
Проектирует хранилища и витрины, пишет пайплайны (Airflow, Spark и др.), следит за качеством и доступностью данных, оптимизирует обработку больших объёмов. Результат — чистые, надёжные данные под аналитику и продукт.
Вилки ориентировочные — зависят от ниши, стека и формата. Актуальные цифры под ваш запрос назову на созвоне.
Сильный описывает ETL/ELT, оркестрацию и качество.
Проверяем зрелость: тесты данных, алерты.
Должен знать партиционирование, Spark, оптимизацию.
Инженер строит инфраструктуру, а не отчёты.
Данные молча ломаются.
На больших объёмах всё встаёт.
Разберёмся, какой грейд и опыт вам реально нужен. Часто на этом шаге вакансия меняется — и поиск становится точнее.
Ищу через data-инженерные сообщества и личные связи, а не отклики. Многие сильные сидят в найме и на job-бордах не появляются.
Смотрю не на резюме, а на то, как человек реально думает и решает задачи. В шортлист — 3–5 человек; дальше сопровождаю до выхода и помогаю с адаптацией.
Расскажите про задачу — за пару дней вернусь с планом и первыми кандидатами. Без обязательств.
Обсудить задачу →