Разработчик Hadoop (senior)
Описание
IT-компания GNIVC - партнер государственных компаний и лидеров российского бизнеса, разработчик и системный интегратор крупнейших государственных информационных систем, а также коммерческих решений для налогового мониторинга. Компания входит в ТОП-100 лучших работодателей страны и на 9-м месте в категории «IT-компании» 2025 года по рейтингу работодателей hh.ru среди крупных компаний; Мы в 25% лучших по уровню счастья среди компаний отрасли IT и России 2025 по версии Happy Job; У нас есть ИИ-песочница - среда для экспериментов и реальных проектов на современных опенсорс-больших языковых моделях. Здесь можно применять ИИ для оптимизации своей работы, автоматизации процессов и реализации собственных идей от гипотезы до результата; Являемся аккредитованной ИТ-компанией. Мы ищем опытного разработчика для проектов по обработке больших данных с потенциалом роста до тимлида в части bigdata. В задачи входит разработка и поддержка распределённых процессов обработки данных на базе Apache Spark (Java/Scala) с интеграцией в экосистему Hadoop (HDFS, Hive, HBase), а также взаимодействие с системами Oracle/Postgres и потоковыми данными через Kafka. Работа ведётся в кластере ADH. Задачи: разработка и поддержка Big Data на крупном проекте; разработка и сопровождение ETL-процессов и потоковых пайплайнов на Spark (Java/Scala); интеграция с источниками и хранилищами данных: HDFS, Hive, HBase, Oracle, Postgres, Kafka, ClickHouse; написание SQL-запросов; оптимизация производительности Spark job’ов и процессов загрузки/выгрузки; участие в проектировании архитектуры и внедрение лучших практик разработки под Big Data; оптимизация производительности на уровне кластера (тюнинг Spark, partitioning, broadcasting). Требования: опыт коммерческой разработки на Java и Scala: 5+ лет опыта разработки, из них 2–3 года в Big Data; практический опыт работы с Apache Spark; знание экосистемы Hadoop (HDFS, Hive, HBase); опыт работы с Kafka; хорошее знание SQL; опыт работы с реляционными СУБД; уверенное владение Linux; глубокое понимание Spark internals (RDD/DataFrame API, shuffle, Catalyst Optimizer); опыт оптимизации производительности; понимание принципов распределённых систем (HDFS, Zookeeper, YARN); опыт взаимодействия с бизнес-заказчиками/аналитиками (умение переводить требования в архитектуру решения). Мы предлагаем: гибкие форматы работы: возможность работы в офисе, по гибридному графику или полностью дистанционно на территории РФ; рабочий график: пятидневная рабочая неделя (пн.–чт. с 09:00 до 18:00, пт. с 09:00 до 16:45); достойное вознаграждение: конкурентная заработная плата по результатам собеседования, а также премии за эффективную работу и достигнутые результаты; официальное трудоустройство: полное соблюдение требований ТК РФ, включая оплачиваемые отпуска (с дополнительной выплатой 50% от оклада после 11 месяцев работы в Компании) и выплату заработной платы дважды в месяц; заботу о здоровье: компенсация больничного листа продолжительностью до 7 дней с сохранением полной оплаты, эквивалентной рабочему дню, добровольное медицинское страхование (ДМС) по окончании испытательного срока, с широким перечнем ведущих медицинских учреждений, включая качественную стоматологию, возмещение до 50% затрат на занятия спортом; развитие и обучение: профессиональное обучение и сертификация за счет компании, организация внутренних и внешних митапов, хакатонов, конференций, семинаров и тренингов, партнерские программы по изучению иностранных языков и развитию профессиональных навыков от Skyeng и Skillbox, доступ к корпоративной библиотеке на платформе Alpina Digital; дополнительные выходные: возможность взять 5 дополнительных оплачиваемых выходных (ресурсных) дней в течение календарного года (с 1 января до 31 декабря) для сотрудников, проработавших в компании более 11 месяцев.