Tech Stack
Job Description, Responsibilities & Requirements
Про посаду
Ми шукаємо проактивного Middle Big Data Engineer для приєднання до нашої команди в Україні. На цій посаді ви будете відповідальним за проектування, розробку та підтримку масштабовних дата-піплайнів і готових до звітності даних активів у Palantir Foundry. Ідеальний кандидат матиме міцний досвід у хмарних технологіях, архітектурі даних і захоплення від вирішення складних задач з даними.
Обов'язки
- Співпраця з міжфункціональними командами для збору бізнес-вимог і проектування, впровадження та підтримки масштабовних дата-піплайнів у Palantir Foundry, забезпечуючи цілісність даних від початку до кінця і оптимізовані робочі процеси
- Проектування та підтримка піплайнів інтеграції, трансформації та оркестрації даних за допомогою Palantir Foundry, Python та PySpark
- Розробка готових до звітності наборів даних і моделей даних для підтримки нижчого рівня аналітики та звітності Power BI
- Розробка, оптимізація та підтримка ефективних процесів ETL/ELT для збору, обробки та інтеграції даних з кількох джерел, забезпечуючи своєчасну і точну доставку даних
- Впровадження перевірки якості даних, моніторингу та перевірок стану для забезпечення надійності та узгодженості даних активів
- Моніторинг продуктивності піплайнів, виявлення вузьких місць, усунення проблем у виробництві та постійне підвищення масштабованості та ефективності обробки
- Планування та визначення пріоритетів роботи самостійно, прозоре повідомлення про хід роботи та проактивне управління зміною пріоритетів, пропонуючи практичні рішення при зміні вимог
- Ведення чіткої технічної документації та заохочення автоматизації та постійного вдосконалення процесів інженерії даних
- Зберігання актуальності щодо нових технологій та кращих практик галузі, включення інноваційних підходів у рішення з інженерії даних
Вимоги
- 3+ роки досвіду в інженерії даних, бажано в фармацевтичній або біомедичній галузі
- Глибоке знання Python та PySpark
- Досвід роботи з технологіями великих даних (наприклад, Apache Hadoop, Spark, Kafka, BigQuery тощо)
- Практичний досвід роботи з хмарними сервісами (наприклад, AWS Glue, Azure Data Factory, Google Cloud Dataflow)
- Досвід у моделюванні даних, дата-варахаусінгу та концепціях ETL/ELT
- Практичний досвід роботи з системами баз даних (наприклад, PostgreSQL, MySQL, NoSQL тощо)
- Знання технологій контейнеризації (наприклад, Docker, Kubernetes)
- Ефективні навички вирішення проблем та аналітичні здібності, поєднані з чудовими комунікаційними та коопераційними здібностями
Буде плюсом
- Досвід роботи з даними маркетингових досліджень
- Знання Veeva CRM, Reltio, SAP та/або Palantir Foundry
- Досвід у фармацевтичній або медичній галузі
- Досвід автоматизації / оптимізації піплайнів
Ми пропонуємо
- Гнучний робочий формат - віддалено, в офісі або гнучко
- Конкурентоспроможна зарплата та хороший компенсаційний пакет
- Персоналізований кар'єрний ріст
- Інструменти професійного розвитку (програма наставництва, технічні лекції та тренінги, центри досконалості тощо)
- Активні технічні спільноти з регулярним обміном знаннями
- Компенсація витрат на освіту
- Пам'ятні подарунки до ювілеїв
- Корпоративні заходи та командоутворення
- Інші місцеві переваги
не застосовується до фрілансерів
Про компанію
Наш клієнт є провідною світовою організацією охорони здоров'я, яка сприяє інноваціям у фармацевтичній, біотехнологічній та пацієнтоорієнтованій сферах. Вони розробляють передові рішення з даних та аналітики, які допомагають світовим організаціям перетворювати складні дані в зрозумілі цифрові інструменти, дозволяючи командам приймати обґрунтовані рішення у своїй щоденній діяльності та довгостроковій стратегії. Їх проекти охоплюють сучасні операційні додатки, інтерактивні дашборди та передові платформи аналітики, призначені для надання дійсних знань у різних бізнес-доменах.