
Senior/Lead Machine Learning Engineer
Primary stack
Nice to have's
Job description
Про посаду
Ми шукаємо здібного Senior/Lead Machine Learning Engineer для приєднання до нашої віддаленої команди у Львові, Україна. Обраний кандидат відіграватиме значну роль у створенні, розробці та управлінні нашим ML-піплайн, використовуючи стандарти галузі.
На цій посаді ви будете зосереджені на створенні, розгортанні, утриманні, діагностиці та покращенні компонентів у межах ML-піплайн. Крім того, ви будете керувати розробкою та розгортанням ML-ендпоінтів прогнозування. Співпраця з системними інженерами для створення фреймворка управління життєвим циклом ML та просування передових практик кодування буде критичним.
Ми вітаємо інноваційних людей, які бажають стати частиною нашої динамічної команди!
Обов'язки
- Сприяти розробці, розгортанню та управлінню ML-піплайн, відповідно до кращих практик
- Розробляти, розгортати, утримувати, діагностувати та покращувати компоненти ML-піплайн
- Керувати розробкою та розгортанням ML-ендпоінтів прогнозування
- Співпрацювати з системними інженерами для створення фреймворка управління життєвим циклом ML
- Писати специфікації, документацію та керівництва для користувачів для додатків
- Покращувати практики кодування та організовувати репозиторії в межах наукового робочого процесу
- Налаштовувати піплайн для різних проектів
- Визначати технічні ризики та невідповідності, пропонуючи стратегії пом'якшення
- Працювати з дата-сайєнтистами для операціоналізації предиктивних моделей, забезпечуючи чітке розуміння цілей та цілей моделі, і розробляти масштабовані піплайн для підготовки даних
Вимоги
- 5+ років досвіду програмування, з акцентом на Python та сильні знання SQL
- Знання інструментів та фреймворків MLOps (наприклад, Sagemaker, Vertex, Azure ML)
- Досвід у Data Science, Data Engineering та DevOps Engineering на проміжному рівні
- Докази виконання щонайменше одного проекту в якості MLE
- Експертиза у передових практиках інженерії
- Навички використання екосистеми Apache Spark (Spark SQL, MLlib/SparkML) або еквівалентних технологій для дата-продуктів
- Знання технологій Big Data (наприклад, Hadoop, Spark, Kafka, Cassandra, GCP BigQuery, AWS Redshift, Apache Beam тощо)
- Знання роботи з інструментами автоматизації піплайн та управління робочими процесами даних, такими як Airflow або Argo Workflow
- Розуміння різних парадигм обробки даних, включаючи batch, micro-batch та streaming
- Досвід роботи з принаймні одним великим постачальником хмарних послуг, таким як AWS, GCP чи Azure
- Знання інтеграції ML-моделей у складні, дата-інтенсивні системи
- Знання технологій DS, таких як Tensorflow, PyTorch, XGBoost, NumPy, SciPy, Scikit-learn, Pandas, Keras, Spacy, HuggingFace, Transformers
- Здібності до роботи з багатьма типами баз даних, включаючи реляційні, NoSQL, графові, документальні, стобцеві, часові ряди тощо
Буде плюсом
- Досвід у MLOps-пов'язаних інструментах або технологіях Databricks, включаючи MLFlow, Kubeflow, TensorFlow Extended (TFX)
- Знання інструментів тестування продуктивності, таких як JMeter або LoadRunner
- Знання технологій контейнеризації, таких як Docker
Про компанію
EPAM Systems є глобальною компанією з інженерії програмного забезпечення та розробки продуктів, яка співпрацює з провідними світовими компаніями для надання технологічних рішень, що сприяють цифровій трансформації та інноваціям.
© EPAM. This job description was sourced from the employer's public career page. TheJob is not the employer — we index the posting and route candidates to the source. All content rights and hiring decisions belong to the employer.
EPAM helps organizations innovate their business processes and rethink the way they manage their businesses so they can remain competitive in this new digital age.