EPAM logo

Lead Generative AI Operations Engineer (GenAI Ops)

EPAM·Salary not specified

Primary stack

DockerDevOpsCloudFormationKubernetesJenkinsPythonAWS CDKBashGitLab CITerraform

Nice to have's

Master’s or PhD in Computer Science, AI, or related fieldAWS Certified DevOps EngineerGoogle Cloud Professional DevOps EngineerLLM architecturesmulti-agent systems

Job description

Description language:

Про посаду

Ми шукаємо висококваліфікованого Lead Generative AI Operations Engineer (GenAI Ops) для приєднання до нашої передової команди AI. Ідеальний кандидат матиме значний досвід в операціоналізації масштабних генеративних AI систем, створенні CI/CD трубопроводів та управлінні інфраструктурою AI агентів у хмарних середовищах. Ви будете відігравати ключову роль у забезпеченні масштабованості, безпеки та продуктивності багатоагентних AI систем та генеративних додатків.

Обов'язки

  • Проектування, впровадження та підтримка автоматизованих CI/CD трубопроводів для розробки, навчання та розгортання Великих Моделей Мовлення (LLMs) та AI агентів
  • Створення та управління агентськими AI системами, забезпечення ефективної співпраці між агентами та оркестрації складних робочих процесів
  • Інтеграція AI агентів з зовнішніми інструментами та API за допомогою сучасних стандартів, таких як Model Context Protocol (MCP)
  • Використання AI-інструментів розробки для оптимізації доставки програмного забезпечення, управління інфраструктурою та процесів усунення несправностей
  • Визначення та управління хмарною інфраструктурою для робочих навантажень GenAI за допомогою інструментів Infrastructure as Code (IaC), таких як Terraform, AWS CDK або CloudFormation
  • Впровадження рішень для моніторингу та спостереження за моделями, агентами та станом системи за допомогою інструментів, таких як Prometheus, Grafana або Datadog
  • Оптимізація масштабованості, продуктивності та ефективності витрат генеративних AI сервісів у виробничих середовищах
  • Забезпечення практик безпеки, надійності та управління AI, дотримання організаційних та галузевих стандартів

Вимоги

  • Мінімум 3 роки досвіду в DevOps, Site Reliability Engineering (SRE)
  • Мінімум 1 рік досвіду в MLOps ролях з акцентом на хмарну інфраструктуру
  • Перевірені знання AWS, Google Cloud або Azure
  • Знання Python або Bash, досвід роботи з інструментами контейнеризації/оркестрації, такими як Docker та Kubernetes
  • Значний досвід у створенні та підтримці CI/CD трубопроводів за допомогою Jenkins, GitLab CI або аналогічних інструментів
  • Досвід роботи з хмарними платформами GenAI (наприклад, AWS Bedrock, Azure AI Foundry, Google Vertex AI)
  • Знання архітектур LLM та викликів, пов'язаних з розгортанням масштабних моделей
  • Досвід проектування або управління багатоагентними системами та оркестрованими робочими процесами AI
  • Практичний досвід впровадження інфраструктури за допомогою IaC фреймворків
  • B2+ рівень володіння англійською мовою

Буде плюсом

  • Магістерський чи PhD ступінь в галузі комп'ютерних наук, AI або суміжних областях
  • Відповідні сертифікати з хмари чи DevOps (наприклад, AWS Certified DevOps Engineer, Google Cloud Professional DevOps Engineer)
  • Сильний проблемно-орієнтований підхід та здатність працювати в швидкозмінному, інноваційному середовищі

Ми пропонуємо

  • Можливість працювати з передовими технологіями AI
  • Віддалена робота з Києва, Україна
  • Бути частиною динамічної та інноваційної команди

Про компанію

EPAM Systems є глобальною компанією з інженерії програмного забезпечення та розробки продуктів, яка надає цифрову трансформацію та технологічні інновації клієнтам у різних галузях.

© EPAM. This job description was sourced from the employer's public career page. TheJob is not the employer — we index the posting and route candidates to the source. All content rights and hiring decisions belong to the employer.

EPAM helps organizations innovate their business processes and rethink the way they manage their businesses so they can remain competitive in this new digital age.

More at EPAM

All 2376 roles

Popular searches