О компании Nebius:
Nebius возглавляет новую эру в облачной инфраструктуре для глобальной экономики ИИ. Мы создаём полнофункциональную AI-облачную платформу, которая поддерживает разработчиков и предприятия от работы с данными и обучения моделей до развертывания в производстве, без затрат и сложности создания крупной внутренней инфраструктуры ИИ/МО.
Создано инженерами для инженеров. От масштабной оркестрации GPU до оптимизации вывода — мы решаем сложные задачи в области вычислений, хранения, сетей и прикладного ИИ.
Компания котируется на Nasdaq (NBIS) и имеет штаб-квартиру в Амстердаме, с глобальным присутствием и исследовательскими центрами в Европе, Великобритании, Северной Америке и Израиле. В нашей команде из более чем 1500 человек сотни инженеров с глубокими знаниями в области аппаратного обеспечения, программного обеспечения и исследований ИИ.
Роль
Эта позиция находится в рамках Nebius Token Factory — нашей бессерверной платформы для запуска и настройки открытых LLM в производстве. Token Factory позволяет выполнять бессерверный вывод и дообучение, поддерживаемые внутренними оптимизациями, такими как кастомное спекулятивное декодирование, квантизация, маршрутизация с учётом кэша и выделенные конечные точки. Клиенты обращаются к нам, чтобы перейти от прототипа к масштабному производству без затрат и сложности создания и настройки собственного стека вывода.
Наши архитекторы решений отвечают за техническую реализацию взаимодействия с клиентами: развертывание открытых моделей, настройку стека обслуживания, бенчмаркинг по критериям успеха клиента и сопровождение технических отношений до производства. Инженеры по продажам квалифицируют и оценивают возможности; архитекторы решений реализуют их. Технические менеджеры по работе с клиентами берут на себя сопровождение после запуска в производство.
Мы ищем Менеджера по архитектуре ML-решений для руководства региональными командами архитекторов решений в ЕС. Ваша зона ответственности — реализация PoC и техническая поддержка после продаж: люди, которые это делают, стандарты, по которым они работают, и операционный ритм, который обеспечивает предсказуемость. Вы будете подчиняться руководителю архитектуры решений и сотрудничать с коллегой-менеджером из другого региона.
Мы ожидаем, что вы будете подталкивать сотрудников, когда это необходимо, принимать непростые решения, если результаты не достигнуты, несмотря на приложенные усилия, и брать на себя ответственность за документацию: внедрять и контролировать соблюдение руководств, порядок в тикетах и гарантировать, что команда действительно использует все три.
Вы можете работать удалённо из любой страны ЕС.
Ваши обязанности будут включать:
Руководство командой
- Управление командой из 8 архитекторов решений с планами дальнейшего роста: индивидуальные встречи, постановка целей, оценка эффективности, рассмотрение случаев повышения и планы развития сотрудников
- Формирование точного представления о сильных сторонах, пробелах и предпочтениях каждого архитектора решений и распределение аккаунтов и проектов с учётом как экспертизы, так и интересов
- Организация ритма работы, который выявляет блокировки на ранних этапах, затем передача их в команды разработки, продукта и бизнеса для решения и контроль до устранения
- Требование результатов: отделять усилия от достигнутых результатов, прямо говорить, когда они расходятся, и отражать это в оценках и решениях по компенсациям
- Введение новых сотрудников в работу до их первого самостоятельного проекта
- Коучинг архитекторов решений для повышения их инженерных и коммуникативных навыков, а также принятие осознанных решений о готовности к расширению зоны ответственности
Ответственность за выполнение
- Ответственность за результаты работы команды: время от запуска PoC до первой оптимизированной выделенной конечной точки, процент достижения критериев успеха и качество технических отношений после запуска клиента в производство
- Проверка технической работы до её передачи клиенту: методология бенчмаркинга, конфигурации обслуживания, результаты, документы закрытия; выявление неправильных выводов, основанных на артефактах метрик, до того, как клиент их увидит
- Обеспечение достаточного штата и покрытия эскалаций по аккаунтам и часовым поясам, включая нагрузку по запросам после продаж, которая не учитывает границы спринтов
- Раннее и обоснованное выявление невозможности выполнения, чтобы команда не тратила итерации на требования, которые платформа сегодня не может удовлетворить
Ответственность за операционную систему команды
- Поддержка и расширение документации команды: обязанности, инструкции, руководства, ввод в должность, определения завершённости, шаблоны закрытия проектов. Поддержание её в актуальном и доступном состоянии; использовать ссылки, а не копировать
- Обеспечение использования документации, а не просто её написания: документация, которую никто не читает, — это издержки, а не актив
- Поддержание трекера тикетов как системы учёта, чтобы статус PoC и производства был понятен без необходимости спрашивать
- Инструментирование работы: определение и отчётность по метрикам, показывающим, становится ли выполнение быстрее и надёжнее со временем
Взаимодействие с другими командами
- Команды разработки и исследований: преобразование повторяющихся проблем клиентов в приоритетные задачи платформы и представление технической реальности клиента в обсуждениях дорожной карты
- Предпродажи: контроль границы между оценкой и выполнением: отстаивание интересов при недостаточной оценке проектов и обратная связь о реализуемости
- Менеджмент аккаунтов: обеспечение беспроблемной передачи в производство и поддержание движения технических запросов после продаж
- Бизнес и руководство: предоставление честной оценки состояния аккаунтов, технической реализуемости и потребностей в ресурсах
Мы ожидаем от вас:
- 3+ года опыта управления техническими командами, включая управление эффективностью и проведение сложных разговоров
- Опыт управления командой, работающей с клиентами. Руководство командой, чья работа видна клиентам, с учётом их сроков и эскалаций.
- Глубокие знания в области машинного обучения: архитектуры LLM, методы дообучения (SFT/LoRA, на основе RL), проектирование оценки и практическое понимание внутренностей вывода — квантизация, управление KV-кэшем, батчинг, маршрутизация, спекулятивное декодирование — а также фреймворков, с которыми работает команда (vLLM, SGLang, TensorRT-LLM)
- Достаточный технический опыт, чтобы проверить чужой бенчмарк и найти ошибку в методологии, а не только в выводах
- Уверенное владение Python для чтения и проверки кода команды
- Отличные коммуникативные навыки, способность ясно объяснять технические концепции разным аудиториям — от инженеров до руководителей, включая выступления перед корпоративными клиентами в стрессовых ситуациях
- Истинное терпение к операционной работе: документация, проектирование процессов, отчётность и контроль за их соблюдением
- Комфорт работы в условиях неопределённости в распределённых командах и разных часовых поясах, склонность всё записывать
Будет плюсом, если у вас есть:
- Рекомендации как от бывших руководителей, так и от бывших подчинённых
- Опыт масштабирования команды в условиях быстрого роста (с 5 до 15+ человек) без потери качества выполнения
- Предыдущий опыт в технической роли, ориентированной на клиентов, в облачной, инференсной или AI-инфраструктурной компании
- Опыт определения процессов и документации для команды, у которой их не было
- Практический опыт запуска LLM в производстве и отладки инференсных нагрузок на уровне фреймворка
- Работа с мультимодальными AI-моделями (визуально-языковыми, речевыми)
- Знание инструментов DevOps (Docker, Kubernetes) и инфраструктуры как кода
Предпочтительный технический стек:
- Языки программирования: Python
- ML-фреймворки и библиотеки: vLLM, TensorRT-LLM, SGLang, Transformers, SDK OpenAI/Anthropic
- MLOps и DevOps инструменты: Kubernetes (K8s), Docker, Git
- Облачные платформы: AWS (SageMaker, Bedrock), GCP (Vertex AI), Azure (Azure ML)
Преимущества и бонусы:
- Конкурентоспособная компенсация
- Возможности карьерного роста и обучения
- Гибкость и автономия
- Культура сотрудничества и инноваций
- Возможность работать над значимыми AI-проектами
- Международная среда и талантливые команды
Каково работать в Nebius:
Быстрое развитие - Смелые идеи - Постоянный рост - Значимое влияние - Доверие и реальная ответственность - Возможность формировать будущее ИИ
Заявление о равных возможностях:
Nebius является работодателем, предоставляющим равные возможности. Мы стремимся создавать инклюзивную и разнообразную рабочую среду и обеспечивать равные возможности трудоустройства во всех аспектах занятости. Мы не допускаем дискриминации по признаку расы, цвета кожи, религии, пола (включая беременность), национального происхождения, происхождения, возраста, инвалидности, генетической информации, семейного положения, статуса ветерана, сексуальной ориентации, гендерной идентичности или выражения, или любой другой характеристики, защищённой применимым законодательством.
Кандидаты должны иметь разрешение на работу в стране, в которой они подают заявку, и будут обязаны предоставить подтверждение права на трудоустройство как условие найма.
Если вам необходимы условия для прохождения процесса подачи заявки, пожалуйста, сообщите нам.