8404 активных вакансий
← Все вакансии

ANT2WQPQ Опубликовано 4 сен 2 просмотров

Инженер по обеспечению надежности сайта в сетевой инфраструктуре

Nebius внешнее объявление
Нанимают из: Europe, Netherlands Удалённо Полная занятость IT / программирование
По договорённости Приём откликов до

Переведено автоматически с языка оригинала.

О Nebius:

Nebius возглавляет новую эру в облачной инфраструктуре для глобальной экономики ИИ. Мы создаем полнофункциональную облачную платформу ИИ, которая поддерживает разработчиков и предприятия от обучения данным и моделям до развертывания в производстве, без затрат и сложности создания большой внутренней инфраструктуры ИИ/МО.

Создано инженерами для инженеров. От крупномасштабной оркестровки GPU до оптимизации вывода, мы владеем сложными проблемами в области вычислений, хранения, сетевого взаимодействия и прикладного ИИ.

Входит в список Nasdaq (NBIS) и штаб-квартирой в Амстердаме, мы имеем глобальное присутствие с центрами исследований и разработок по всей Европе, Великобритании, Северной Америке и Израилю. Наша команда из более 1500 человек включает сотни инженеров с глубоким опытом в области аппаратного, программного обеспечения и исследований и разработок ИИ. Роль Мы ищем инженера по обеспечению надежности сайта, чтобы помочь построить и управлять фундаментальной частью Nebius - сетью - инфраструктурой, от которой зависит все остальное. Это инженерная роль SRE: вы будете устанавливать четкие цели надежности, создавать инструменты и автоматизацию для их достижения и делать сеть более безопасной для эксплуатации по мере быстрого масштабирования. Ваши обязанности будут включать:

  • Определение и владение целями надежности для сетевых услуг и критических путей (SLI/SLO, цели доступности, бюджеты ошибок, где это имеет смысл)
  • Управление улучшениями надежности по всей сети: не только услуги, но также готовность сайта, межсайтовая связность (DCI) и операционные стандарты
  • Владение реагированием на инциденты в ваших областях, руководство расследованиями/постмортемами и превращение сбоев в прочные исправления (а не повторное тушение пожаров)
  • Создание и развитие наблюдаемости: действенные метрики/журналы/трассы, оповещения и более быстрые циклы отладки во время и после инцидентов
  • Разработка более безопасных рабочих процессов изменений: автоматизация, CI/CD, тестовые/стадионные среды, канонизация, отмена и аудируемость изменений сети
  • Тесное сотрудничество с сетевыми инженерами и платформенными командами для внедрения управляемости в проекты и сохранения практической и быстрой эксплуатации

Мы ожидаем от вас:

  • Сильных производственных основ Linux и структурированного подхода к отладке сложных систем
  • Твердого понимания сетевых основ и того, как реальные сети терпят неудачу (плоскость управления и плоскость данных, задержка/потеря, домены сбоев и т. д.)
  • Практического опыта эксплуатации высокодоступных систем и их улучшения со временем (а не просто «поддержание свечения»)
  • Умения писать и поддерживать программное обеспечение/автоматизацию (Go часто используется у нас; Python также приветствуется)
  • Опыта работы с современными инфраструктурными инструментами (например, IaC, CI/CD, контейнерными платформами) и комфорта с автоматизацией операционных рабочих процессов

Дополнительным преимуществом будет, если у вас есть:

  • Опыт работы с высокопроизводительной обработкой трафика: балансировщики нагрузки, туннелирование/декapsulation, NAT64 или подобные системы с интенсивным трафиком
  • Фоновые знания о низкоуровневой сетевой производительности/отладке (eBPF/XDP, DPDK, perf/ftrace, внутренние механизмы сетевого взаимодействия ядра)
  • Опыт создания безопасных сетевых конвейеров доставки (тестовые лаборатории, поэтапное внедрение, автоматическая проверка, обнаружение отклонений)
  • Фоновые знания о крупномасштабной сетевой наблюдаемости/телеметрии (например, телеметрия маршрутизации/потока, обнаружение регрессии в масштабе)

Преимущества и льготы:

  • Конкурентная компенсация
  • Возможности карьерного роста и обучения
  • Гибкость и ответственность
  • Коллаборативная и инновационная культура
  • Возможность работать над impactful проектами ИИ
  • Международная среда и талантливые команды

Что значит работать в Nebius:

Быстрое движение - Смелое мышление - Постоянный рост - Значимое влияние - Доверие и реальная ответственность - Возможность формировать будущее ИИ

Заявление о равных возможностях:

Nebius - это работодатель с равными возможностями. Мы привержены созданию инклюзивной и разнообразной рабочей среды и предоставлению равных возможностей трудоустройства во всех аспектах занятости. Мы не дискриминируем по признаку расы, цвета кожи, религии, пола (включая беременность), национального происхождения, происхождения, возраста, инвалидности, генетической информации, семейного положения, статуса ветерана, сексуальной ориентации, гендерной идентичности или выражения, или любого другого признака, защищенного применимым законом.

Заявители должны иметь разрешение на работу в стране, в которой они подают заявление, и будут обязаны предоставить доказательство права на трудоустройство в качестве условия приема на работу.

Если вам нужны accommodations во время процесса подачи заявления, пожалуйста, сообщите нам.

Поделиться этой страницей FacebookTelegramLinkedInX

Пожаловаться

Это ваше объявление?

Мы публикуем копию этого объявления, чтобы его нашли те, кто ищет работу в Грузии, со ссылкой на первоисточник. Если оно ваше, вы можете взять управление им на себя, или попросить нас его снять.

Полученное объявление становится прямым: показывается выше зеркальных копий, отклики приходят в вашу панель, а объявление попадает в поиск вакансий Google.

О работодателе
Nebius
Сайт ↗
Похожие объявления

Нанимайте в Грузии без лишних хлопот

Бесплатно для всех