Сайт-релиабилити инженер (SRE)
Bright Vision Technologies ищет опытного Site Reliability Engineer для удаленной работы. Вы будете обеспечивать надежность и производительность крупных распределенных систем, автоматизировать операции и внедрять лучшие практики SRE. Требуется 5+ лет опыта, знание Kubernetes, Python/Go, мониторинга и CI/CD. Компания предлагает конкурентоспособную зарплату и долгосрочную занятость.
Эта вакансия платит больше рынка
На 157% выше медианы DevOps по 67 вакансиям за 90 дней.
Что предстоит делать
Штаб-квартира: Удаленно URL: http://bvteck.com Bright Vision Technologies — это прогрессивная компания по разработке программного обеспечения, стремящаяся создавать инновационные решения, которые помогают businesses автоматизировать и оптимизировать свою деятельность. Мы используем передовые технологии для создания масштабируемых, безопасных и удобных приложений. По мере нашего роста мы ищем квалифицированного инженера по надежности сайтов (SRE) для присоединения к нашей динамичной команде и внесения вклада в нашу миссию по трансформации бизнес-процессов с помощью технологий. Это отличная возможность присоединиться к устоявшейся и уважаемой организации, предлагающей огромный потенциал карьерного роста. Инженер по надежности сайтов (SRE) Должность: Инженер по надежности сайтов (SRE) Местоположение: 100% удаленно (континентальная часть США) Тип позиции: Внутренний проект Bright Vision Technologies SOW (без участия стороннего клиента или вендора) Зарплата: $100 000 - $150 000 в год Опыт: 5+ лет Спонсорство: Спонсорство новых виз H1B не предоставляется. Переводы H1B для квалифицированных кандидатов приветствуются. Тип занятости: Полная занятость, прямая занятость W2 с Bright Vision Technologies (без C2C, без 1099, без посредников) Занятость: Долгосрочная, многолетняя, привязанная к дорожной карте выполнения SOW Bright Vision. Компенсация: Конкурентная базовая зарплата, соответствующая опыту, плюс льготы. Условия трудоустройства и визовая политика Это 100% удаленная, полная занятость, прямая позиция W2 в компании Bright Vision Technologies. Эта роль является частью внутреннего проекта Bright Vision Technologies по договору подряда (SOW). Клиент, конечный заказчик и работодатель для этой должности — Bright Vision Technologies — никакие сторонние клиенты, вендоры или партнеры по внедрению не участвуют. Мы не используем схемы C2C, 1099 или сторонние договоренности для этой роли. НО СТРОГО БЕЗ КОМПАНИЙ C2C/1099/3RD PARTY. ВСЕ НАШИ ВАКАНСИИ — W2, ПОЖАЛУЙСТА, БЕЗ ПОСРЕДНИЧЕСТВА СТОРОННИХ КОМПАНИЙ. Кандидаты должны быть готовы работать напрямую в качестве штатного сотрудника W2 компании Bright Vision Technologies и вносить вклад в наши внутренние результаты по SOW. Спонсорство новых виз H1B для этой роли не предоставляется. Однако кандидаты, которые в настоящее время имеют действительную визу H1B и нуждаются в переводе, могут подавать заявки. Мы поддержим переводы H1B для квалифицированных кандидатов. Для каждой роли обязательно прохождение технического оценочного задания по кодингу. Пожалуйста, подавайте заявку только если вы уверены в своих технических навыках и практическом опыте. Краткое описание должности Мы ищем опытного инженера по надежности сайтов, который обеспечит доступность, производительность и операционное совершенство крупномасштабных распределенных систем в production. Как SRE, вы будете находиться на границе между разработкой и эксплуатацией, применяя сильные принципы программной инженерии к задачам инфраструктуры и эксплуатации, постоянно продвигая платформу к более высокой надежности с меньшими операционными издержками. Идеальный кандидат сочетает глубокие знания систем с сильными навыками программирования, мышлением, основанным на измерениях, и дисциплиной для проектирования, автоматизации и эксплуатации сложных сервисов, чтобы надежность стала первостепенной инженерной задачей, а не реактивной проблемой. Ключевые обязанности Определять, внедрять инструментарий и постоянно совершенствовать целевые уровни обслуживания (SLO), индикаторы уровня обслуживания (SLI) и бюджеты ошибок для критически важных сервисов, используя эти показатели для принятия конкретных инженерных решений и расстановки приоритетов. Руководить реагированием на инциденты и их разрешением в случае производственных проблем, выступая в роли спокойного и эффективного руководителя инцидента при необходимости, и обеспечивая качественный посмертный анализ инцидентов, ведущий к долгосрочным улучшениям. Проектировать и внедрять комплексные стратегии мониторинга, логирования и трассировки с использованием Prometheus, Grafana, OpenTelemetry, ELK/EFK, Datadog или аналогичных инструментов, чтобы операторы имели полную и действенную видимость поведения системы. Создавать и поддерживать надежные процессы дежурств, плейбуки и пути эскалации, которые сокращают среднее время обнаружения и среднее время устранения, защищая при этом благополучие инженеров, находящихся на дежурстве. Агрессивно автоматизировать операционную рутину, создавая production-уровневые инструменты на Python, Go, Bash или аналогичных языках, заменяя ручные рабочие процессы надежной, проверяемой автоматизацией. Проектировать архитектуру и эксплуатировать крупномасштабные кластеры Kubernetes и рабочие нагрузки на основе контейнеров, включая автоматическое масштабирование, планирование мощностей, сетевые политики и интеграцию с сервисными сетками. Проектировать CI/CD пайплайны, которые обеспечивают безопасные, частые и наблюдаемые релизы, поддерживаемые автоматическим тестированием, канареечными развертываниями, функциональными флагами и стратегиями постепенного развертывания. Руководить деятельностью по планированию мощностей и инженерии производительности, создавая модели, прогнозирующие рост и нагрузку, и проверяя эти модели с помощью нагрузочного тестирования и хаос-экспериментов. Тесно сотрудничать с командами разработки приложений, чтобы внедрять практики надежности на ранних этапах проектирования, включая анализ режимов отказов, шаблоны корректной деградации и укрепление зависимостей. Повышать устойчивость платформы с помощью хаос-инжиниринга, внедрения отказов, изоляции зависимостей, повторных попыток, таймаутов, автоматических выключателей и хорошо протестированных путей переключения на резерв. Совместно с командами безопасности обеспечивать непрерывное улучшение состояния безопасности, включая управление исправлениями, устранение уязвимостей и настройки платформы по умолчанию, ориентированные на безопасность. Вносить вклад в техническую дорожную карту по инструментам надежности, платформам наблюдаемости и улучшениям опыта разработчиков, которые снижают трения и улучшают результаты для инженерных команд. Наставлять инженеров по всей организации в практиках SRE и способствовать созданию сильной, безобвинительной культуры операционного совершенства. Требуемая квалификация Степень бакалавра в области компьютерных наук, инженерии или смежной технической дисциплине. Пять или более лет опыта работы SRE, DevOps или инженером по эксплуатации production-систем, поддерживающих крупномасштабные распределенные системы. Сильные навыки программирования как минимум на одном из языков: Python, Go или Java, с возможностью создавать надежную автоматизацию и инструменты. Глубокий практический опыт эксплуатации Linux в масштабе, включая работу с сетями, настройку производительности и устранение неисправностей на уровне системы. Опыт работы в production с эксплуатацией Kubernetes и контейнерных рабочих нагрузок. Хорошее практическое знание инструментов наблюдаемости, таких как Prometheus, Grafana, OpenTelemetry, ELK/EFK или их коммерческих аналогов. Практический опыт проектирования и эксплуатации CI/CD пайплайнов как для инфраструктуры, так и для приложений. Твердое понимание проектирования распределенных систем, включая модели согласованности, секционирование и семантику отказов. Подтвержденный опыт руководства реагированием на инциденты и проведения эффективных посмертных анализов. Отличные коммуникативные навыки и навыки документирования. Предпочтительная квалификация Опыт определения и внедрения в эксплуатацию SLO и бюджетов ошибок в реальных производственных средах. Знакомство с практиками и инструментами хаос-инжиниринга, такими как Chaos Monkey, Gremlin или Litmus. Практический опыт работы как минимум с одной крупной облачной платформой (AWS, Azure или GCP). Опыт в планировании мощностей, инженерии производительности или крупномасштабном нагрузочном тестировании. Знакомство с технологиями сервисных сеток, такими как Istio, Linkerd или Consul. Как подать заявку Хотите узнать больше об этой возможности? Для немедленного рассмотрения, пожалуйста, отправьте свое резюме на [email protected] или свяжитесь с нами по телефону (908) 505-3899. Узнайте больше о Bright Vision Technologies на www.bvteck.com. Мы признаем, что наши сотрудники — наша сила, и разнообразные таланты, которые они привносят в нашу глобальную команду, напрямую связаны с нашим успехом. Мы — работодатель с равными возможностями и высоко ценим разнообразие и инклюзивность в нашей компании. Мы не дискриминируем по признаку любой защищенной характеристики, включая расу, религию, цвет кожи, национальное происхождение, пол, сексуальную ориентацию, гендерную идентичность, гендерное самовыражение, возраст, семейное положение или статус ветерана, беременность или инвалидность, или любые другие признаки, защищенные применимым законодательством. Мы также предоставляем разумные приспособления для религиозных обрядов и убеждений соискателей и сотрудников, а также для потребностей, связанных с психическим здоровьем или физическими ограничениями. Bright Vision Technologies — работодатель с равными возможностями, включая инвалидов и ветеранов. Должность предлагается «Агентством без комиссии». Заявление о равных возможностях трудоустройства (EEO) Bright Vision Technologies (BV Teck) стремится к обеспечению равных возможностей трудоустройства (EEO) для всех сотрудников и соискателей без учета расы, цвета кожи, религии, пола, сексуальной ориентации, гендерной идентичности или самовыражения, национального происхождения, возраста, генетической информации, инвалидности, статуса ветерана или любого другого защищенного статуса, как это определено применимыми федеральными законами, законами штата или местными законами. Это обязательство распространяется на все аспекты занятости, включая подбор персонала, найм, обучение, оплату труда, продвижение по службе, перевод, отпуска, увольнение, сокращение штата и отзыв из отпуска. BV Teck категорически запрещает любые формы домогательств или дискриминации на рабочем месте. Любое неправомерное вмешательство в способность сотрудников выполнять свои должностные обязанности может повлечь за собой дисциплинарные меры вплоть до увольнения. Для подачи заявки: https://weworkremotely.com/remote-jobs/bright-vision-technologies-site-reliability-engineer-sre-1
Стек и инструменты
Подходит ли вам эта вакансия?
Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть
Ещё в Bright Vision Technologies
2 активные вакансии в компании
Site Reliability Engineer (SRE)
Компания Bright Vision Technologies ищет Senior SRE для поддержки и развития крупных распределенных систем. Вы будете отвечать за надежность, автоматизацию, мониторинг и управление инцидентами. Требуется опыт с Kubernetes, Python/Go, CI/CD и Linux. Предлагается удаленная работа на полный день с зарплатой $100K-$150K в год.
Похожие вакансии
6 вакансий
DevOps Engineer (Azure)
~481 576 – 563 796 ₸ оценка
Шукаємо досвідченого DevOps інженера для роботи з Azure-інфраструктурою. Потрібно проєктувати хмарні середовища, автоматизувати CI/CD, керувати Kubernetes та забезпечувати спостережуваність. Компанія SoftServe пропонує гнучкий графік, конкурентну зарплату та можливості для розвитку.
Старший DevSecOps инженер
~1 791 000 – 3 372 642 ₸ оценка
Ищем Senior DevSecOps инженера для страховой компании. Нужно автоматизировать безопасность в CI/CD пайплайнах, интегрировать инструменты сканирования и управлять уязвимостями в AWS и Azure. Требуется опыт с Terraform, Kubernetes и продуктами безопасности. Предлагают полную удаленку и конкурентную зарплату.
Платформенный инженер (Platform Engineer)
~481 576 – 563 796 ₸ оценка
Платформенный инженер для построения внутренней платформы на Kubernetes, GitOps и AWS. Нужно автоматизировать инфраструктуру, создавать инструменты для разработчиков и активно использовать AI в повседневной работе. Требуется 7+ лет опыта, уверенное владение AWS, Kubernetes, ArgoCD и Terraform. Предлагают удаленную работу, обучение и бонусы.
Системный инженер (Proxmox, VMware, Linux, Windows)
~1 791 000 – 3 372 642 ₸ оценка
Компания ищет опытного системного инженера для управления и развития корпоративной IT-инфраструктуры. Основные задачи: администрирование Proxmox и VMware, настройка сетей и серверов (Windows/Linux), обеспечение безопасности по стандартам PCI-DSS. Предлагается удаленная работа, гибкий график и соцпакет.
DevOps инженер (Kubernetes, GCP)
~1 791 000 – 3 372 642 ₸ оценка
Patrianna ищет опытного DevOps инженера для работы над инфраструктурой социального гейминга. Вы будете проектировать и поддерживать кластеры Kubernetes на GCP, строить CI/CD пайплайны и внедрять GitOps. Требуется глубокий опыт с Kubernetes, Terraform и облачными технологиями. Предлагают полную удаленку и 30 дней отпуска.
DevOps / Системный администратор
~1 791 000 – 3 372 642 ₸ оценка
FORTECH ищет опытного DevOps-инженера для управления инфраструктурой на OpenStack, публичных облаках и bare metal. Требуется глубокое знание Linux, сетей, Terraform и Ansible. Предлагают полную удаленку, гибкий график, зарплату в долларах и релокацию в Грузию.