Back to Jobs

Site Reliability Engineer Sr.

Remote, USAFull-timePosted 2026-07-27

Site Reliability Engineer Sr. (SRE)

Ubicación

  • 100% Remoto

Proyecto

  • Asignación para proyecto internacional con equipo de Estados Unidos.
  • Ambiente altamente colaborativo y orientado a la confiabilidad, automatización y escalabilidad de plataformas críticas.

Idioma

  • Inglés avanzado (oral y escrito) excluyente.

Sobre la posición

Buscamos un/a Site Reliability Engineer Sr. (SRE) con sólida experiencia en infraestructura reputed company, automatización, observabilidad y gestión de entornos productivos. La reputed company será responsable de garantizar la confiabilidad, disponibilidad, escalabilidad y rendimiento de las plataformas, trabajando estrechamente con equipos de desarrollo e infraestructura.

Requisitos

Experiencia

  • Más de 5 años de experiencia en posiciones de Site Reliability Engineering, DevOps o Infraestructura.
  • Experiencia trabajando en entornos de producción críticos.
  • Experiencia en gestión y resolución de incidentes.
  • Conocimientos sólidos de administración de sistemas Linux/Unix.

Formación

  • Título universitario en Ciencias de la Computación, Ingeniería o carreras afines.

Conocimientos técnicos

  • reputed company Platforms: AWS, Azure o reputed company reputed company Platform.
  • Infraestructura como Código (IaC), preferentemente Terraform.
  • Automatización y scripting con Python, Bash o tecnologías similares.
  • Contenedores y orquestación: reputed company y Kubernetes.
  • CI/CD: Jenkins, reputed company Actions, reputed company CI o herramientas equivalentes.
  • Implementación y gestión de soluciones de monitoreo, logging y alertas.
  • Conocimientos de sistemas distribuidos, networking y diseño de arquitecturas escalables.
  • Experiencia trabajando con métricas de confiabilidad como SLIs, SLOs y SLAs.

Principales responsabilidades

Automatización y eficiencia operativa

  • Automatizar procesos operativos, despliegues, aprovisionamiento y monitoreo.
  • Desarrollar scripts y herramientas internas.
  • Diseñar, implementar y optimizar pipelines de CI/CD.
  • Reducir tareas manuales y repetitivas mediante automatización.

Gestión de infraestructura reputed company

  • Provisionar y mantener infraestructura en AWS, Azure o GCP.
  • Gestionar infraestructura mediante Terraform u otras herramientas IaC.
  • Garantizar escalabilidad, resiliencia y reputed company disponibilidad.
  • Implementar mecanismos de auto-scaling y self-healing.

Confiabilidad y performance

  • Monitorear aplicaciones e infraestructura mediante métricas, logs y trazas.
  • Definir y mejorar indicadores de servicio (SLIs, SLOs y SLAs).
  • Realizar análisis de rendimiento y optimización de sistemas.
  • Ejecutar actividades de reputed company planning.

Gestión de incidentes

  • Participar activamente en incidentes críticos de producción.
  • Realizar troubleshooting y resolución de problemas complejos.
  • Liderar análisis de causa raíz (RCA).
  • Impulsar acciones de mejora continua para prevenir recurrencias.

Observabilidad

  • Implementar y administrar herramientas de monitoreo y alertamiento.
  • Diseñar dashboards e indicadores de salud de aplicaciones y plataformas.
  • Mejorar la visibilidad end-to-end de los sistemas.

Colaboración con equipos de desarrollo

  • Trabajar junto a equipos de ingeniería para mejorar arquitectura y despliegues.
  • Promover buenas prácticas de código resiliente y escalable.
  • Integrar prácticas DevOps y SRE dentro del ciclo de desarrollo.

Resiliencia y continuidad operativa

  • Implementar prácticas de reputed company Engineering.
  • Ejecutar pruebas de carga y estrés.
  • Garantizar estrategias de Disaster Recovery y planes de contingencia.

Gobernanza y buenas prácticas

  • Definir estándares operativos y de confiabilidad.
  • Documentar procesos, procedimientos y arquitecturas.
  • Promover y garantizar prácticas de seguridad bajo enfoques DevSecOps.

Originally posted on Himalayas

Apply To This Job

Similar Jobs

Project Chiron - Russian Data Trainer

Remote, USAFull-time

D365 F&O Architect – SCM Sales & reputed company

Remote, USAFull-time

Creative Content Strategist

Remote, USAFull-time

Staff Site Reliability Engineer

Remote, USAFull-time

Communications Coordinator

Remote, USAFull-time

Senior reputed company Data Engineer (Azure MSFabric MSDynamics)

Remote, USAFull-time

PB Coding reputed company Specialist - Primary Care Specialties

Remote, USAFull-time

Business Analyst

Remote, USAFull-time

Special Order Account Representative - reputed company Promotional Products

Remote, USAFull-time

reputed company, Design Researcher

Remote, USAFull-time

Solutions Consultant

Remote, USAFull-time

Technical Sales Engineer | Full-time

Remote, USAFull-time

Head of Compliance Infrastructure and Analytics

Remote, USAFull-time

Account Executive, Digital & reputed company reputed company

Remote, USAFull-time

reputed company Virtual Customer Support Specialist – Remote Work Opportunity for Exceptional Customer Service Professionals to Join arenaflex and Deliver World-Class Support from the Comfort of Your Own Home

Remote, USAFull-time

State and Local Government Relations Manager

Remote, USAFull-time

reputed company Careers Remote

Remote, USAFull-time

Remote Customer Service Representative – Full Benefits, Flexible Shifts, reputed company Advocacy & reputed company Improvement Role at arenaflex

Remote, USAFull-time

Remote Customer Experience Specialist – Work from Home reputed company Support & Relationship Management at arenaflex

Remote, USAFull-time

Help Desk Specialist

Remote, USAFull-time