Vagas
Entrar
Entrar
Raízen

RaízenVerificada

11346293 - SRE Sênior

BrazilSênior / EspecialistaRemotoSalário a combinar

Sobre a empresa

Somos uma empresa brasileira presente no seu dia a dia. Dos postos e produtos Shell, sempre no seu caminho, até a produção de açúcar, etanol e energia renovável. Aqui, segurança, integridade, colaboração e simplificação são a forma como a gente trabalha.

Com mais de 30 mil pessoas, construímos juntos um ecossistema integrado que vai do campo, no cultivo da cana-de-açúcar, até a produção e comercialização de etanol, açúcar e bioenergia. Também atuamos, sob licença da marca Shell, na distribuição de combustíveis, lubrificantes e especialidades no Brasil.

Se você é uma pessoa resiliente, que se move com velocidade, enfrenta desafios como oportunidades e acredita que colaboração é o caminho, a Raízen pode ser o seu lugar. Por aqui, o aprendizado vem da prática e o trabalho ganha mais sentido quando é feito junto. Todas as nossas vagas estão abertas a pessoas de qualquer orientação afetivo-sexual, identidade de gênero, raça, etnia e idade, com ou sem deficiência. O que importa aqui é a vontade de crescer, contribuir e fazer a diferença.

Sobre a vaga

Procuramos uma pessoa Engenheira de Confiabilidade de Sistemas (SRE) Sênior para atuar na sustentação, evolução e garantia da confiabilidade de plataformas críticas. Se você se move com velocidade, enfrenta desafios como oportunidades e acredita que a colaboração é o melhor caminho, esta vaga pode ser ideal para você. Nessa posição, você terá um papel estratégico na evolução das práticas de SRE, com forte foco em observabilidade, monitoração e automação em ambientes cloud e Kubernetes, ajudando a construir uma operação altamente resiliente, escalável e orientada a dados. Todas as nossas vagas são abertas para todas as pessoas, valorizando a diversidade e o compromisso em fazer a diferença.

Responsabilidades

  • Apoiar ambientes distribuídos em Azure e AWS, atuando na evolução da observabilidade corporativa utilizando ferramentas como Grafana, Prometheus, OpenTelemetry, Loki, Tempo e Zabbix.
  • Realizar troubleshooting de ambientes críticos, análise de causas raízes (RCA) e estruturação de dashboards, alertas e indicadores operacionais.
  • Trabalhar em estreita colaboração com os times de desenvolvimento, arquitetura e infraestrutura para garantir a performance, disponibilidade e qualidade das aplicações.
  • Evoluir práticas de automação, GitOps e monitoramento de ambientes Kubernetes (AKS/EKS), promovendo a melhoria contínua da plataforma com foco em governança, segurança e eficiência.
  • Apoiar iniciativas de monitoração de aplicações, infraestrutura, métricas, coleta de logs e tracing distribuído.


Requisitos obrigatórios

  • Formação superior completa.
  • Sólida experiência com observabilidade e monitoramento de ambientes críticos utilizando soluções como Grafana, Prometheus, Zabbix, OpenTelemetry ou equivalentes.
  • Experiência em troubleshooting e análise de causa raiz (RCA) em sistemas distribuídos de alta disponibilidade.
  • Conhecimento avançado em Kubernetes, preferencialmente em ambientes AKS e/ou EKS.
  • Experiência em provedores de nuvem pública (Azure e/ou AWS).
  • Domínio de sistemas Linux, containers e Docker.
  • Conhecimentos sólidos em infraestrutura de redes, DNS, Load Balancers, conectividade e resolução de problemas de rede.
  • Capacidade de criar scripts e automações em Bash, PowerShell e/ou Python.
  • Vivência com práticas de GitOps, CI/CD e construção ou manutenção de pipelines via GitHub Actions.


Diferenciais

  • Experiência com a stack Grafana (Loki, Tempo, Mimir, Prometheus) e aplicação prática dos conceitos de SRE (SLI, SLO e Error Budgets).
  • Experiência com ArgoCD, Argo Workflows ou Argo Events.
  • Conhecimento em Infraestrutura como Código (IaC) utilizando Terraform, Terragrunt ou Crossplane.
  • Vivência com estratégias de FinOps e otimização de custos em ambientes cloud.
  • Conhecimento em Service Mesh (como Istio) ou plataformas corporativas de observabilidade (Dynatrace, Datadog ou New Relic).
  • Vivência com iniciativas de AIOps, automação inteligente e correlação de eventos.


O que esperamos

Esperamos uma pessoa resiliente, comunicativa e analítica, que goste de aprender na prática e construir soluções em conjunto com diferentes times. Procuramos alguém motivado por desafios técnicos, que busque constantemente a excelência operacional, a automação de processos e a alta disponibilidade dos sistemas.

Benefícios

🍽️Vale-refeição🛒Vale-alimentação🏥Plano de saúde🦷Plano odontológico💻Auxílio home office🏋️Wellhub / Totalpass💬Apoio psicológico🛡️Seguro de vida💰Previdência privada🎁Bônus✨Auxílio Farmácia✨Auxílio Óptico✨Telemedicina

Como será o processo

1Entrevista por IA
2Entrevista com Atração e seleção
3Entrevista com Gestor
4Feedback
Fazer entrevistapela webFazer entrevistapelo WhatsApp