Publicada em 07 de ago. de 2026 · Verificamos no momento em que essa vaga foi agregada
Buscamos um Analista de TI Sênior – Site Reliability Engineering (SRE)
para atuar na evolução das práticas de confiabilidade, observabilidade e automação das plataformas e aplicações em ambiente AWS.Esse(a) profissional será responsável por garantir a disponibilidade, resiliência, escalabilidade e desempenho dos serviços críticos, trabalhando de forma integrada com as equipes de Arquitetura, Desenvolvimento, Infraestrutura e fornecedores para incorporar práticas de confiabilidade desde a concepção das soluções até sua operação contínua.Procuramos alguém com perfil técnico, visão sistêmica e foco em melhoria contínua, que contribua para a evolução das práticas de SRE, Dev
Ops, Platform Engineering e automação, apoiando a modernização tecnológica e a excelência operacional da organização.
Cultura e Práticas de SRE: Definir e implementar práticas de SRE para aplicações críticas, estabelecendo e acompanhando SLIs, SLOs e Error Budgets.Observabilidade: Definir e evoluir a arquitetura corporativa de observabilidade (logs, métricas, traces e experiência do usuário), mantendo dashboards operacionais e executivos.Automação e Eficiência: Eliminar trabalhos repetitivos (toil) por meio de automação operacional e desenvolvimento de mecanismos de remediação automática (Self-Healing).Gestão de Incidentes e Resiliência: Liderar a resolução de incidentes críticos, conduzir análises de causa raiz (RCA), elaborar Post-Mortems e garantir a execução dos planos de ação.Capacidade e Performance: Realizar análises contínuas de desempenho, capacidade e disponibilidade dos ambientes em nuvem.Colaboração e Arquitetura: Atuar em parceria com arquitetos, desenvolvedores e fornecedores na construção de soluções cloud native resilientes, apoiando pipelines de CI/CD e práticas de Platform Engineering e Infraestrutura como Código (IaC).Gestão Financeira em Nuvem: Apoiar iniciativas de otimização de custos (Fin
Ops) e eficiência operacional na AWS.
É ESSENCIAL!Formação e experiência
Graduação completa em Ciência da Computação, Engenharia da Computação, Sistemas de Informação ou áreas correlatas.Experiência sólida como Site Reliability Engineer (SRE), Dev
Ops Engineer, Cloud Engineer ou em funções equivalentes.Vivência em ambientes críticos de produção em Cloud AWS.Experiência com Kubernetes em ambientes produtivos.Atuação em definição e acompanhamento de SLIs, SLOs e Error Budgets.Experiência em automação operacional e Infraestrutura como Código (IaC).Vivência em troubleshooting avançado de aplicações e infraestrutura.Experiência em gerenciamento de incidentes, análise de causa raiz (RCA) e gestão de mudanças.Conhecimento de arquiteturas distribuídas, microsserviços e aplicações cloud native.Experiência em ambientes ágeis e com práticas Dev
Ops.Capacidade de atuar de forma colaborativa com equipes multidisciplinares e fornecedores.Conhecimentos técnicos
Cloud & Containers: Domínio prático de ambientes AWS de missão crítica (com foco em Amazon EKS, ECS, EC2, Lambda, IAM, S3, RDS, DynamoDB, SQS/SNS, Load Balancers e API Gateway) e Kubernetes em produção.Confiabilidade e Operações: Vivência prática na definição de SLIs/SLOs/Error Budgets, troubleshooting avançado, gerenciamento de incidentes e análise de causa raiz.Observabilidade: Conhecimento avançado na arquitetura e uso de ferramentas como Open
Telemetry, Datadog, Grafana, Prometheus, Elastic Stack e APM (Distributed Tracing).Infraestrutura como Código & Automação: Experiência hands-on com Terraform, AWS Cloud
Formation, Shell Script/Python e ferramentas de CI/CD (Git
Hub Actions, Git
Lab CI/CD ou Jenkins).Arquitetura & Metodologias: Domínio de arquiteturas distribuídas, microsserviços e ecossistema Cloud Native, atuando sob frameworks ágeis e cultura Dev
Ops.É DIFERENCIAL!Experiência no segmento financeiro, ambientes regulados, ecossistema do Banco Central (Pix, Open Finance) ou processos de compliance e auditoria.Conhecimentos em práticas de Dev
Sec
Ops, Chaos Engineering, Platform Engineering e Fin
Ops.Vivência em segurança em nuvem e frameworks de mercado (LGPD, ISO 27001, NIST).Certificações desejáveis:AWS: Solutions Architect (Associate/Professional), Sys
Ops Administrator ou Dev
Ops Engineer Professional.Kubernetes: CKA ou CKAD.Observabilidade & Infraestrutura: Datadog Certified, Dynatrace Associate ou Hashi
Corp Terraform Associate.SRE & Segurança: Google Cloud Dev
Ops Engineer, SRE Foundation, AWS Security Specialty ou CCSP.
No FGC, valorizamos o bem-estar, o desenvolvimento e a segurança dos nossos colaboradores. Confira o que oferecemos:🏥 Saúde e Bem-estar
Plano de saúde Bradesco (top nacional plus apartamento) e odontológico Met
Life com cobertura completa para você e seus dependentes.Seguro de vida
Credencial SESCTotal
Pass
Ginástica laboral 2x por semana no escritório🍽️ Alimentação
Vale refeição de R$990,52 e vale alimentação de R$780,50 mensais (inclusive nas férias), sem desconto em folha.🚍 Mobilidade
Vale transporte com desconto de 6% sobre o salário fixo.Modelo de trabalho híbrido – 3x por semana presencial na Faria Lima e 2x💰 Previdência Privada
Contrapartida do FGC de até 8% do salário, conforme sua adesão.🎁 Gratificação Anual
Pagamento variável pago em março, conforme desempenho e orçamento. Elegível após 6 meses de casa.📚 Educação e Desenvolvimento
Treinamentos internos e plataforma de aprendizagem.Bolsa de estudos para graduação e pós, com reembolso de até 80%. Elegível após 2 anos.
Crie uma conta grátis pra ver a vaga completa e se candidatar.