XP Inc. logo

Site Reliability Engineer

XP Inc.

Hybrid
São Paulo, SP
Full-time
Mid Level
Senior
3+ yrs
Salary not listedPosted 12m ago

Real job — pulled straight from XP Inc.’s careers page · Verified September 29, 2026 · No reposts.

Job description

XP Inc. is hiring a Site Reliability Engineer — a full-time, based in São Paulo, SP role. Apply directly on XP Inc.'s careers page below.

Analista Pleno em Infraestrutura | SRE

Location: São Paulo, SP

Department: Infraestrutura

Sobre nós ​ 

A XP Inc. é uma das maiores instituições financeiras independente do Brasil, dona das marcas XP, Rico, Clear, XP Educação, InfoMoney, entre outras. Com mais de 4,6 milhões de clientes ativos e um valor superior a R$ 1,1 trilhão de ativos sob custódia, há 25 anos vem transformando o mercado financeiro para melhorar a vida das pessoas.

Com uma cultura marcante guiada por quatro valores - Sonho Grande, Espírito Empreendedor, Foco no Cliente e Mente Aberta - a XP Inc. está sempre em busca dos melhores talentos que tem ambição de fazer o impossível.


 

 

🚀 Sobre a Oportunidade

Estamos em busca de um SRE Pleno para fazer parte do time de infraestrutura da XP Inc. — um dos maiores ecossistemas financeiros do país. Se você tem autonomia para operar ambientes críticos de média e alta complexidade, resolve problemas reais em Linux, Kubernetes e mensageria, e quer atuar como referência técnica para o time júnior enquanto conduz projetos de evolução da plataforma, essa vaga é para você. Aqui você vai lidar com troubleshooting de incidentes N2/N3, implementar automações, participar de war rooms e garantir que nossos sistemas continuem rodando com a confiabilidade que o mercado exige.

Saiba mais sobre nosso dia a dia no Instagram e no LinkedIn.

Confira nossas avaliações no Glassdoor.


🔍 O Que Procuramos

Pré-requisitos Essenciais:

 

  • Ensino superior completo em Ciência da Computação, Engenharia da Computação ou áreas correlatas
  • 3 a 6 anos de experiência em infraestrutura de TI, SRE, DevOps ou administração de sistemas
  • Mínimo de 2 anos com Kubernetes em produção (RBAC, networking, storage, HPA, Helm)
  • Mínimo de 2 anos com Linux (RHEL) em produção (kernel tuning, performance profiling, troubleshooting avançado)
  • Mínimo de 1 ano com Apache Kafka em produção (tópicos, partições, replicação, consumer groups, Kafka Connect)
  • Mínimo de 1 ano com RabbitMQ em produção (clusters, mirroring, exchanges, dead letter queues)
  • Experiência com observabilidade (Grafana, Dynatrace, Loki, ELK Stack)
  • Automação com Ansible, Python e Shell Script avançado
  • Troubleshooting avançado de redes TCP/IP (tcpdump, Wireshark, análise de latência)
  • Experiência com CI/CD (GitLab CI, GitHub Actions ou Jenkins)
  • Git avançado (branching strategies, code review, GitOps)

 

Diferenciais:

 

  • Terraform (infraestrutura como código)
  • ArgoCD / Flux (GitOps)
  • Service Mesh (Istio, Linkerd)
  • Certificações: CKA, CKAD, RHCE, AWS SA Associate
  • Experiência com bancos de dados (PostgreSQL, MySQL, SQL Server)
  • Conhecimento de Vault (Hashicorp) ou CyberArk
  • Experiência em empresas de missão crítica (bancos, fintechs, telecom)
  • Já conduziu RCAs de incidentes Severity 1
  • Conhecimento de Chaos Engineering
  • Contribuições open source ou palestras em eventos técnicos

 


🎯 Desafios e Impacto

 

  • Garantir disponibilidade 24x7 de sistemas críticos em ambiente auditado (BACEN, CVM, LGPD), com janelas de manutenção restritas e tolerância a falhas próxima de zero
  • Conduzir troubleshooting de incidentes N2/N3 em ambientes multi-tecnologia (K8s + Kafka + RabbitMQ + redes + storage), atuando como escalation primário em war rooms
  • Reduzir TOIL através de automação, implementando soluções com Ansible, Python e Shell Script para eliminar tarefas repetitivas e ganhar eficiência operacional
  • Realizar análises de causa raiz (RCA/Postmortem) para incidentes críticos, garantindo que 100% dos Severity 1 e 2 tenham RCA concluída em até 5 dias úteis
  • Mentorear SREs juniores, revisando código, fazendo pair troubleshooting e promovendo treinamentos para desenvolver autonomia operacional no time
  • Participar de projetos de migração e evolução de infraestrutura, equilibrando a velocidade que os times de produto querem com a confiabilidade que a operação exige

 


⏳ Etapas do Processo

  1. Triagem inicial: Análise do currículo para verificar a adequação às qualificações e requisitos da vaga.

  2. Testes gerais: Avaliação do alinhamento cultural com o teste da Mindsight e teste de raciocínio lógico da Predictive Index.

  3. Entrevista com a equipe de Recrutamento: Discussão sobre as expectativas em relação à vaga e aos objetivos profissionais.

  4. Entrevista com a liderança: Uma conversa para discutir sua visão e como você pode contribuir para a equipe e a empresa.

  5. Entrevista com colegas de trabalho: Interação com futuros pares para avaliar a sinergia e o trabalho em equipe.

  6. Oferta: Apresentação da proposta de trabalho, incluindo detalhes sobre remuneração e benefícios.


 


Benefícios:   

Saúde e bem-estar:

  • Plano de saúde
  • Plano odontológico
  • Wellhub (Gympass)
  • Zenklub
  • Seguro de Vida
  • iFood Benefícios (VA e VR flexível)
  • Vale Transporte
  • New Value (clube de benefícios)
  • Licença parental: maternidade de 6 meses e paternidade de 20 dias.
  • Auxílio Creche

Vida Financeira

  • Fundos de Investimentos Exclusivos
  • Assessoria de Investimentos  
  • Cartão XP Visa Infinite sem anuidade  
  • Crédito (consignado, home equity, CCB Imobiliário, etc.) 

Modelo de Trabalho Presencial Flexível  

O nosso modelo de trabalho varia de acordo com a função, podendo ser totalmente presencial para frentes de negócio e mais flexível para outras equipes.  
 
Seguimos um modelo com mais frequência presencial, mas sempre guiado por flexibilidade e autonomia com a responsabilidade da nossa cultura empreendedora. 

Aqui na XP Inc., valorizamos as interações pessoais e acreditamos no uso do escritório como uma ferramenta para potencializar nossas relações no trabalho.


*Ao seguir com a inscrição, você declara que leu, compreendeu e concorda com a Política de Privacidade do Grupo XP Inc. e de seus fornecedores e parceiros que apoiam com a realização do processo seletivo. O Grupo XP Inc. poderá utilizar de soluções de inteligência artificial para apoiar a equipe de recrutamento no decorrer do processo, o que poderá envolver o tratamento de seus dados pessoais para tal finalidade, conforme princípios da Lei Geral de Proteção de Dados e da Política de Privacidade do Grupo XP Inc.

Get Site Reliability Engineer jobs like this→

New roles from thousands of companies land hourly, straight from their careers pages. Get the freshest matches by email so you never miss one.

Email me new jobs
M9 Solutions logo

Software Engineer

$100k–$115kScottsdale, AZ
✓ From careers page· 4h ago
Riot Games logo

Staff Software Engineer, Infrastructure

Los Angeles, CA
✓ From careers page· 5h ago
SAP Fioneer logo

AI Platform Engineer (Remote)

Remote · Germany +3
✓ From careers page· 5h ago
SAP Fioneer logo

Graduate AI Engineer

Munich, Bavaria, Germany
✓ From careers page· 5h ago

Frequently asked questions

What skills are required for Site Reliability Engineer at XP Inc.?

The required skills for Site Reliability Engineer at XP Inc. include: Kubernetes, Linux, Kafka, RabbitMQ, Grafana, Ansible, Python, TCP/IP, CI/CD, GitLab CI, GitHub Actions, Jenkins, Git, Terraform, ArgoCD, AWS, PostgreSQL, MySQL, SQL Server.

What is the seniority level for Site Reliability Engineer at XP Inc.?

Site Reliability Engineer at XP Inc. is a Mid Level / Senior level position.

How do I apply for Site Reliability Engineer at XP Inc.?

You can view the full description and apply for Site Reliability Engineer at XP Inc. on EchoJobs: https://echojobs.io/job/xp-inc-analista-pleno-em-infraestrutura-sre-4u6er.