Especialista Sre
mb
Score da Vaga
90 pontosBuscamos uma pessoa Especialista em SRE para atuar na confiabilidade, escalabilidade e segurança das plataformas que sustentam operações críticas de uma instituição financeira regulada. O ambiente é majoritariamente GCP, com workloads relevantes em AWS, orquestração em Kubernetes, infraestrutura declarada em Terraform e automações em Python. Trata-se de uma posição de profundidade técnica, não de gestão de pessoas, com forte interface com times de Engenharia de Produto e Segurança da Informação.
O que você vai fazer:
- Definir, instrumentar e evoluir SLIs, SLOs e error budgets dos serviços críticos, negociando metas de confiabilidade com os times de produto.
- Evoluir a plataforma de Kubernetes: topologia de clusters, autoscaling, políticas de segurança de workloads, service mesh, gestão de recursos e otimização de custo.
- Escrever e manter Infraestrutura como Código em Terraform, incluindo módulos reutilizáveis, versionamento, pipelines de plan/apply, policy-as-code e revisão de mudanças.
- Desenvolver automações, ferramentas internas e operadores em Python para eliminar toil operacional.
- Construir e evoluir a stack de observabilidade (métricas, logs, traces e profiling): instrumentação, dashboards, alertas acionáveis e redução de ruído.
- Atuar no ciclo completo de gestão de incidentes: on-call, resposta, mitigação, comunicação e condução de post-mortems sem culpabilização, com acompanhamento de ações corretivas.
- Investigar e resolver problemas complexos de performance e de falhas parciais (grey failures) em bancos de dados gerenciados, redes e camadas de conectividade.
- Implementar práticas de engenharia de resiliência: testes de carga, chaos engineering, game days e exercícios de DR.
- Garantir que os controles de infraestrutura atendam às exigências regulatórias aplicáveis (BACEN/CVM), colaborando com Segurança da Informação e Compliance na evidenciação de controles.
- Contribuir para a maturidade de DevSecOps: hardening de pipelines, gestão de segredos, identidade de workloads e controle de acesso à infraestrutura.
O que esperamos que você tenha:
- Experiência sólida (5+ anos) em SRE, DevOps ou Engenharia de Infraestrutura, sendo parte relevante em ambientes de produção de alta criticidade.
- GCP em profundidade: IAM, VPC e networking, GKE, Cloud SQL, Cloud Load Balancing, Cloud Monitoring/Logging.
- AWS em nível operacional consistente: IAM, VPC, EKS ou ECS, RDS, ELB.
- Terraform em nível avançado: escrita de módulos, gestão de estado, estratégias de refatoração e execução segura de mudanças em produção.
- Kubernetes em profundidade: arquitetura do control plane, networking (CNI, Ingress, Service), RBAC, políticas de admissão, troubleshooting de workloads e capacity planning.
- Python para automação, integração de APIs e ferramentas internas (código legível, testado e versionado).
- Observabilidade aplicada: experiência prática com Prometheus, Grafana, ferramentas de APM; capacidade de desenhar alertas baseados em sintomas e não em causas.
- Domínio de Linux, redes TCP/IP, TLS/PKI e depuração de sistemas distribuídos.
- Experiência com CI/CD e práticas de entrega contínua.
- Vivência real em plantão on-call e condução de incidentes de produção.
Diferenciais:
- Conhecimento de Core Bancário e de sistemas financeiros de missão crítica: ledger, conciliação, liquidação, idempotência de transações, consistência de saldos, janelas de fechamento.
- Experiência com integrações do SPB/SFN, Pix, SPI/DICT ou instituições reguladas pelo BACEN.
- Familiaridade com requisitos regulatórios de continuidade e resiliência operacional).
- Experiência com FinOps e otimização de custo em nuvem.
- Service mesh (Istio, Linkerd), policy-as-code (OPA/Gatekeeper, Sentinel) e controles de perímetro em nuvem (VPC-SC, PrivateLink).
- Certificações: Google Professional Cloud Architect / Cloud DevOps Engineer, AWS Solutions Architect Professional, CKA/CKS, HashiCorp Terraform Associate.
- Inglês técnico para leitura de documentação e interação com fornecedores globais.
Sobre a área de Web Master
O Web Master é o profissional responsável pela manutenção, segurança e performance técnica de sites e aplicações web. Ele gerencia servidores, infraestrutura de hospedagem, monitoramento de uptime e garante que tudo funcione com rapidez e disponibilidade.
As principais habilidades incluem gestão de servidores (Apache, Nginx), hospedagem (AWS, Google Cloud, Azure), CDN (Cloudflare), SSL, DNS, segurança web (WAF, firewall), performance (Core Web Vitals, cache, compressão) e versionamento (Git, CI/CD). Conhecimento de Docker, WordPress, cPanel e monitoramento (Sentry, New Relic) é diferencial.
Web Masters em empresas de tecnologia são muito valorizados, especialmente aqueles que dominam DevOps, SRE e conseguem garantir uptime e performance em escala. A área oferece oportunidades desde webmaster júnior até SRE e infrastructure engineer, com foco em confiabilidade, segurança e velocidade.
Conheça Outras Áreas
Entenda melhor o escopo de atuação, habilidades necessárias e ferramentas utilizadas em diferentes áreas de carreira.
Sobre a área de Desenvolvimento Mobile
O Desenvolvimento Mobile é uma das áreas mais dinâmicas e em constante evolução do mercado de tecnologia. Com bilhões de dispositivos smartphones no mundo, a demanda por desenvolvedores mobile qualificados continua crescendo exponencialmente.
As principais stacks incluem Flutter (Dart), React Native (JavaScript/TypeScript), Kotlin (Android nativo), Swift (iOS nativo) e frameworks híbridos como Ionic e Capacitor. Conhecimento de arquitetura mobile (MVVM, Clean Architecture), CI/CD mobile (Fastlane, Bitrise, Codemagic) e publicação em App Store/Google Play são essenciais.
Desenvolvedores mobile sênior são profissionais muito valorizados, com salários competitivos e muitas oportunidades de trabalho remoto para empresas internacionais. A especialização em cross-platform ou nativo é uma decisão estratégica de carreira.
Sobre a área de Engenheiro de Automação
O Engenheiro de Automação é o profissional responsável por projetar, desenvolver e implementar soluções que automatizam processos manuais e repetitivos em TI, infraestrutura, testes e operações. Ele combina conhecimento de programação com visão de DevOps e SRE para eliminar tarefas manuais e aumentar a eficiência operacional.
As principais habilidades incluem Infrastructure as Code (Terraform, Ansible, Pulumi), CI/CD (Jenkins, GitHub Actions, GitLab CI), automação de testes (Selenium, Cypress, Playwright), automação de rede (Netconf, SDN), RPA (UiPath, Power Automate) e scripting (Python, Bash, PowerShell). Conhecimento de Kubernetes, GitOps (ArgoCD, Flux) e plataforma de automação é diferencial.
Engenheiros de Automação em empresas de tecnologia são muito valorizados, especialmente aqueles que conseguem criar pipelines de deploy automatizados, infraestrutura auto-healing e plataformas internas de desenvolvimento (IDP). A área oferece oportunidades desde automation engineer júnior até automation architect e head of automation.
Sobre a área de Agilidade
A área de Agilidade e Transformação Digital é fundamental para organizações que buscam eficiência e adaptação rápida. Profissionais de agile facilitam processos, eliminam gargalos e promovem cultura de melhoria contínua.
As principais certificações incluem CSM, PSM, SAFe, ICP e Kanban. Conhecimento de Scrum, Kanban, XP e frameworks ágeis é essencial, assim como soft skills de liderança e facilitação.
Agile coaches e Scrum Masters sênior são muito valorizados, especialmente em empresas de tecnologia que adotam metodologias ágeis em escala.
Sobre a área de Cloud Solutions
A área de Cloud Solutions é responsável por projetar, implementar e gerenciar infraestrutura e serviços em nuvem (AWS, Azure, GCP) para empresas. Profissionais de cloud arquitetam soluções escaláveis, seguras e otimizadas em custo, desde migrações de data centers até arquiteturas serverless e multi-cloud.
As principais habilidades incluem IaC (Terraform, CloudFormation), containers (Docker, Kubernetes), serverless (Lambda, Cloud Functions), bancos de dados gerenciados (RDS, DynamoDB, BigQuery), redes cloud (VPC, CDN, load balancer) e segurança (IAM, WAF, KMS). Conhecimento de FinOps, cloud governance e certificações AWS/Azure/GCP é diferencial.
Profissionais de Cloud Solutions em empresas de tecnologia são muito valorizados, especialmente aqueles que dominam arquiteturas multi-cloud, FinOps e conseguem otimizar custos enquanto mantêm performance e segurança. A área oferece oportunidades desde cloud engineer até cloud solutions architect, head of cloud e chief cloud architect.
Sobre a área de Engenharia
A Engenharia de Software vai além do desenvolvimento tradicional, focando em escalabilidade, performance e arquitetura de sistemas. Engenheiros de software são responsáveis por projetar infraestruturas que suportam milhões de usuários simultâneos.
As habilidades incluem arquitetura de microsserviços, DevOps, cloud computing, segurança de aplicações e otimização de performance. Conhecimento em containerização (Docker, Kubernetes) e CI/CD é cada vez mais exigido.
Engenheiros de software sênior são profissionais raros e muito bem remunerados, com oportunidades em grandes tech companies globais.