Sre Pleno
gruposrm
Score da Vaga
90 pontosSite Reliability Engineer (SRE) Pleno
Objetivo da posição
Atuar na sustentação, administração, observabilidade e evolução dos ambientes de infraestrutura e aplicações, garantindo disponibilidade, estabilidade, segurança e desempenho dos serviços.
O profissional será responsável principalmente pela administração dos ambientes AWS, Kubernetes, soluções de backup Veeam/AWS e observabilidade através do Datadog, atuando também na análise e resolução de incidentes.
Principais responsabilidades
Administração de Recursos AWS
-
Administrar e acompanhar recursos e serviços hospedados na AWS.
-
Realizar troubleshooting de infraestrutura, conectividade, disponibilidade e performance.
-
Acompanhar utilização e capacidade dos recursos.
-
Apoiar provisionamento, configuração e manutenção dos ambientes.
-
Administrar recursos como EC2, EBS, S3, IAM, VPC, Load Balancers, Route 53 e demais serviços utilizados pela organização.
-
Analisar eventos, logs e métricas através de CloudWatch e CloudTrail.
-
Apoiar aplicação de boas práticas de segurança, disponibilidade e controle de acesso.
-
Participar da análise e otimização de custos e recursos AWS.
-
Apoiar processos de atualização, manutenção e mudanças de infraestrutura.
Administração de Backup Veeam e AWS
-
Administrar e monitorar rotinas de backup através do Veeam e serviços AWS.
-
Acompanhar execução, sucesso e falhas dos jobs de backup.
-
Investigar e corrigir falhas relacionadas às rotinas de backup.
-
Executar e acompanhar procedimentos de restore quando necessário.
-
Realizar testes periódicos de recuperação para garantir a integridade dos backups.
-
Apoiar políticas de retenção, armazenamento e ciclo de vida dos backups.
-
Acompanhar capacidade e utilização dos repositórios de backup.
-
Apoiar procedimentos relacionados a Disaster Recovery e continuidade de negócio.
-
Manter documentação e evidências das rotinas e testes de recuperação.
Administração de Clusters Kubernetes
-
Administrar e monitorar clusters Kubernetes.
-
Acompanhar Pods, Deployments, StatefulSets, DaemonSets, Services, Ingress, ConfigMaps e Secrets.
-
Realizar troubleshooting de aplicações e workloads executados nos clusters.
-
Analisar eventos, logs, probes, consumo de CPU/memória e comportamento dos Pods.
-
Investigar problemas como CrashLoopBackOff, ImagePullBackOff, OOMKilled, falhas de probes e indisponibilidade de aplicações.
-
Apoiar atualização e manutenção dos clusters e seus componentes.
-
Administrar namespaces, permissões e recursos dos ambientes.
-
Apoiar configurações de escalabilidade, requests, limits e autoscaling.
-
Trabalhar em conjunto com os times de desenvolvimento na análise de problemas das aplicações.
-
Apoiar processos de deploy e operação de aplicações utilizando práticas de CI/CD e GitOps.
Administração de Observabilidade e Datadog
-
Administrar e manter dashboards no Datadog.
-
Criar e evoluir dashboards técnicos e operacionais.
-
Criar e ajustar monitors e alertas.
-
Acompanhar métricas de infraestrutura e aplicações.
-
Realizar análise de logs, métricas e traces para troubleshooting.
-
Utilizar recursos de APM para identificação de gargalos e falhas de aplicações.
-
Acompanhar indicadores de disponibilidade, latência, erros e saturação.
-
Apoiar definição e acompanhamento de SLIs e SLOs.
-
Revisar alertas buscando redução de falsos positivos e melhoria da qualidade da monitoração.
-
Apoiar times técnicos durante incidentes utilizando dados de observabilidade para identificação da causa raiz.
Atuação operacional
O profissional também deverá:
-
Atuar no atendimento e resolução de incidentes de infraestrutura e aplicações.
-
Realizar troubleshooting de problemas de média complexidade.
-
Participar de análises de causa raiz (RCA).
-
Registrar procedimentos, incidentes e soluções em documentação técnica.
-
Executar mudanças seguindo os processos internos de Change Management.
-
Trabalhar em conjunto com os times de SRE, Infraestrutura, Redes, Segurança, Banco de Dados e Desenvolvimento.
-
Apoiar automações para redução de atividades operacionais manuais.
-
Participar da evolução contínua dos ambientes e processos de confiabilidade.
Conhecimentos técnicos desejados
-
AWS.
-
Kubernetes.
-
Veeam Backup & Replication.
-
Datadog.
-
Linux.
-
Redes TCP/IP, DNS, HTTP/HTTPS e troubleshooting de conectividade.
-
Conceitos de containers e Docker.
-
Git.
-
CI/CD.
-
Shell Script e/ou Python.
-
Terraform ou outra ferramenta de Infrastructure as Code.
-
Conceitos de observabilidade: métricas, logs e traces.
-
Conceitos de alta disponibilidade, backup e Disaster Recovery.
-
Conhecimentos básicos de segurança em ambientes Cloud.
Perfil esperado
Buscamos um profissional de nível pleno, com autonomia para executar atividades operacionais e troubleshooting de média complexidade, capacidade de análise de incidentes e interesse em automação e melhoria contínua.
É importante possuir boa comunicação, organização, senso de responsabilidade sobre ambientes produtivos e capacidade de trabalhar de forma integrada com diferentes times técnicos.
Sobre a área de Web Master
O Web Master é o profissional responsável pela manutenção, segurança e performance técnica de sites e aplicações web. Ele gerencia servidores, infraestrutura de hospedagem, monitoramento de uptime e garante que tudo funcione com rapidez e disponibilidade.
As principais habilidades incluem gestão de servidores (Apache, Nginx), hospedagem (AWS, Google Cloud, Azure), CDN (Cloudflare), SSL, DNS, segurança web (WAF, firewall), performance (Core Web Vitals, cache, compressão) e versionamento (Git, CI/CD). Conhecimento de Docker, WordPress, cPanel e monitoramento (Sentry, New Relic) é diferencial.
Web Masters em empresas de tecnologia são muito valorizados, especialmente aqueles que dominam DevOps, SRE e conseguem garantir uptime e performance em escala. A área oferece oportunidades desde webmaster júnior até SRE e infrastructure engineer, com foco em confiabilidade, segurança e velocidade.
Conheça Outras Áreas
Entenda melhor o escopo de atuação, habilidades necessárias e ferramentas utilizadas em diferentes áreas de carreira.
Sobre a área de Ecommerce Analyst
O Ecommerce Analyst é o profissional responsável por analisar dados de vendas online, comportamento do comprador e performance de lojas virtuais para guiar decisões estratégicas. Ele combina análise de dados com conhecimento de ecommerce para otimizar conversão, ticket médio e retorno sobre investimento.
As principais habilidades incluem Google Analytics (GA4), Hotjar, análise de funil de conversão, cohort analysis, segmentação de clientes, análise de pricing e métricas de ecommerce (CAC, CLV, AOV, taxa de conversão). Conhecimento de SQL, Power BI, Google Tag Manager e plataformas como Shopify e VTEX é diferencial.
Ecommerce Analysts em empresas de tecnologia são muito valorizados, especialmente aqueles que conseguem transformar dados de comportamento de compra em insights acionáveis para aumentar receita e reduzir abandono de carrinho. A área oferece oportunidades desde analista júnior até analytics manager de ecommerce.
Sobre a área de Cloud Solutions
A área de Cloud Solutions é responsável por projetar, implementar e gerenciar infraestrutura e serviços em nuvem (AWS, Azure, GCP) para empresas. Profissionais de cloud arquitetam soluções escaláveis, seguras e otimizadas em custo, desde migrações de data centers até arquiteturas serverless e multi-cloud.
As principais habilidades incluem IaC (Terraform, CloudFormation), containers (Docker, Kubernetes), serverless (Lambda, Cloud Functions), bancos de dados gerenciados (RDS, DynamoDB, BigQuery), redes cloud (VPC, CDN, load balancer) e segurança (IAM, WAF, KMS). Conhecimento de FinOps, cloud governance e certificações AWS/Azure/GCP é diferencial.
Profissionais de Cloud Solutions em empresas de tecnologia são muito valorizados, especialmente aqueles que dominam arquiteturas multi-cloud, FinOps e conseguem otimizar custos enquanto mantêm performance e segurança. A área oferece oportunidades desde cloud engineer até cloud solutions architect, head of cloud e chief cloud architect.
Sobre a área de Marketing Digital
O Marketing Digital é uma área em permanente expansão, impulsionada pelo crescimento do e-commerce e pela necessidade de presença digital forte. Profissionais de marketing dominam ferramentas como Google Ads, Meta Ads, HubSpot, Google Analytics e plataformas de automação.
As especializações mais procuradas incluem Growth Marketing, Performance, SEO, Marketing de Conteúdo e Growth Hacking. A combinação de criatividade com análise de dados é o diferencial mais valorizado no mercado.
O mercado oferece oportunidades tanto em agências quanto em empresas de tecnologia, com salários competitivos e possibilidade de trabalho remoto.
Sobre a área de Desenvolvimento
A área de Desenvolvimento de Software é uma das mais dinâmicas e em constante evolução no mercado de trabalho. Profissionais dessa área são responsáveis por criar, manter e otimizar aplicações web, mobile e desktop que impactam milhões de usuários diariamente.
As principais linguagens e frameworks incluem JavaScript (React, Node.js, Vue.js), Python (Django, Flask), Java (Spring), PHP (Laravel) e TypeScript. A demanda por desenvolvedores full-stack continua crescendo, especialmente em empresas de tecnologia e startups.
Salários variam de R$ 3.000 (júnior) a R$ 20.000+ (sênior), com oportunidades crescentes para trabalho remoto e freelance internacional.
Sobre a área de UX
A área de User Experience (UX) Design é focada em otimizar a experiência geral do usuário ao interagir com um produto ou serviço. Profissionais de UX realizam pesquisas com usuários (UX Research), mapeiam jornadas, criam wireframes, realizam testes de usabilidade e definem fluxos de navegação para garantir que o produto seja intuitivo, útil e atenda às necessidades reais dos usuários.
Comentários 0