Sre Pleno
gruposrm
Score da Vaga
90 pontosSite Reliability Engineer (SRE) Pleno
Objetivo da posição
Atuar na sustentação, administração, observabilidade e evolução dos ambientes de infraestrutura e aplicações, garantindo disponibilidade, estabilidade, segurança e desempenho dos serviços.
O profissional será responsável principalmente pela administração dos ambientes AWS, Kubernetes, soluções de backup Veeam/AWS e observabilidade através do Datadog, atuando também na análise e resolução de incidentes.
Principais responsabilidades
Administração de Recursos AWS
-
Administrar e acompanhar recursos e serviços hospedados na AWS.
-
Realizar troubleshooting de infraestrutura, conectividade, disponibilidade e performance.
-
Acompanhar utilização e capacidade dos recursos.
-
Apoiar provisionamento, configuração e manutenção dos ambientes.
-
Administrar recursos como EC2, EBS, S3, IAM, VPC, Load Balancers, Route 53 e demais serviços utilizados pela organização.
-
Analisar eventos, logs e métricas através de CloudWatch e CloudTrail.
-
Apoiar aplicação de boas práticas de segurança, disponibilidade e controle de acesso.
-
Participar da análise e otimização de custos e recursos AWS.
-
Apoiar processos de atualização, manutenção e mudanças de infraestrutura.
Administração de Backup Veeam e AWS
-
Administrar e monitorar rotinas de backup através do Veeam e serviços AWS.
-
Acompanhar execução, sucesso e falhas dos jobs de backup.
-
Investigar e corrigir falhas relacionadas às rotinas de backup.
-
Executar e acompanhar procedimentos de restore quando necessário.
-
Realizar testes periódicos de recuperação para garantir a integridade dos backups.
-
Apoiar políticas de retenção, armazenamento e ciclo de vida dos backups.
-
Acompanhar capacidade e utilização dos repositórios de backup.
-
Apoiar procedimentos relacionados a Disaster Recovery e continuidade de negócio.
-
Manter documentação e evidências das rotinas e testes de recuperação.
Administração de Clusters Kubernetes
-
Administrar e monitorar clusters Kubernetes.
-
Acompanhar Pods, Deployments, StatefulSets, DaemonSets, Services, Ingress, ConfigMaps e Secrets.
-
Realizar troubleshooting de aplicações e workloads executados nos clusters.
-
Analisar eventos, logs, probes, consumo de CPU/memória e comportamento dos Pods.
-
Investigar problemas como CrashLoopBackOff, ImagePullBackOff, OOMKilled, falhas de probes e indisponibilidade de aplicações.
-
Apoiar atualização e manutenção dos clusters e seus componentes.
-
Administrar namespaces, permissões e recursos dos ambientes.
-
Apoiar configurações de escalabilidade, requests, limits e autoscaling.
-
Trabalhar em conjunto com os times de desenvolvimento na análise de problemas das aplicações.
-
Apoiar processos de deploy e operação de aplicações utilizando práticas de CI/CD e GitOps.
Administração de Observabilidade e Datadog
-
Administrar e manter dashboards no Datadog.
-
Criar e evoluir dashboards técnicos e operacionais.
-
Criar e ajustar monitors e alertas.
-
Acompanhar métricas de infraestrutura e aplicações.
-
Realizar análise de logs, métricas e traces para troubleshooting.
-
Utilizar recursos de APM para identificação de gargalos e falhas de aplicações.
-
Acompanhar indicadores de disponibilidade, latência, erros e saturação.
-
Apoiar definição e acompanhamento de SLIs e SLOs.
-
Revisar alertas buscando redução de falsos positivos e melhoria da qualidade da monitoração.
-
Apoiar times técnicos durante incidentes utilizando dados de observabilidade para identificação da causa raiz.
Atuação operacional
O profissional também deverá:
-
Atuar no atendimento e resolução de incidentes de infraestrutura e aplicações.
-
Realizar troubleshooting de problemas de média complexidade.
-
Participar de análises de causa raiz (RCA).
-
Registrar procedimentos, incidentes e soluções em documentação técnica.
-
Executar mudanças seguindo os processos internos de Change Management.
-
Trabalhar em conjunto com os times de SRE, Infraestrutura, Redes, Segurança, Banco de Dados e Desenvolvimento.
-
Apoiar automações para redução de atividades operacionais manuais.
-
Participar da evolução contínua dos ambientes e processos de confiabilidade.
Conhecimentos técnicos desejados
-
AWS.
-
Kubernetes.
-
Veeam Backup & Replication.
-
Datadog.
-
Linux.
-
Redes TCP/IP, DNS, HTTP/HTTPS e troubleshooting de conectividade.
-
Conceitos de containers e Docker.
-
Git.
-
CI/CD.
-
Shell Script e/ou Python.
-
Terraform ou outra ferramenta de Infrastructure as Code.
-
Conceitos de observabilidade: métricas, logs e traces.
-
Conceitos de alta disponibilidade, backup e Disaster Recovery.
-
Conhecimentos básicos de segurança em ambientes Cloud.
Perfil esperado
Buscamos um profissional de nível pleno, com autonomia para executar atividades operacionais e troubleshooting de média complexidade, capacidade de análise de incidentes e interesse em automação e melhoria contínua.
É importante possuir boa comunicação, organização, senso de responsabilidade sobre ambientes produtivos e capacidade de trabalhar de forma integrada com diferentes times técnicos.
Sobre a área de Web Master
O Web Master é o profissional responsável pela manutenção, segurança e performance técnica de sites e aplicações web. Ele gerencia servidores, infraestrutura de hospedagem, monitoramento de uptime e garante que tudo funcione com rapidez e disponibilidade.
As principais habilidades incluem gestão de servidores (Apache, Nginx), hospedagem (AWS, Google Cloud, Azure), CDN (Cloudflare), SSL, DNS, segurança web (WAF, firewall), performance (Core Web Vitals, cache, compressão) e versionamento (Git, CI/CD). Conhecimento de Docker, WordPress, cPanel e monitoramento (Sentry, New Relic) é diferencial.
Web Masters em empresas de tecnologia são muito valorizados, especialmente aqueles que dominam DevOps, SRE e conseguem garantir uptime e performance em escala. A área oferece oportunidades desde webmaster júnior até SRE e infrastructure engineer, com foco em confiabilidade, segurança e velocidade.
Conheça Outras Áreas
Entenda melhor o escopo de atuação, habilidades necessárias e ferramentas utilizadas em diferentes áreas de carreira.
Sobre a área de Office Suite
O domínio de Office Suite é uma habilidade essencial para profissionais de diversas áreas. Microsoft Excel, Word, PowerPoint e Outlook são ferramentas fundamentais no dia a dia corporativo, enquanto Google Workspace e outras soluções colaborativas ganham espaço cada vez maior.
As principais habilidades incluem Excel avançado (fórmulas, tabelas dinâmicas, Power Query, VBA/Macros), Word (formatação, mala direta, estilos), PowerPoint (design de apresentações, animações), Outlook (gestão de email e calendário), e ferramentas colaborativas como Google Sheets, Notion e Airtable.
Profissionais com domínio avançado de Office Suite são valorizados em áreas administrativas, financeiras, de dados e operacionais. Certificações como Microsoft Office Specialist (MOS) são diferenciais importantes. A combinação de Excel avançado com habilidades de análise de dados é uma das competências mais requisitadas do mercado.
Sobre a área de Content Writer
O Content Writer é o profissional responsável por criar conteúdo escrito de qualidade para sites, blogs, redes sociais e outras plataformas digitais. Ele combina habilidades de escrita com estratégia de conteúdo e SEO para atrair, engajar e converter audiências.
As principais habilidades incluem criação de conteúdo para blogs, landing pages, newsletters e redes sociais, pesquisa de palavras-chave, estratégia de conteúdo, calendário editorial e SEO writing. Conhecimento de WordPress, Surfer SEO, Ahrefs e ferramentas de analytics é diferencial.
Content Writers em empresas de tecnologia são muito valorizados, especialmente aqueles que conseguem criar conteúdo técnico acessível, evergreen content e conteúdo que gera tráfego orgânico. A área oferece oportunidades desde content writer júnior até head of content, com foco em qualidade, estratégia e performance de conteúdo.
Sobre a área Comercial
A área Comercial é responsável por gerar receita e expandir a base de clientes. Profissionais de vendas B2B e B2C são fundamentais para o crescimento sustentável de qualquer organização.
As principais habilidades incluem prospecção, negociação, CRM (Salesforce, HubSpot), sales enablement e consultoria de valor. A abordagem consultiva e data-driven é cada vez mais valorizada.
Vendedores consultivos e Sales Managers sênior têm potencial de earning muito alto, com OTE (On-Target Earnings) que pode superar R$ 30.000 mensais em empresas de tecnologia.
Sobre a área de Web3
A área de Web3 representa a nova fase da internet descentralizada, baseada em tecnologia blockchain. Profissionais de Web3 criam aplicações descentralizadas (dApps), interagem com smart contracts, gerenciam ativos digitais (criptomoedas e NFTs), e utilizam protocolos DeFi (Finanças Descentralizadas), revolucionando a forma como dados, propriedade e finanças são geridos online.
Sobre a área de Fullstack
Desenvolvedores Fullstack são profissionais versáteis capazes de atuar tanto no frontend quanto no backend de aplicações web e mobile. Eles dominam múltiplas tecnologias e são capazes de construir produtos completos do início ao fim, desde a interface do usuário até a infraestrutura do servidor.
As principais habilidades incluem domínio de pelo menos uma stack completa (React/Vue/Angular + Node.js/PHP/Python/Java), banco de dados (SQL e NoSQL), APIs REST/GraphQL, versionamento com Git, CI/CD e conhecimento básico de infraestrutura (Docker, cloud). Arquitetura limpa, DDD e testes são diferenciadores importantes.
Desenvolvedores Fullstack são muito valorizados em startups e empresas que precisam de profissionais versáteis e autônomos. A área oferece oportunidades desde desenvolvedor júnior até arquiteto de software, com foco em entrega completa, visão holística do produto e capacidade de trabalhar em múltiplas camadas da aplicação.
Comentários 0