Staff Platform Engineer
cobli
Score da Vaga
90 pontosSobre a vaga
Se você curte construir a plataforma sobre a qual dezenas de engenheiros entregam produto, e quer ver o efeito disso em milhões de km rodados e na segurança de motoristas reais, esse desafio é pra você.
Como Staff Engineer de Infra & DevTools, você vai liderar a execução técnica dos projetos mais importantes da Cobli. Você propõe e implementa soluções de infraestrutura em nuvem e de ferramentas internas que tornam o desenvolvimento fácil, rápido, eficiente e escalável para as squads de Produto, Hardware e Dados.
No dia a dia, o foco do time está nos aspectos comuns a toda a plataforma: custo, segurança e observabilidade.
Na prática, isso significa cuidar de clusters Kubernetes na AWS que processam telemetria e vídeo de frotas em tempo real, dos caminhos padronizados (Golden Paths) da nossa Internal Developer Platform, da observabilidade e do custo da nuvem.
Responsabilidades e atribuições
-
Propor e evoluir a arquitetura da plataforma (Kubernetes/EKS, rede, IaC, CI/CD, IDP), usando dados para priorizar melhorias alinhadas às metas da área.
-
Liderar a execução técnica de projetos importantes da plataforma, coordenando com as squads impactadas, como upgrades de EKS, migrações de Karpenter e de ingress e mudanças no modelo de gestão de cargas.
-
Escrever e revisar design docs e ADRs, explicitando trade-offs entre confiabilidade, custo, segurança e velocidade de entrega.
-
Identificar gaps nos fluxos de desenvolvimento e propor padrões de plataforma (Golden Paths, templates, políticas), apoiando (e liderando) a adoção pelas squads.
-
Evoluir a Internal Developer Platform com base nas dores dos times, propondo o que construir, adotar ou descontinuar (build vs. buy)
-
Evoluir a observabilidade (Datadog) e as práticas de FinOps: ownership de alertas e de custo por squad, cobertura de tags e redução de custo AWS.
-
Implementar e evoluir práticas de segurança na infraestrutura e do ciclo de desenvolvimento junto a SecOps (IAM, segredos, Cognito, desenvolvimento seguro).
-
Ser a referência de escalação técnica em problemas complexos de infraestrutura e performance
-
Elevar o nível técnico do time por meio de revisão de código e de design, pareamento e mentoria técnica.
-
Ser agente ativo na adoção de IA na operação da plataforma: automação operacional, investigação de incidentes e ferramentas que aumentem a produtividade das squads.
-
Seguir hands-on, implementando as partes mais críticas das iniciativas que lidera.
Requisitos obrigatórios
-
Experiência sólida em infraestrutura, SRE, DevOps ou Platform Engineering, com parte relevante em produção de alto volume.
-
Histórico de liderar a execução técnica de projetos de plataforma complexos, coordenando com outras equipes do design à adoção.
-
Experiência propondo soluções de arquitetura com trade-offs documentados (design docs, ADRs).
-
Domínio profundo de AWS (EKS, EC2, VPC, IAM, S3, RDS ou equivalentes), incluindo desenho de rede, multi-conta e modelo de permissões.
-
Domínio de Kubernetes em produção: operação multi-cluster, upgrades sem downtime, autoscaling, networking e troubleshooting avançado.
-
Infraestrutura como código com Terraform e empacotamento de aplicações com Helm, incluindo módulos e padrões reutilizáveis por outros times.
-
CI/CD (CircleCI ou similar), com experiência evoluindo fluxos de deploy usados por vários times, e noções de GitOps.
-
Experiência construindo ou evoluindo uma plataforma interna de desenvolvimento (self-service, templates, catálogo), tratando outros engenheiros como clientes.
-
Confiabilidade e observabilidade: SLIs/SLOs, error budgets, estratégia de alertas e análise de logs, métricas e traces (Datadog ou equivalente), usando esses dados para priorizar melhorias.
-
Programação para automação e ferramentas internas (Python, Go ou similar) com qualidade de código de produção.
-
Liderança de incidentes de alta severidade e de post-mortems.
-
Fundamentos sólidos de Linux, redes (DNS, TLS, load balancing) e segurança em nuvem.
-
Experiência prática usando IA para acelerar a engenharia, elevando a produtividade do time e não apenas a própria.
-
Inglês avançado para leitura técnica.
Diferenciais
-
Experiência com Karpenter, Emissary-ingress/Envoy ou service mesh.
-
Experiência prática com Flux ou outra ferramenta de GitOps (ex.: ArgoCD).
-
Operação de bancos distribuídos (ScyllaDB, Cassandra) ou sistemas de streaming (Kafka, Kinesis).
-
Prática de FinOps em AWS: alocação de custo por time, tagging, Savings Plans e rightsizing.
-
Conhecimento de DevSecOps: scanning de imagens e dependências, políticas de admissão, gestão de segredos.
-
Vivência com o ecossistema JVM em produção (tuning de memória, heap dumps, profiling).
-
Contato com plataformas de dados (Snowflake, data warehouses) do ponto de vista de infraestrutura.
-
Gestão de infraestrutura para IA: controle de consumo e custo de tokens de LLMs (gateways, quotas e observabilidade de uso por squad) e MLOps (pipelines de treino e deploy de modelos, serving com GPU no Kubernetes, versionamento e monitoramento de modelos em produção).
Sobre a área de Web Master
O Web Master é o profissional responsável pela manutenção, segurança e performance técnica de sites e aplicações web. Ele gerencia servidores, infraestrutura de hospedagem, monitoramento de uptime e garante que tudo funcione com rapidez e disponibilidade.
As principais habilidades incluem gestão de servidores (Apache, Nginx), hospedagem (AWS, Google Cloud, Azure), CDN (Cloudflare), SSL, DNS, segurança web (WAF, firewall), performance (Core Web Vitals, cache, compressão) e versionamento (Git, CI/CD). Conhecimento de Docker, WordPress, cPanel e monitoramento (Sentry, New Relic) é diferencial.
Web Masters em empresas de tecnologia são muito valorizados, especialmente aqueles que dominam DevOps, SRE e conseguem garantir uptime e performance em escala. A área oferece oportunidades desde webmaster júnior até SRE e infrastructure engineer, com foco em confiabilidade, segurança e velocidade.
Conheça Outras Áreas
Entenda melhor o escopo de atuação, habilidades necessárias e ferramentas utilizadas em diferentes áreas de carreira.
Sobre a área de Suporte Técnico
O Suporte Técnico é essencial para garantir a satisfação e retenção de clientes. Profissionais de suporte resolvem problemas técnicos, documentam soluções e identificam padrões que podem levar a melhorias no produto.
As principais habilidades incluem troubleshooting, atendimento ao cliente, documentação técnica, conhecimento de ITIL e ferramentas de ticketing (Zendesk, Freshdesk, Intercom).
O suporte técnico evoluiu de uma função reativa para proativa, com profissionais de alto nível atuando em Customer Engineering e Support Engineering.
Sobre a área de Analista de Negócios
O Analista de Negócios (BA) é o profissional responsável por identificar problemas, oportunidades e soluções em processos organizacionais, atuando como ponte entre as áreas de negócio e a equipe de desenvolvimento de tecnologia. Ele realiza o levantamento e especificação de requisitos, mapeia fluxos de valor, desenha processos futuros e ajuda a garantir que as entregas de software estejam alinhadas com as metas estratégicas da empresa.
Sobre a área de Gestor de Tráfego
O Gestor de Tráfego é o profissional responsável por planejar, executar e otimizar campanhas de mídia paga em diversas plataformas digitais. Com a competitividade do mercado digital, profissionais de tráfego pago são essenciais para gerar leads qualificados e maximizar o retorno sobre investimento em publicidade.
As principais habilidades incluem gestão de campanhas em Google Ads, Meta Ads, LinkedIn Ads e TikTok Ads, planejamento de mídia, análise de métricas (ROAS, CPA, CPC, CTR), A/B testing, remarketing e criação de landing pages. Ferramentas como Google Analytics, Google Tag Manager, Hotjar e plataformas de automação são essenciais.
Gestores de tráfego em empresas de tecnologia são muito valorizados, especialmente aqueles que dominam performance marketing, otimização de funil de conversão e estratégias de escala. A área oferece oportunidades desde analista de mídia até diretor de performance, com foco em crescimento, eficiência de verba e retorno sobre investimento.
Sobre a área de Designer Gráfico
O Designer Gráfico é o profissional responsável por criar peças visuais para comunicação impressa e digital, desde identidade visual e logotipos até materiais de marketing e embalagens. Ele combina criatividade com técnica para transmitir mensagens de forma visual e impactante.
As principais habilidades incluem Adobe Photoshop, Illustrator e InDesign, CorelDRAW, design de identidade visual, tipografia, teoria das cores, packaging design e motion graphics. Conhecimento de ilustração vetorial, impressão offset/digital e produção gráfica é diferencial.
Designers Gráficos em empresas de tecnologia são muito valorizados, especialmente aqueles que dominam design para redes sociais, infográficos e conseguem criar materiais que fortalecem a identidade visual da marca. A área oferece oportunidades desde designer gráfico júnior até art director e design director.
Sobre a área de QA e Testes
QA e Testes de Software são fundamentais para garantir a qualidade e confiabilidade de aplicações. Profissionais de QA garantem que o produto entregue atenda aos requisitos e esteja livre de defeitos críticos.
As principais habilidades incluem testes manuais e automatizados, Selenium, Cypress, Playwright, Postman, JMeter e conhecimento de pipelines CI/CD. Testes de performance e segurança são diferenciais.
Com a adoção de DevOps e deploy contínuo, a demanda por QAs automatizadores e SDETs continua crescendo.
Comentários 0