New

Devops/SRE Tech Lead I Observabilidade

BrazilBrazil·Rio de JaneiroRemotelead
OtherTech Lead
2 views0 saves0 applied

Quick Summary

Requirements Summary

Projetar, implantar e manter a infraestrutura de telemetria (OpenTelemetry Collectors, agentes de métricas/logs/traces, concentradores e ferramentas de visualização),

Technical Tools
OtherTech Lead

A BigDataCorp é a maior datatech da América Latina, e democratiza, desde 2013, o acesso aos dados, aumentando possibilidades e certezas em um mundo repleto de incertezas.

Somos pioneiros na captura, estruturação, armazenamento e distribuição de dados no Brasil. Nosso processo é único. Já nascemos adequados à LGPD e às demais regulamentações, garantindo a origem das informações fornecidas, obtidas sempre de forma ética.

Os times de infraestrutura são responsáveis por organizar, manter e evoluir as diferentes plataformas que constituem a base da operação da empresa, da organização dos serviços de computação na nuvem empregados pelos diferentes times técnicos até a definição e implantação de processos relacionados com a segurança da informação na empresa como um todo.

Requirements

~1 min read

  • Arquitetura de Observabilidade: Projetar, implantar e manter a infraestrutura de telemetria (OpenTelemetry Collectors, agentes de métricas/logs/traces, concentradores e ferramentas de visualização), garantindo alta disponibilidade da própria plataforma de observabilidade.
  • Governança de Alertas e Métricas: Configurar o ecossistema de observabilidade para coletar dados de aplicações e infraestrutura, definindo regras de alerta acionáveis (Alertmanager/Incident.io) e reduzindo o ruído operando no modelo Observability-as-a-Service para os times de desenvolvimento.
  • Arquitetura e Nuvem: Projetar, operar e evoluir a infraestrutura em AWS utilizando Infraestrutura como Código (IaC).
  • Gestão de Kubernetes: Administrar clusters em produção, garantindo escalabilidade, segurança e controle de custos.
  • CI/CD e Automação: Construir e otimizar pipelines de entrega contínua rápidas e confiáveis, eliminando trabalho operacional repetitivo (toil).
  • Liderança e Mentoria: Guiar o time de infraestrutura/plataforma, organizar o backlog, distribuir tarefas e atuar como mentor(a) para os demais engenheiros.
  • Ponte com Produto: Negociar prioridades técnicas com os times de desenvolvimento e produto.

  • Cloud: Experiência profunda com provedores de nuvem pública (preferencialmente AWS).
  • Containers: Domínio avançado de Kubernetes e ecossistema de containers (Docker/containerd).
  • Vivência madura na operação e sustentação de sistemas distribuídos e de alta disponibilidade em produção.
  • Infraestrutura de Observabilidade (Hands-on): Experiência comprovada implantando e configurando a pilha de observabilidade via código (IaC/Helm). É necessário dominar o deploy e gerenciamento de ferramentas como Prometheus Operator, OpenTelemetry Collector, Grafana Stack (Loki, Tempo, Mimir) ou agentes/arquitetura em soluções proprietárias (Datadog, New Relic, Dynatrace), incluindo gestão de retenção e custo de dados de telemetria.
  • Capacidade de desenhar arquiteturas resilientes e escaláveis na nuvem.
  • Visão sistêmica de ciclo de vida de desenvolvimento de software (SDLC) para melhorar a experiência dos desenvolvedores (DevEx).
  • Visão de Engenharia de Telemetria: Entendimento profundo de como os dados de observabilidade são gerados, coletados, processados e armazenados (não apenas criar dashboards, mas entender o caminho que o log, a métrica e o trace percorrem desde a aplicação até o banco de dados de telemetria).
  • Experiência em protocolos de resposta a incidentes.
  • Experiência ou forte aptidão para facilitação de ritos ágeis e gestão de entregas de um pequeno time técnico.
  • IaC: Proficiência em Infraestrutura como Código (Terraform, Pulumi ou similar).
  • Programação/Scripting: Capacidade real de codificar para automação (Python, Go ou Bash avançado).
  • CI/CD: Experiência na construção e manutenção de pipelines (GitLab CI, GitHub Actions, Jenkins, etc.).
  • Comunicação e Negociação: Saber traduzir dívidas técnicas e riscos de infraestrutura para uma linguagem de negócios, conseguindo negociar espaço no backlog com os demais times internos.
  • Inteligência Emocional: Resiliência e frieza para tomar decisões rápidas sob pressão durante incidentes (quedas de produção).
  • Perfil Mentoria (Servant Leadership): Gostar de ensinar, destravar o time e formar novos talentos, não apenas querer brilhar sozinho no código.
  • Pragmatismo: Saber equilibrar a "arquitetura perfeita" com as necessidades reais e o tempo de entrega que o negócio exige.
  • Requisitos diferenciais:
      • GitOps & Service Mesh: Prática com Argo CD, Flux, Istio ou Linkerd.
      • FinOps: Experiência prática na redução e otimização de custos de infraestrutura em nuvem.
      • Observabilidade Avançada e eBPF: Uso de eBPF (Cilium, Pixie) para observabilidade sem instrumentação pesada no código.
      • Otimização de Custos em Observabilidade: Estratégias de amostragem (sampling) de traces, agregação/descarte de logs em nível de coletor para evitar explosão de custos de ingestão na nuvem ou SaaS.
      • Segurança (DevSecOps): Gestão de segredos, políticas como código (ex: OPA/Gatekeeper) e segurança de supply chain.
      • Certificações: CKA (Certified Kubernetes Administrator), AWS Solutions Architect ou equivalentes.
      • Idiomas: Inglês técnico avançado (para leitura, conversação e condução de fóruns com eventuais fornecedores/times globais).

What We Offer

~1 min read
    • Trabalho 100% remoto (trabalhe de onde quiser);
    • Escritório em RJ e SP com ambiente de trabalho descontraído (para quem quiser utilizar);
    • Oportunidades de crescimento e desenvolvimento;
    • Flexibilidade de horários (sim, mesmo em home office);
    • Férias flexíveis (além do regime CLT);
    • Plano de saúde e dental Bradesco;
    • Seguro de vida em grupo;
    • Benefício Refeição via cartão Caju;
    • Auxílio mensal ao home office (móveis e internet);
    • Vale Home Office;
    • OrienteMe (apoio psicológico);
    • Conexa Saúde (apoio psicológico e nutricional);
    • Wellhub;
    • Day Off para aniversários;
    • Licença Maternidade de 6 meses;
    • Licença Paternidade de 1 mês;
    • Auxílio-creche;
    • Convênio SESC;
    • Game night (presencial no escritório do RJ e online no Discord);
    • BDC Learning e BDC Decola (programa de desenvolvimento e crescimento dos nossos profissionais através do subsídio de treinamentos diversos, como cursos, palestras, livros e outros);
    • Equipe unida e sempre pronta para apoiar.

Location & Eligibility

Where is the job
Rio de Janeiro, Brazil
Remote within one country

Listing Details

Posted
October 2, 2026
First seen
October 2, 2026
Last seen
October 2, 2026

Posting Health

Days active
0
Repost count
0
Trust Level
75%
Scored at
October 2, 2026

Signal breakdown

freshnesssource trustcontent trustemployer trust
Newsletter

Stay ahead of the market

Get the latest job openings, salary trends, and hiring insights delivered to your inbox every week.

A
B
C
D
Join 12,000+ marketers

No spam. Unsubscribe at any time.

Devops/SRE Tech Lead I Observabilidade