# Devops/SRE Tech Lead I Observabilidade

> BigDataCorp · Rio de Janeiro, Brazil (Remote) · — · Posted 2026-10-02

**Workplace:** remote

## Description

**Sobre a BigDataCorp**

A BigDataCorp é a maior datatech da América Latina, e democratiza, desde 2013, o acesso aos dados, aumentando possibilidades e certezas em um mundo repleto de incertezas.

Somos pioneiros na captura, estruturação, armazenamento e distribuição de dados no Brasil. Nosso processo é único. Já nascemos adequados à LGPD e às demais regulamentações, garantindo a origem das informações fornecidas, obtidas sempre de forma ética.

**Sobre a área e a vaga**

Os times de infraestrutura são responsáveis por organizar, manter e evoluir as diferentes plataformas que constituem a base da operação da empresa, da organização dos serviços de computação na nuvem empregados pelos diferentes times técnicos até a definição e implantação de processos relacionados com a segurança da informação na empresa como um todo.

## Requirements

**O que vai fazer no dia a dia**

-   Arquitetura de Observabilidade: Projetar, implantar e manter a infraestrutura de telemetria (OpenTelemetry Collectors, agentes de métricas/logs/traces, concentradores e ferramentas de visualização), garantindo alta disponibilidade da própria plataforma de observabilidade.
-   Governança de Alertas e Métricas: Configurar o ecossistema de observabilidade para coletar dados de aplicações e infraestrutura, definindo regras de alerta acionáveis (Alertmanager/Incident.io) e reduzindo o ruído operando no modelo Observability-as-a-Service para os times de desenvolvimento.
-   Arquitetura e Nuvem: Projetar, operar e evoluir a infraestrutura em AWS utilizando Infraestrutura como Código (IaC).
-   Gestão de Kubernetes: Administrar clusters em produção, garantindo escalabilidade, segurança e controle de custos.
-   CI/CD e Automação: Construir e otimizar pipelines de entrega contínua rápidas e confiáveis, eliminando trabalho operacional repetitivo (toil).
-   Liderança e Mentoria: Guiar o time de infraestrutura/plataforma, organizar o backlog, distribuir tarefas e atuar como mentor(a) para os demais engenheiros.
-   Ponte com Produto: Negociar prioridades técnicas com os times de desenvolvimento e produto.

**Habilidades necessárias**

-   Cloud: Experiência profunda com provedores de nuvem pública (preferencialmente AWS).
-   Containers: Domínio avançado de Kubernetes e ecossistema de containers (Docker/containerd).
-   Vivência madura na operação e sustentação de sistemas distribuídos e de alta disponibilidade em produção.
-   Infraestrutura de Observabilidade (Hands-on): Experiência comprovada implantando e configurando a pilha de observabilidade via código (IaC/Helm). É necessário dominar o deploy e gerenciamento de ferramentas como Prometheus Operator, OpenTelemetry Collector, Grafana Stack (Loki, Tempo, Mimir) ou agentes/arquitetura em soluções proprietárias (Datadog, New Relic, Dynatrace), incluindo gestão de retenção e custo de dados de telemetria.
-   Capacidade de desenhar arquiteturas resilientes e escaláveis na nuvem.
-   Visão sistêmica de ciclo de vida de desenvolvimento de software (SDLC) para melhorar a experiência dos desenvolvedores (DevEx).
-   Visão de Engenharia de Telemetria: Entendimento profundo de como os dados de observabilidade são gerados, coletados, processados e armazenados (não apenas criar dashboards, mas entender o caminho que o log, a métrica e o trace percorrem desde a aplicação até o banco de dados de telemetria).
-   Experiência em protocolos de resposta a incidentes.
-   Experiência ou forte aptidão para facilitação de ritos ágeis e gestão de entregas de um pequeno time técnico.
-   IaC: Proficiência em Infraestrutura como Código (Terraform, Pulumi ou similar).
-   Programação/Scripting: Capacidade real de codificar para automação (Python, Go ou Bash avançado).
-   CI/CD: Experiência na construção e manutenção de pipelines (GitLab CI, GitHub Actions, Jenkins, etc.).
-   Comunicação e Negociação: Saber traduzir dívidas técnicas e riscos de infraestrutura para uma linguagem de negócios, conseguindo negociar espaço no backlog com os demais times internos.
-   Inteligência Emocional: Resiliência e frieza para tomar decisões rápidas sob pressão durante incidentes (quedas de produção).
-   Perfil Mentoria (Servant Leadership): Gostar de ensinar, destravar o time e formar novos talentos, não apenas querer brilhar sozinho no código.
-   Pragmatismo: Saber equilibrar a "arquitetura perfeita" com as necessidades reais e o tempo de entrega que o negócio exige.
-   Requisitos diferenciais:

-   GitOps & Service Mesh: Prática com Argo CD, Flux, Istio ou Linkerd.
-   FinOps: Experiência prática na redução e otimização de custos de infraestrutura em nuvem.
-   Observabilidade Avançada e eBPF: Uso de eBPF (Cilium, Pixie) para observabilidade sem instrumentação pesada no código.
-   Otimização de Custos em Observabilidade: Estratégias de amostragem (sampling) de traces, agregação/descarte de logs em nível de coletor para evitar explosão de custos de ingestão na nuvem ou SaaS.
-   Segurança (DevSecOps): Gestão de segredos, políticas como código (ex: OPA/Gatekeeper) e segurança de supply chain.
-   Certificações: CKA (Certified Kubernetes Administrator), AWS Solutions Architect ou equivalentes.
-   Idiomas: Inglês técnico avançado (para leitura, conversação e condução de fóruns com eventuais fornecedores/times globais).

## Benefits

**O que oferecemos**

-   Trabalho 100% remoto (trabalhe de onde quiser);
-   Escritório em RJ e SP com ambiente de trabalho descontraído (para quem quiser utilizar);
-   Oportunidades de crescimento e desenvolvimento;
-   Flexibilidade de horários (sim, mesmo em home office);
-   Férias flexíveis (além do regime CLT);
-   Plano de saúde e dental Bradesco;
-   Seguro de vida em grupo;
-   Benefício Refeição via cartão Caju;
-   Auxílio mensal ao home office (móveis e internet);
-   Vale Home Office;
-   OrienteMe (apoio psicológico);
-   Conexa Saúde (apoio psicológico e nutricional);
-   Wellhub;
-   Day Off para aniversários;
-   Licença Maternidade de 6 meses;
-   Licença Paternidade de 1 mês;
-   Auxílio-creche;
-   Convênio SESC;
-   Game night (presencial no escritório do RJ e online no Discord);
-   BDC Learning e BDC Decola (programa de desenvolvimento e crescimento dos nossos profissionais através do subsídio de treinamentos diversos, como cursos, palestras, livros e outros);
-   Equipe unida e sempre pronta para apoiar.

## Apply

[Apply at BigDataCorp](https://apply.workable.com/bigdatacorp/j/BF6FDF93F1/apply)

---
Powered by [Workable](https://www.workable.com)
