São Paulo, BRonsitePosted Jul 8, 2026
Posting intelligenceActively listedReposted 18×, possible evergreen/ghost posting

Skills

cloudformationkubernetesterraformdatadogpythoncicdawsgo

About the role

Buscamos um(a) SRE Engineer Sênior com sólida experiência em Datadog para atuar na evolução da estratégia de observabilidade e confiabilidade dos ambientes da empresa.

O profissional será responsável por identificar oportunidades de otimização da plataforma, implementar melhores práticas de monitoramento e gerenciamento de logs, reduzir custos relacionados ao uso do Datadog e apoiar a evolução da arquitetura em ambientes AWS.

Procuramos um perfil com forte conhecimento em observabilidade, cloud computing e automação, capaz de atuar de forma estratégica na melhoria da disponibilidade, performance e eficiência operacional das aplicações e serviços.

Quem somos e por que estamos contratando

Fundada em 2016, somos o braço especializado na oferta de serviços terceirizados de profissionais de TI, permitindo que nossos clientes mantenham o foco em seus propósitos de negócio e confiem a TI com a gente.

Em linha com o crescimento da demanda por esses serviços, reestruturamos nossa organização, trazendo grandes talentos e especialistas para compor nosso time.

Nossos colaboradores são nosso maior e melhor ativo. Por isso, buscamos profissionais dinâmicos, apaixonados por TI, inovação e qualidade, que coloquem o cliente em primeiro lugar, mas que também priorizem o seu bem-estar e o de todo o grupo, valorizando a importância do aprendizado contínuo.

Descrição das atividades:

Observabilidade e Monitoramento

Administrar, configurar e evoluir a plataforma Datadog.

Desenvolver dashboards, alertas e métricas para monitoramento de aplicações e infraestrutura.

Implementar estratégias de observabilidade para ambientes distribuídos.

Garantir visibilidade ponta a ponta dos serviços críticos.

Otimização de Custos

Identificar oportunidades de redução de custos na utilização do Datadog.

Implementar melhores práticas de ingestão, retenção e gerenciamento de logs.

Otimizar o consumo de métricas, traces e monitoramentos.

Propor melhorias contínuas visando maior eficiência operacional e financeira da plataforma.

Cloud e Infraestrutura

Atuar em ambientes AWS, apoiando iniciativas de confiabilidade, disponibilidade e escalabilidade.

Colaborar na automação de processos operacionais e monitoramento.

Trabalhar em conjunto com equipes de infraestrutura, plataforma e desenvolvimento para evolução contínua dos ambientes.

Confiabilidade e Melhoria Contínua

Apoiar análises de incidentes e identificação de causa raiz.

Implementar melhorias preventivas para aumentar a estabilidade dos ambientes.

Disseminar boas práticas de Site Reliability Engineering e observabilidade.

Contribuir para a evolução da arquitetura e da maturidade operacional da organização.

Requisitos obrigatórios:

Experiência sólida como Site Reliability Engineer ou em funções correlatas.

Domínio da plataforma Datadog.

Experiência em observabilidade, monitoramento de aplicações e infraestrutura.

Conhecimento avançado em dashboards, alertas, APM, Distributed Tracing e gerenciamento de métricas.

Experiência em otimização de custos da plataforma Datadog.

Conhecimento em melhores práticas de ingestão e gerenciamento de logs.

Sólidos conhecimentos em AWS.

Experiência com troubleshooting em ambientes distribuídos.

Conhecimento em arquitetura de cloud e alta disponibilidade.

Requisitos desejáveis:

Background em Engenharia de Software.

Experiência com linguagens como Python, Go ou Shell Script para automação.

Conhecimento em Kubernetes e containers.

Vivência com Infrastructure as Code, como Terraform ou CloudFormation.

Experiência com práticas DevOps e pipelines CI/CD.

Certificações AWS ou Datadog.

Competências comportamentais

Perfil analítico e investigativo.

Capacidade de identificar oportunidades de otimização técnica e financeira.

Proatividade e foco em melhoria contínua.

Boa comunicação e colaboração com equipes multidisciplinares.

Facilidade para atuar em ambientes críticos e de alta disponibilidade.

Forte capacidade de resolução de problemas.

Informações da vaga

Nível de experiência: Sênior

Regime de contratação: Pessoa Jurídica

Modelo de trabalho: Híbrido, com atuação presencial 1 dia por semana

Previsão de início: Imediato

Formação desejada: Graduação completa ou em andamento em Ciência da Computação, Engenharia da Computação, Sistemas de Informação, Análise de Sistemas ou áreas correlatas

Idioma: Português

Questions about this role

Click "Apply with AI Applyd" above. We auto-fill the application from your resume and answer screening questions in seconds. No copy and paste, no juggling tabs.

Compensation for DevOps / SRE roles in Brazil varies widely by seniority, employer size, and remote vs onsite arrangement. Check the salary range on this listing when published, or browse our DevOps / SRE hub for Brazil medians across recent openings.

Most applications complete in under 90 seconds. You can track the status in your dashboard and watch the screenshot proof land the moment the application submits.

AI Applyd supports Greenhouse, Lever, Ashby, Workday, iCIMS, SmartRecruiters, Personio, Teamtailor and other major ATS platforms. If we can submit through the platform, we do.

Want AI Applyd to auto-apply to roles like this?

We tailor your resume per posting, fill the forms, and track replies for you.