SRE Engineer Sênior
Skills
About the role
Buscamos um(a) SRE Engineer Sênior com sólida experiência em Datadog para atuar na evolução da estratégia de observabilidade e confiabilidade dos ambientes da empresa.
O profissional será responsável por identificar oportunidades de otimização da plataforma, implementar melhores práticas de monitoramento e gerenciamento de logs, reduzir custos relacionados ao uso do Datadog e apoiar a evolução da arquitetura em ambientes AWS.
Procuramos um perfil com forte conhecimento em observabilidade, cloud computing e automação, capaz de atuar de forma estratégica na melhoria da disponibilidade, performance e eficiência operacional das aplicações e serviços.
Quem somos e por que estamos contratando
Fundada em 2016, somos o braço especializado na oferta de serviços terceirizados de profissionais de TI, permitindo que nossos clientes mantenham o foco em seus propósitos de negócio e confiem a TI com a gente.
Em linha com o crescimento da demanda por esses serviços, reestruturamos nossa organização, trazendo grandes talentos e especialistas para compor nosso time.
Nossos colaboradores são nosso maior e melhor ativo. Por isso, buscamos profissionais dinâmicos, apaixonados por TI, inovação e qualidade, que coloquem o cliente em primeiro lugar, mas que também priorizem o seu bem-estar e o de todo o grupo, valorizando a importância do aprendizado contínuo.
Descrição das atividades:
Observabilidade e Monitoramento
Administrar, configurar e evoluir a plataforma Datadog.
Desenvolver dashboards, alertas e métricas para monitoramento de aplicações e infraestrutura.
Implementar estratégias de observabilidade para ambientes distribuídos.
Garantir visibilidade ponta a ponta dos serviços críticos.
Otimização de Custos
Identificar oportunidades de redução de custos na utilização do Datadog.
Implementar melhores práticas de ingestão, retenção e gerenciamento de logs.
Otimizar o consumo de métricas, traces e monitoramentos.
Propor melhorias contínuas visando maior eficiência operacional e financeira da plataforma.
Cloud e Infraestrutura
Atuar em ambientes AWS, apoiando iniciativas de confiabilidade, disponibilidade e escalabilidade.
Colaborar na automação de processos operacionais e monitoramento.
Trabalhar em conjunto com equipes de infraestrutura, plataforma e desenvolvimento para evolução contínua dos ambientes.
Confiabilidade e Melhoria Contínua
Apoiar análises de incidentes e identificação de causa raiz.
Implementar melhorias preventivas para aumentar a estabilidade dos ambientes.
Disseminar boas práticas de Site Reliability Engineering e observabilidade.
Contribuir para a evolução da arquitetura e da maturidade operacional da organização.
Requisitos obrigatórios:
Experiência sólida como Site Reliability Engineer ou em funções correlatas.
Domínio da plataforma Datadog.
Experiência em observabilidade, monitoramento de aplicações e infraestrutura.
Conhecimento avançado em dashboards, alertas, APM, Distributed Tracing e gerenciamento de métricas.
Experiência em otimização de custos da plataforma Datadog.
Conhecimento em melhores práticas de ingestão e gerenciamento de logs.
Sólidos conhecimentos em AWS.
Experiência com troubleshooting em ambientes distribuídos.
Conhecimento em arquitetura de cloud e alta disponibilidade.
Requisitos desejáveis:
Background em Engenharia de Software.
Experiência com linguagens como Python, Go ou Shell Script para automação.
Conhecimento em Kubernetes e containers.
Vivência com Infrastructure as Code, como Terraform ou CloudFormation.
Experiência com práticas DevOps e pipelines CI/CD.
Certificações AWS ou Datadog.
Competências comportamentais
Perfil analítico e investigativo.
Capacidade de identificar oportunidades de otimização técnica e financeira.
Proatividade e foco em melhoria contínua.
Boa comunicação e colaboração com equipes multidisciplinares.
Facilidade para atuar em ambientes críticos e de alta disponibilidade.
Forte capacidade de resolução de problemas.
Informações da vaga
Nível de experiência: Sênior
Regime de contratação: Pessoa Jurídica
Modelo de trabalho: Híbrido, com atuação presencial 1 dia por semana
Previsão de início: Imediato
Formação desejada: Graduação completa ou em andamento em Ciência da Computação, Engenharia da Computação, Sistemas de Informação, Análise de Sistemas ou áreas correlatas
Idioma: Português
Questions about this role
Want AI Applyd to auto-apply to roles like this?
We tailor your resume per posting, fill the forms, and track replies for you.