Especialista Devops
Indexed description
No Grupo Stefanini, acreditamos no poder da colaboração. Co-criamos soluções inovadoras em parceria com nossos clientes, combinando tecnologia de ponta, inteligência artificial e a criatividade humana. Estamos na vanguarda da resolução de problemas de negócios, proporcionando impacto real em escala global.
Ao se juntar à Stefanini, você se torna parte de uma jornada global de transformação. Estamos empenhados em criar impacto positivo não apenas nos negócios, mas também na vida de nossos colaboradores. Se você procura uma oportunidade de crescimento profissional em uma empresa que valoriza inovação, respeito, autonomia e parceria, você encontra aqui!
Junte-se a nós e seja parte da mudança!#LIREMOTE#LI-SS1
Responsabilidades e atribuições
Estamos em busca de uma Pessoa Engenheira SRE com foco em Observabilidade para atuar em ambientes críticos, garantindo alta disponibilidade, performance e confiabilidade de aplicações de missão crítica.
Você será uma das principais referências técnicas em observabilidade, trabalhando na evolução da estratégia de monitoramento, análise de incidentes e automação operacional, além de apoiar os times de engenharia na construção de uma cultura de excelência operacional e confiabilidade.
Principais responsabilidadesProjetar, implementar e evoluir a estratégia de observabilidade utilizando Datadog e ELK Stack (Elasticsearch + Kibana);
Estruturar e correlacionar métricas, logs e traces para troubleshooting e análise de causa raiz;
Definir e evoluir SLIs, SLOs, Error Budgets, dashboards e alertas inteligentes, reduzindo ruídos e acelerando a resolução de incidentes;
Atuar tecnicamente em incidentes críticos, conduzindo análises de causa raiz e propondo ações preventivas para evitar recorrências;
Apoiar squads de desenvolvimento na adoção das melhores práticas de SRE, DevOps, observabilidade e confiabilidade;
Automatizar atividades operacionais e processos utilizando Python;
Contribuir para a evolução contínua da plataforma, promovendo maior estabilidade, escalabilidade e eficiência operacional.
Requisitos e qualificações
Requisitos obrigatóriosExperiência sólida em Site Reliability Engineering (SRE) ou áreas correlatas;
Forte experiência com Datadog;
Experiência em análise de logs utilizando ELK Stack (Elasticsearch e Kibana);
Vivência com correlação entre métricas, logs e traces para identificação de causa raiz;
Experiência em ambientes de missão crítica, alta disponibilidade e alto volume transacional;
Conhecimento de práticas de observabilidade e monitoramento de aplicações.
Conhecimentos desejáveisCloud Computing, preferencialmente AWS;
Kubernetes;
Pipelines de CI/CD;
Infraestrutura como Código (Terraform);
Automação utilizando Python;
Conhecimento de aplicações Java em runtime e troubleshooting.
Será considerado um
diferencial
Experiência com definição de SLIs, SLOs, Error Budgets e cultura SRE;
Experiência em ambientes Multi-Cloud;
Automação avançada de operações;
Conhecimento em Inteligência Artificial aplicada à observabilidade e operações (AIOps).
Informações adicionais
🍛 Vale-alimentação ou vale-refeição;👨🏼🎓 Desconto em cursos, universidades e instituições de idiomas;📚 Academia Stefanini — plataforma com cursos on-line, gratuitos, atualizados e com certificado;🗣 Mentoring;💉 Clube de vantagens para consultas e exames;🏥 Assistência médica;🦷 Assistência odontológica;💰 Clube de vantagens e descontos nos melhores estabelecimentos;🛫 Clube de viagens;🐶 Convênio para pets.
Create a free Caio profile to unlock more results and save your role and location preferences.
Unlock free search