A Quality Digital está com vaga aberta para Especialista SRE em modelo 100% remoto (home office). A oportunidade é para atuar com Site Reliability Engineering e observabilidade, construindo uma visão ponta a ponta dos serviços e sistemas e fortalecendo a confiabilidade da operação.
Responsabilidades e atribuições
- Atuar junto aos times de Infraestrutura, Redes, Banco de Dados, Cloud, Segurança, Desenvolvimento, Arquitetura, Integração, Middleware, APIs e Sistemas;
- Conduzir levantamentos técnicos e workshops de descoberta;
- Mapear a arquitetura e a cadeia de dependências dos principais sistemas;
- Construir o Service Mapping ponta a ponta;
- Mapear infraestrutura, aplicações, integrações, APIs, bancos de dados, filas, serviços externos e demais dependências;
- Identificar os caminhos utilizados pelas integrações entre sistemas;
- Avaliar como cada componente impacta a disponibilidade dos serviços;
- Relacionar componentes técnicos aos respectivos serviços de negócio;
- Identificar lacunas de monitoração e observabilidade;
- Definir e implementar estratégias de observabilidade;
- Trabalhar com métricas, logs, traces, eventos, experiência digital e disponibilidade;
- Criar monitoração orientada a serviços e acompanhar o fluxo completo de transações e integrações;
- Definir indicadores de confiabilidade, como SLI, SLO e disponibilidade;
- Construir dashboards, alertas, correlações e mecanismos de diagnóstico;
- Identificar rapidamente degradações e interrupções;
- Atuar na redução de MTTD e MTTR;
- Utilizar observabilidade para acelerar a identificação de causas raiz;
- Participar de projetos corporativos desde as fases iniciais;
- Garantir requisitos adequados de observabilidade para novos sistemas e integrações;
- Promover boas práticas e contribuir para a evolução da cultura de observabilidade na organização.
Requisitos
- Ensino Superior completo;
- Conhecimento em arquitetura de aplicações e sistemas distribuídos;
- Conhecimento em infraestrutura de servidores e sistemas operacionais;
- Conhecimento em redes e protocolos de comunicação;
- Conhecimento em bancos de dados;
- Experiência com APIs REST e integrações entre sistemas;
- Conhecimento em microsserviços;
- Experiência com containers e Kubernetes;
- Conhecimento em Cloud e ambientes híbridos;
- Conhecimento em filas e mensageria;
- Conhecimento em balanceadores, proxies e gateways;
- Conhecimento em DNS, HTTP/HTTPS, TCP/IP e TLS;
- Conhecimento em APM e Distributed Tracing;
- Experiência com centralização e análise de logs;
- Conhecimento em métricas e monitoramento de infraestrutura;
- Conhecimento em Service Mapping e Dependency Mapping;
- Conhecimento em SLI, SLO, SLA e Error Budget;
- Experiência com Incident Management e análise de causa raiz.
Diferenciais
- Inglês intermediário.
Benefícios
- Vale-alimentação e/ou refeição;
- Assistência médica e odontológica;
- Convênio com farmácias;
- Auxílio-creche;
- Parceria com o SESC;
- Parcerias para estudos de idiomas, tecnologia e plataformas de cursos;
- Empréstimo consignado com taxas atrativas;
- Programa de educação financeira;
- Universidade Corporativa e trilhas de conhecimento;
- Programa de Indicações com possibilidade de prêmios e bonificações;
- Seguro de vida coletivo;
- Ambiente voltado para aprendizado e crescimento profissional;
- Avaliação de desempenho e feedbacks para desenvolvimento contínuo.
Informações adicionais
- Horário: 08h às 17h30, com intervalo das 11h30 às 13h;
- Contratação temporária;
- A oportunidade também é destinada a PcD.
Candidaturas Encerradas
As candidaturas para essa vaga foram encerradas a pedido da empresa/recrutador ou porque o prazo final para recebimento das inscrições foi atingido.
Alguns anúncios podem expirar rápido devido ao alto volume de candidaturas.
Alguns anúncios podem expirar rápido devido ao alto volume de candidaturas.
