ESPECIALISTA SRE

Quality Digital · via Himalayas ·

TypeFull-time job
LocationBrazil
Posted3 hours ago
Nós somos aQuality Digital! Saiba mais sobre a gente:

Uma frase que nos define- Somos especialistas em soluções de TI e apaixonados por inovação! 🚀

Ao infinito e além - Somos #semfronteiras. Nosso time está espalhado pelo Brasil e pelo mundo 🌎

Nossa cultura - Mesmo distantes, estamos juntos 🧡 Temos cerimônias para estarmos mais próximos, compartilhar conhecimento e ficar por dentro das novidades da nossa empresa!

Somos diversos - Um dos nossos compromissos é fazer da companhia um ambiente cada vez mais diverso, inclusivo e respeitoso, valorizando e promovendo a pluralidade. Por isso, aqui temos espaço para todas as pessoas, independente de raça, gênero, idade, orientação sexual, crença religiosa ou deficiência. 🏳️‍🌈👩🏾‍🦽

Nosso objetivo - Potencializar os negócios dos nossos clientes através de soluções inovadoras e sustentáveis. Topa vir com a gente nessa? 🎯

O que buscamos?
Buscamos um profissional de Site Reliability Engineering com forte especialização em Observabilidade, capaz de atuar de forma transversal entre diferentes áreas de tecnologia para mapear, compreender e monitorar a cadeia completa dos serviços e sistemas da organização.
O principal desafio desta posição será construir uma visão ponta a ponta dos serviços, identificando como aplicações, integrações, APIs, bancos de dados, componentes de infraestrutura, redes, mensageria e serviços de terceiros se relacionam para entregar cada serviço de negócio.
Forte capacidade de investigação técnica e visão sistêmica, que tenha facilidade para conversar com especialistas de diferentes disciplinas e transformar informações fragmentadas em uma visão integrada do ambiente.
Principais responsabilidades:

Atuar junto aos times de Infraestrutura, Redes, Banco de Dados, Cloud, Segurança, Desenvolvimento, Arquitetura, Integração, Middleware, APIs e Sistemas, conduzindo levantamentos técnicos e workshops de descoberta.

Mapear a arquitetura e a cadeia de dependências dos principais sistemas da empresa, identificando todos os componentes envolvidos na entrega de cada serviço.

Construir o Service Mapping ponta a ponta, contemplando infraestrutura, aplicações, integrações, APIs, bancos de dados, filas, serviços externos e demais dependências.

Identificar os diferentes caminhos utilizados pelas integrações entre sistemas e compreender como cada componente impacta a disponibilidade do serviço.

Relacionar componentes técnicos com os respectivos serviços de negócio, permitindo maior entendimento do impacto de falhas.

Identificar lacunas de monitoração e observabilidade existentes nos ambientes.

Definir e implementar uma estratégia de observabilidade para os serviços mapeados, contemplando métricas, logs, traces, eventos, experiência digital e disponibilidade.

Criar monitoração orientada a serviço, deixando de observar apenas componentes isolados e passando a acompanhar o fluxo completo das transações e integrações.

Definir indicadores de confiabilidade como SLI, SLO e disponibilidade de serviços.

Construir dashboards, alertas, correlações e mecanismos de diagnóstico que permitam identificar rapidamente onde ocorreu uma degradação ou interrupção.

Trabalhar na redução de MTTD e MTTR, utilizando observabilidade para acelerar a identificação da causa raiz.

Participar de projetos corporativos desde suas fases iniciais, garantindo que novos sistemas e integrações já nasçam com requisitos adequados de observabilidade.

Apoiar a evolução da cultura de observabilidade dentro da organização, promovendo boas práticas entre os diferentes times técnicos.

Necessário Ensino Superior completo;

Arquitetura de aplicações e sistemas distribuídos

Infraestrutura de servidores e sistemas operacionais

Redes e protocolos de comunicação

Bancos de dados

APIs REST e integrações entre sistemas

Microserviços

Containers e Kubernetes

Cloud e ambientes híbridos

Filas e mensageria

Balanceadores, proxies e gateways

DNS, HTTP/HTTPS, TCP/IP e TLS

APM e Distributed Tracing

Centralização e análise de logs

Métricas e monitoramento de infraestrutura

Service Mapping e Dependency Mapping

SLI, SLO, SLA e Error Budget

Incident Management e análise de causa raiz

Ferramentas e tecnologias
É desejável experiência com ferramentas e plataformas de observabilidade como:

Datadog

Elastic Stack / Elasticsearch / Logstash / Kibana / Elastic Agent

Sensedia / API Management

Zabbix

OpenTelemetry

Prometheus

Grafana

Serão diferenciais
Inglês nível intermediário.

Horário de atuação

100% remoto

08:00h às 17:30h(intervalo para almoço das 11:30h às 13:00h) - Temporário

OBS.:Hey! Caso você não preencha todos os requisitos da vaga, te convidamos a se candidatar mesmo assim, ok? Faremos uma análise cuidadosa do seu perfil considerando todas as suas qualificações 😉
Informações adicionais
O que você vai encontrar aqui:

Um ambiente propício paraaprendizadoecrescimento profissional 🎯

Avaliação de desempenhoefeedbacks, visando o desenvolvimento contínuo das nossas pessoas📊

Vale alimentação e/ou refeiçãopara suas compras de mercado e refeições 🍴

Assistência médica e odontológicapara que você e sua família estejam com a saúde em dia💙

Convênio com farmáciaspara descontos em medicamentos💊

Auxílio crechede acordo com política vigente🍼

Parceria com o SESCpara programações variadas de cultura e lazer✈

Parcerias para seus estudosde idiomas, tecnologia e plataforma de cursos📚

Empréstimo consignadocom taxas atrativas + programa de educação financeira💰

Universidade Corporativa e trilhas de conhecimentocom conteúdos diversos de tecnologia, soft skills, tendências de mercado e muito mais 👨‍💻

Programa de Indicaçõescom possibilidade de prêmios e bonificações 🎁

Seguro de vidacoletivo ⛑

Originally posted on Himalayas
site-reliability-engineering especialista-de-sre observabilidade devops-engineer infrastructure-monitoring engenheiro-de-sre analista-de-sre sre sre-engineer sre-analyst
Apply on Himalayas →

Job sourced from Himalayas. Applications happen directly on the original platform — we never collect your data.