ESPECIALISTA SRE

Summary

SRE specialist focused on Observability, building end-to-end service mapping and defining observability strategies (metrics, logs, traces, SLI/SLO) to reduce MTTD/MTTR across distributed systems. Works transversally with Infrastructure, Networks, DB, Cloud, Security, and Dev teams using Kubernetes, Datadog, Prometheus, Grafana, and OpenTelemetry.

Nós somos aQuality Digital! Saiba mais sobre a gente:

  • Uma frase que nos define- Somos especialistas em soluções de TI e apaixonados por inovação! 🚀
  • Ao infinito e além - Somos #semfronteiras. Nosso time está espalhado pelo Brasil e pelo mundo 🌎
  • Nossa cultura - Mesmo distantes, estamos juntos 🧡 Temos cerimônias para estarmos mais próximos, compartilhar conhecimento e ficar por dentro das novidades da nossa empresa!
  • Somos diversos - Um dos nossos compromissos é fazer da companhia um ambiente cada vez mais diverso, inclusivo e respeitoso, valorizando e promovendo a pluralidade. Por isso, aqui temos espaço para todas as pessoas, independente de raça, gênero, idade, orientação sexual, crença religiosa ou deficiência. 🏳️‍🌈👩🏾‍🦽
  • Nosso objetivo - Potencializar os negócios dos nossos clientes através de soluções inovadoras e sustentáveis. Topa vir com a gente nessa? 🎯

O que buscamos?

Buscamos um profissional de Site Reliability Engineering com forte especialização em Observabilidade, capaz de atuar de forma transversal entre diferentes áreas de tecnologia para mapear, compreender e monitorar a cadeia completa dos serviços e sistemas da organização.

O principal desafio desta posição será construir uma visão ponta a ponta dos serviços, identificando como aplicações, integrações, APIs, bancos de dados, componentes de infraestrutura, redes, mensageria e serviços de terceiros se relacionam para entregar cada serviço de negócio.

Forte capacidade de investigação técnica e visão sistêmica, que tenha facilidade para conversar com especialistas de diferentes disciplinas e transformar informações fragmentadas em uma visão integrada do ambiente.

Principais responsabilidades:

  • Atuar junto aos times de Infraestrutura, Redes, Banco de Dados, Cloud, Segurança, Desenvolvimento, Arquitetura, Integração, Middleware, APIs e Sistemas, conduzindo levantamentos técnicos e workshops de descoberta.
  • Mapear a arquitetura e a cadeia de dependências dos principais sistemas da empresa, identificando todos os componentes envolvidos na entrega de cada serviço.
  • Construir o Service Mapping ponta a ponta, contemplando infraestrutura, aplicações, integrações, APIs, bancos de dados, filas, serviços externos e demais dependências.
  • Identificar os diferentes caminhos utilizados pelas integrações entre sistemas e compreender como cada componente impacta a disponibilidade do serviço.
  • Relacionar componentes técnicos com os respectivos serviços de negócio, permitindo maior entendimento do impacto de falhas.
  • Identificar lacunas de monitoração e observabilidade existentes nos ambientes.
  • Definir e implementar uma estratégia de observabilidade para os serviços mapeados, contemplando métricas, logs, traces, eventos, experiência digital e disponibilidade.
  • Criar monitoração orientada a serviço, deixando de observar apenas componentes isolados e passando a acompanhar o fluxo completo das transações e integrações.
  • Definir indicadores de confiabilidade como SLI, SLO e disponibilidade de serviços.
  • Construir dashboards, alertas, correlações e mecanismos de diagnóstico que permitam identificar rapidamente onde ocorreu uma degradação ou interrupção.
  • Trabalhar na redução de MTTD e MTTR, utilizando observabilidade para acelerar a identificação da causa raiz.
  • Participar de projetos corporativos desde suas fases iniciais, garantindo que novos sistemas e integrações já nasçam com requisitos adequados de observabilidade.
  • Apoiar a evolução da cultura de observabilidade dentro da organização, promovendo boas práticas entre os diferentes times técnicos.
  • Necessário Ensino Superior completo;
  • Arquitetura de aplicações e sistemas distribuídos
  • Infraestrutura de servidores e sistemas operacionais
  • Redes e protocolos de comunicação
  • Bancos de dados
  • APIs REST e integrações entre sistemas
  • Microserviços
  • Containers e Kubernetes
  • Cloud e ambientes híbridos
  • Filas e mensageria
  • Balanceadores, proxies e gateways
  • DNS, HTTP/HTTPS, TCP/IP e TLS
  • APM e Distributed Tracing
  • Centralização e análise de logs
  • Métricas e monitoramento de infraestrutura
  • Service Mapping e Dependency Mapping
  • SLI, SLO, SLA e Error Budget
  • Incident Management e análise de causa raiz

Ferramentas e tecnologias

É desejável experiência com ferramentas e plataformas de observabilidade como:

  • Datadog
  • Elastic Stack / Elasticsearch / Logstash / Kibana / Elastic Agent
  • Sensedia / API Management
  • Zabbix
  • OpenTelemetry
  • Prometheus
  • Grafana

Serão diferenciais

  • Inglês nível intermediário.

Horário de atuação

  • 100% remoto
  • 08:00h às 17:30h(intervalo para almoço das 11:30h às 13:00h) - Temporário

OBS.:Hey! Caso você não preencha todos os requisitos da vaga, te convidamos a se candidatar mesmo assim, ok? Faremos uma análise cuidadosa do seu perfil considerando todas as suas qualificações 😉

Informações adicionais

O que você vai encontrar aqui:

  • Um ambiente propício paraaprendizadoecrescimento profissional 🎯
  • Avaliação de desempenhoefeedbacks, visando o desenvolvimento contínuo das nossas pessoas📊
  • Vale alimentação e/ou refeiçãopara suas compras de mercado e refeições 🍴
  • Assistência médica e odontológicapara que você e sua família estejam com a saúde em dia💙
  • Convênio com farmáciaspara descontos em medicamentos💊
  • Auxílio crechede acordo com política vigente🍼
  • Parceria com o SESCpara programações variadas de cultura e lazer
  • Parcerias para seus estudosde idiomas, tecnologia e plataforma de cursos📚
  • Empréstimo consignadocom taxas atrativas + programa de educação financeira💰
  • Universidade Corporativa e trilhas de conhecimentocom conteúdos diversos de tecnologia, soft skills, tendências de mercado e muito mais 👨‍💻
  • Programa de Indicaçõescom possibilidade de prêmios e bonificações 🎁
  • Seguro de vidacoletivo ⛑

See also

要針對這個職缺調整履歷嗎?

目前無法檢查您與這個職缺的符合程度;請先將履歷加入個人檔案,下次即可查看。

A new version of freehire is available