Site Reliability Engineer
Especialista Command Center TI (Cartões)
Удалённо
Откликнуться на сайте работодателяОписание вакансии
Unidade de Negócio:
Sem Parar
Local de trabalho:
Pinheiros/São Paulo.
Modelo de trabalho:
Híbrido 2x3 (ida ao escritório duas vezes na semana)
Objetivos do cargo que você irá atuar:
Buscamos uma pessoa Especialista em Command Center TI para atuar na sustentação e evolução do ecossistema crítico de cartões e meios de pagamento, garantindo disponibilidade, estabilidade, performance e confiabilidade dos serviços por meio de práticas avançadas de observabilidade, monitoramento, gestão de incidentes e automação.
Esta posição será responsável por atuar de forma integrada com times de Operações, Infraestrutura, Desenvolvimento, Segurança, Produtos e parceiros estratégicos, acompanhando a saúde dos ambientes e serviços ponta a ponta, antecipando falhas, conduzindo incidentes críticos e promovendo a excelência operacional.
Será fundamental possuir visão sistêmica do negócio de cartões, compreendendo os fluxos transacionais e seus componentes tecnológicos desde autorização e captura até liquidação, conciliação e chargeback.
Responsabilidades e atribuições
- Atuar na operação do Command Center, garantindo monitoramento e disponibilidade dos serviços críticos.
- Gerenciar incidentes de ponta a ponta, desde identificação até resolução e encerramento.
- Conduzir salas de crise (war rooms), coordenando equipes técnicas e stakeholders durante incidentes críticos.
- Realizar troubleshooting avançado utilizando métricas, logs, traces e eventos.
- Monitorar ambientes, aplicações e integrações utilizando Dynatrace, Zabbix, Grafana, Elastic/OpenSearch e Splunk.
- Criar dashboards, alertas e indicadores técnicos e de negócio.
- Monitorar fluxos do ecossistema de cartões, identificando impactos operacionais e transacionais.
- Correlacionar indicadores técnicos com impactos em jornadas e resultados de negócio.
- Desenvolver automações para monitoramento, troubleshooting e resposta a incidentes utilizando Rundeck, Shell Script, Python ou PowerShell.
- Criar e manter workflows e integrações entre ferramentas de observabilidade, automação e ITSM.
- Apoiar análises de causa raiz (RCA), gestão de problemas e ações preventivas.
- Contribuir para iniciativas de SRE, DevOps e melhoria contínua.
- Definir e acompanhar indicadores operacionais como SLA, SLI, SLO e MTTR.
- Atuar como referência técnica para o time, compartilhando conhecimento e apoiando profissionais menos experientes.
Requisitos e qualificações
É imprescindível que você tenha:
- Ensino Superior completo em Tecnologia da Informação, Engenharia da Computação, Sistemas de Informação ou áreas correlatas.
- Experiência sólida em Command Center, NOC, SRE, Observabilidade ou Operações de TI.
- Experiência avançada com Dynatrace (implantação, administração, APM, instrumentação e análise de performance).
- Experiência em gestão de incidentes críticos e condução de salas de crise.
- Vivência com observabilidade e monitoramento de ambientes críticos.
- Conhecimento avançado em:
- Dynatrace
- Zabbix
- Grafana
- Elastic/OpenSearch
- Splunk
- Experiência com automação utilizando Rundeck, Shell Script, Python ou PowerShell.
- Conhecimentos em Linux e Windows.
- Conhecimento em Cloud (AWS, Azure ou GCP).
- Conhecimento em Docker, Kubernetes e/ou OpenShift.
- Experiência em análise de causa raiz e gestão de problemas.
- Vivência com malhas batch críticas.
- Conhecimento do ecossistema de cartões e meios de pagamento.
- Inglês avançado.
Não obrigatório, mas será incrível se você tiver:
- Pós-graduação em Tecnologia, Engenharia ou Gestão de Serviços.
- Certificação Dynatrace.
- Certificações Elastic.
- Certificação ITIL.
- Certificações SRE, DevOps ou Cloud.
- Certificações relacionadas ao mercado de meios de pagamento.
- Experiência em ambientes de alta criticidade e alta volumetria transacional.
Informações adicionais
Fique por dentro do que te oferecemos:
- Vale-transporte ou estacionamento no escritório;
- Vale-alimentação e vale-refeição;
- Assistência médica;
- Assistência odontológica;
- Telemedicina — Disponível 24h por dia, todos os dias da semana;
- Wellhub (antigo Gympass);
- Zenklub;
- Auxílio home office;
- PLR (Participação nos Lucros e Resultados, de acordo com a política vigente);
- Day off de aniversário — Folga no seu aniversário e também no aniversário da empresa;
- Tag Sem Parar — Sem custo;
- Seguro de vida;
- Licença parental — Afastamento remunerado para mães, pais ou responsáveis para que possam acolher a chegada de um filho(a), por nascimento ou adoção;
- Incentivo educacional — até 25% de desconto em pós-graduação ou MBA;
Это сохранённая копия объявления, опубликованного в другом месте. Вакансии снимают без предупреждения — перед откликом проверьте сайт работодателя. mentors.coach не является нанимающей стороной.