Skip to content
SRE

Список недели

Все такие вакансии — одним письмом

Сейчас вы читаете одну вакансию. Таких же на витрине сотни, и каждую неделю выходят новые. Выберите, что присылать, оставьте почту — список придёт сам, без поисков и без возвращения сюда.

Считаем, сколько вышло за прошлую неделю…

Первое письмо приходит сразу, дальше — раз в неделю. Отписка в один клик из любого письма, адрес больше никуда не уходит.

SRE

8092 - Analista SRE Sênior

B3

Sao Paulo

Откликнуться на сайте работодателя

Описание вакансии

💡
Sobre a vaga
Cargo:
Analista de Infraestrutura, Observabilidade e Resiliência

Localização:
São Paulo, SP

Data da publicação:
13/08/2026

🏢
Como será o seu dia a dia:

  • Participar dos cerimoniais ágeis das squads e do time, apoiando a entrega de projetos e features do segmento de Listados com qualidade e resiliência.
  • Conduzir discussões sobre observabilidade, monitoração, capacidade, resiliência e finops, promovendo a melhoria contínua dos produtos.
  • Atuar em alinhamentos técnicos, avaliação de arquiteturas, documentação técnica e eliminação de atividades operacionais repetitivas (toils).

📌
Responsabilidades da área:

  • Acompanhar projetos do segmento de Listados, garantindo a viabilização de infraestrutura, monitoração e observabilidade dos produtos.
  • Atuar junto às squads e ao time de operações para garantir disponibilidade dos sistemas e aderência às políticas internas da B3.
  • Conduzir fóruns de resiliência, capacidade, finops, incidentes críticos e análises post mortem.

🎯
O que esperamos da sua atuação:

  • Perfil ativo, analítico e colaborativo, com experiência em ambientes cloud, on-premises e práticas DevOps.
  • Conhecimento em Kubernetes/OpenShift, observabilidade (SLA, SLI e SLO), ferramentas de monitoração e infraestrutura como código.
  • Experiência com automações em Python, Shell e PowerShell, além de conhecimentos em redes, bancos de dados, Kafka e arquitetura resiliente.

🚀
E será um diferencial se você tiver:

  • Inglês intermediário ou superior.
  • Certificação CKAD ou outras certificações relacionadas a Kubernetes.
  • Conhecimento em GitOps e conceitos de Inteligência Artificial Generativa.

🏆
Benefícios

  • Participação nos Lucros e Resultados (PLR)
  • Assistência médica e odontológica Bradesco Saúde
  • Vale alimentação (R$ 600/mês)
  • Vale refeição (R$ 50/dia útil)
  • Vale transporte e reembolso parcial de fretado
  • Previdência privada
  • Licença maternidade (até 180 dias) e paternidade estendida
  • Auxílio creche/babá
  • Wellhub (Gympass) e TotalPass extensivo aos dependentes
  • Clube de Vantagens com descontos em centenas de empresas
  • Trabalho híbrido e dress code flexível (“Vista-se de você!”)
  • Plataforma de cursos Alura
  • Programas de qualidade de vida: apoio pessoal, ginástica laboral, day off de aniversário, entrada gratuita em museus, quick massage e muito mais
  • Assistência funerária para você e seu pet

🏅
Reconhecimentos

  • Top Employer Brasil (2020-2025)
  • Melhores Empresas para Trabalhar (Instituições Financeiras, Tecnologia da Informação, São Paulo, Mulheres, Étnico-racial, LGBTI+)
  • Prêmios que reforçam nosso compromisso com diversidade, inclusão e excelência

🚀
Venha construir o futuro com a B3!
Somos muito mais que a bolsa do Brasil. Somos referência global em infraestrutura de mercado financeiro, com mais de 100 anos de história e impacto direto no desenvolvimento econômico sustentável do país. Aqui, você encontra um ambiente plural, inovador e colaborativo, onde cada pessoa é protagonista da própria jornada.

Quer fazer parte de uma equipe que conecta mercados, impulsiona carreiras e transforma vidas? Então essa vaga é para você!

Это сохранённая копия объявления, опубликованного в другом месте. Вакансии снимают без предупреждения — перед откликом проверьте сайт работодателя. mentors.coach не является нанимающей стороной.

SRE

Security Engineering Manager (Cloud Security)

Nubank

Sao Paulo

Откликнуться на сайте работодателя

Описание вакансии

About Nu
Nu is the leading digital bank in Latin America, serving 135 million customers across Brazil, Mexico, and Colombia. The company has been leading an industry transformation by leveraging data and proprietary technology to develop innovative products and services.

Guided by its mission to fight complexity and empower people, Nu caters to customers’ complete financial journey, promoting financial access and advancement with responsible lending and transparency. The company is powered by an efficient and scalable business model that combines low cost to serve with growing returns.

Nu’s impact has been recognized in multiple awards, including Time 100 Most Influential Companies, Fast Company’s Most Innovative Companies, and Forbes World’s Best Banks.

Visit our Institutional Page

About The Team
Cloud Security defines and operates the cloud security controls that underpin Nubank's growth globally and across multiple cloud providers. The team owns the preventive guardrails, configuration baselines, and posture-detection mechanisms that allow Nubank to launch in new markets, sustain regulatory commitments with international banking regulators, and adopt AI safely at the cloud layer.

About The Role
We are looking for an Engineering Manager II to lead a highly senior team of software engineers, translate Foundation Security's strategy into structured execution, and provide the close technical leadership of this squad's seniority and scope demand. This is a dedicated leadership seat — your full focus is one squad and its outcomes.

What You’ll Be Responsible For
Lead the squad

  • Set clear expectations, give frequent feedback, and run career conversations with senior ICs.
  • Hire and onboard talent, partnering with P&C and the Foundation Security hiring pipeline.
  • Mediate conflicts, address low performance promptly and impartially, and create a safe space for difficult conversations.
  • Manage team engagement with data; plan the team's composition and skills against Nubank's objectives.

Drive technical decisions and engineering excellence

  • Lead and enable technical decisions on the squad's architecture, with a strong understanding of multi-cloud patterns and trade-offs (AWS, GCP, IaC, Kubernetes, event-driven controls).
  • Be accountable for the technical health of the squad's products: code quality, test coverage, observability, and technical-debt management.
  • Set the team's quality bar; oversee root cause analysis for complex incidents and lead phased rollouts that reduce blast radius.
  • Sponsor architectural decisions for squad-level projects and communicate trade-offs to non-technical stakeholders.

Translate strategy into execution

  • Cascade Foundation Security and ITSec strategy into the squad's roadmap, balancing regulatory commitments across international markets, AI enablement, and ongoing reduction of cloud configuration risk.
  • Manage small-to-moderate initiatives that span multiple stakeholders (Infrastructure peers, infrastructure teams, product engineering, compliance, GRC, procurement).
  • Own the squad's contribution to OKRs, monthly business reviews, and the Area business board.

Operate with accountability

  • Hold accountability for the squad's financials within ITSec's guidelines (tooling renewals, headcount, contracts).
  • Operate in compliance with corporate policies and risk-management processes.
  • Lead and mentor others within the squad; contribute to hiring panels across Foundation Security.

We Are Looking For a Person Who Has
Must-have

  • Engineering Manager experience leading a software/security squad, or strong tech-lead/staff-level background with clear intent and readiness to move into people management.
  • Solid hands-on software engineering background — comfortable reading and reviewing code in at least one of Golang, Clojure, or Python, writing Shell/Python scripts for automation, and reviewing IaC (Terraform, Pulumi).
  • Working knowledge of AWS at scale (multi-account, Organizations, IAM, networking, Security Hub, Config). Familiarity with GCP is a strong plus.
  • Comfort designing and governing preventive controls (SCPs, Organization Policies, admission controllers) and remediation pipelines.
  • Track record of hiring, onboarding, and developing engineers; experience (or strong appetite) for running performance and career conversations.
  • Strong written and spoken communication in English; ability to make complex trade-offs clear to non-technical stakeholders.

Nice-to-have

  • Prior experience building and shipping software products (not only operating off-the-shelf security tools) — internal platforms, services, CLIs, integrations, APIs.
  • Prior exposure to CSPM/CNAPP platforms (any major vendor).
  • Experience supporting regulatory or compliance workstreams (PCI, ISO 27001, banking regulators).
  • Familiarity with Kubernetes runtime security, event-streaming platforms, and large-scale data pipelines.
  • Experience embedding security into AI/ML infrastructure.
  • Hands-on use of AI coding assistants (Cursor, Claude Code, GitHub Copilot, or similar) to accelerate engineering work and team productivity.

Tech stack you'll be exposed to

  • AWS, GCP, Terraform, Pulumi, CloudFormation, Kubernetes, Kafka, Golang, Clojure, Python, shell scripting, CSPM/CNAPP platforms, internal data pipelines, Looker/BigQuery, Jira. AI coding assistants are part of our daily engineering workflow.

What We Offer

  • A dedicated leadership seat in a squad with very high seniority and very high strategic relevance.
  • Direct line of sight to Nubank's regulatory and international expansion programs.
  • A squad that builds its own products in-house — you'll lead software engineers shipping real software, not coordinating ticket queues.
  • A peer group of EMs across Foundation Security (Runtime, Infrastructure, Data) and a senior management layer that operates with full financial and strategic accountability.
  • Exposure to multi-country, multi-cloud problems at the scale of Latin America's largest digital bank.

Our Benefits

  • Chance of earning equity at Nubank
  • Food/ Meal Card (Vale-Refeição and/or Vale Alimentação)
  • Public Transportation Commuting Benefit (Vale-Transporte)
  • NuCare – Psychological, Financial and Legal Assistance Program
  • Life Insurance
  • Medical Plan
  • Dental Plan
  • NuLanguage – Language Course Program
  • Nucleo - Our learning platform of courses
  • Extended Parental Leave
  • Daycare Allowance
  • Parental Consultancy
  • Work-from-home Allowance
  • Gym Partnerships
  • 30 days of paid vacation

Work Model for this Role
Hybrid 2-3 times/week:
Our hybrid work model brings us to the office at least twice a week, on strategic days designed to maximize team connection and collaboration. For more details, visit https://building.nubank.com/nu\-hybrid\-work\-model/

Our recruitment process may involve the use of artificial intelligence–enabled tools, such as automated interview transcription and analysis, to support the evaluation process. Artificial intelligence is not used to make final hiring decisions; all decisions are made by human reviewers.

Это сохранённая копия объявления, опубликованного в другом месте. Вакансии снимают без предупреждения — перед откликом проверьте сайт работодателя. mentors.coach не является нанимающей стороной.

SRE

Cloud Engineer / Site Reliability Engineer (SRE) Sênior

GrooveTech

Sao Paulocontract

Откликнуться на сайте работодателя

Описание вакансии

Estamos buscando um(a) Cloud Engineer / Site Reliability Engineer (SRE) Sênior para atuar na evolução, confiabilidade, segurança e escalabilidade de uma plataforma crítica.

O ambiente é 100% Google Cloud Platform (GCP), com Kubernetes/GKE como núcleo da arquitetura. Buscamos alguém com forte experiência em cloud, visão de arquitetura e mentalidade SRE, capaz de atuar de forma estratégica e hands-on.

Essa pessoa será uma referência técnica para os times de Engenharia e Produto, contribuindo para decisões de arquitetura, automação, observabilidade, segurança, performance e eficiência de custos.

Principais responsabilidades
Liderar tecnicamente a evolução da infraestrutura em GCP, principalmente GKE, Compute Engine, Cloud SQL, Cloud Storage, VPC, Load Balancing, IAM, Cloud DNS, Secret Manager, Pub/Sub e BigQuery.

Projetar arquiteturas com foco em alta disponibilidade, escalabilidade, resiliência, segurança, performance e custo.

Atuar com práticas de SRE, definindo e acompanhando SLIs, SLOs e Error Budgets.

Trabalhar com indicadores de confiabilidade como disponibilidade, latência, throughput, taxa de erro, saturação, capacidade, MTTR e MTBF.

Administrar e realizar troubleshooting avançado em Kubernetes/GKE em produção.

Definir estratégias de autoscaling, capacity planning, resource management e workload isolation.

Evoluir a estratégia de observabilidade, utilizando principalmente New Relic, além de OpenTelemetry, Prometheus, Grafana e ferramentas nativas de cloud.

Criar dashboards, alertas e métricas técnicas e de negócio, garantindo uma observabilidade acionável.

Atuar como Incident Commander em incidentes críticos e conduzir postmortems blameless.

Administrar e evoluir infraestrutura como código utilizando Terraform.

Desenvolver e manter módulos reutilizáveis, padrões de configuração, state management e pipelines de Terraform.

Administrar pipelines de CI/CD com GitHub Actions e processos de deployment utilizando ArgoCD/GitOps.

Implementar estratégias como rolling, blue/green e canary deployments.

Desenvolver automações utilizando Go, Python e Bash.

Criar soluções de Platform Engineering, self-service, templates, automações e golden paths.

Atuar com networking cloud, segurança, governança, IAM/RBAC, secrets, certificados e criptografia.

Contribuir para iniciativas de FinOps, otimização de recursos, rightsizing e redução de desperdícios.

Projetar e validar estratégias de Disaster Recovery, backup, restore, failover, RPO e RTO.

Atuar com performance e capacity planning, antecipando gargalos e necessidades de crescimento.

Requisitos
5+ anos de experiência atuando com infraestrutura crítica em produção em cloud pública.

Experiência sólida com Google Cloud Platform (GCP).

Experiência prática com Kubernetes em produção, preferencialmente GKE.

Conhecimento avançado de Terraform, incluindo módulos, state, versionamento e organização de ambientes.

Experiência prática com SLIs, SLOs e Error Budgets.

Conhecimento avançado de troubleshooting em Linux, redes, DNS, HTTP, TLS, Load Balancers e Kubernetes.

Experiência com automação utilizando Go, Python e/ou Bash.

Experiência com GitHub Actions, ArgoCD e GitOps.

Experiência na condução de incidentes críticos, postmortems e análise de causa raiz.

Capacidade de atuar em decisões arquiteturais e comunicar trade-offs técnicos, operacionais e financeiros.

Conhecimentos técnicos
Cloud
GCP — essencial

AWS e/ou Azure — desejável

Kubernetes: GKE, EKS e/ou AKS

Observabilidade
New Relic

OpenTelemetry

Prometheus

Grafana

Cloud Monitoring / CloudWatch / Azure Monitor

Infrastructure as Code
Terraform

Terragrunt

Atlantis

Terraform Cloud ou OpenTofu

CI/CD e Platform Engineering
GitHub Actions

ArgoCD

GitOps

Self-service

Golden Paths

Developer Portals

Automação
Go

Python

Bash

Networking
TCP/IP

DNS

HTTP/HTTPS

TLS

Routing

NAT

VPN

Firewalls

Load Balancers

Ingress Controllers

CDN

Segurança
IAM / RBAC

Least Privilege

Zero Trust

Secret Manager

AWS Secrets Manager

Azure Key Vault

Vault

External Secrets Operator

Diferenciais
Experiência prática em mais de um provedor de cloud.

Vivência em ambientes multi-cloud ou hybrid cloud.

Experiência com arquiteturas multi-região e Disaster Recovery.

Conhecimento de AWS EKS, RDS/Aurora e multi-account.

Conhecimento de Azure AKS e Landing Zones.

Experiência com Service Mesh, como Istio, Linkerd ou Anthos Service Mesh.

Experiência com API Gateway e gerenciamento de APIs.

Conhecimento de Chaos Engineering.

Conhecimento de FinOps.

Experiência com Platform Engineering.

Benefícios

Contratação PJ

Modelo de trabalho remoto

Wellhub

Seguro de Vida

Это сохранённая копия объявления, опубликованного в другом месте. Вакансии снимают без предупреждения — перед откликом проверьте сайт работодателя. mentors.coach не является нанимающей стороной.

SRE

Analista de Infraestrutura Pleno (Kubernetes / DevOps)

Banco Daycoval

Sao Paulo

Откликнуться на сайте работодателя

Описание вакансии

Buscamos um(a)
Analista de Infraestrutura Pleno
para integrar nosso time de
Infraestrutura de Servidores
, atuando na sustentação de ambientes críticos baseados em
Kubernetes
.

O profissional fará parte da equipe responsável pelo atendimento
N1 e N2 da plataforma de microsserviços
, trabalhando em conjunto com especialistas de nível
N3
na sustentação, evolução e melhoria contínua do ambiente.

Mais do que administrar servidores, buscamos um profissional com conhecimento consistente em
Kubernetes, containers e práticas do ecossistema DevOps
, que tenha capacidade de atuar na resolução de problemas, contribuir tecnicamente com o time e compartilhar boas práticas e conhecimentos.

Responsabilidades e atribuições

  • Atuar na sustentação operacional de ambientes Kubernetes;
  • Administrar ambientes Linux voltados para workloads containerizados;
  • Realizar troubleshooting e análise de incidentes em ambientes de produção;
  • Atuar no atendimento de incidentes relacionados a containers, pods, serviços e redes;
  • Executar atividades de operação e administração utilizando kubectl;
  • Apoiar processos de deploy e administração de aplicações;
  • Monitorar a saúde do cluster e de seus componentes críticos;
  • Identificar e atuar na resolução de problemas relacionados à infraestrutura e à plataforma;
  • Trabalhar em conjunto com as equipes de Infraestrutura, Desenvolvimento e especialistas N3;
  • Apoiar iniciativas de melhoria e evolução da arquitetura da plataforma;
  • Contribuir para a estabilidade, disponibilidade e performance dos ambientes;
  • Compartilhar conhecimento técnico e disseminar boas práticas entre os integrantes da equipe.

Requisitos e qualificações
Requisitos obrigatórios:

  • Experiência em Infraestrutura de TI e Linux;
  • Experiência prática com Kubernetes e Docker;
  • Conhecimento de redes TCP/IP;
  • Experiência com troubleshooting e ambientes produtivos;
  • Conhecimento de monitoramento, logs e sustentação de ambientes críticos;
  • Disponibilidade para atuação presencial na Avenida Paulista, das 13h às 22h.

Conhecimentos desejáveis:

  • Kubernetes
  • Docker
  • Linux
  • Cilium
  • Helm
  • Redes TCP/IP
  • Git
  • CI/CD

Informações adicionais
Benefícios que Valorizam Você:

  • Assistência Médica e Odontológica: Cobertura completa para cuidados médicos e odontológicos de qualidade.
  • Vale-Refeição/Alimentação
  • Seguro de Vida
  • Auxílio-Creche: Apoio financeiro para conciliar trabalho e responsabilidades familiares.
  • Licença maternidade e paternidade estendida (reforçando nosso compromisso com a promoção de um ambiente de trabalho saudável)
  • Participação nos Lucros ou Resultados (PLR): Reconhecimento financeiro pelo seu empenho e contribuição para o sucesso da empresa.
  • Programa de Participação de Resultados: Incentivo contínuo para o alcance de metas individuais e coletivas.
  • Apoio à Educação: Suporte para desenvolvimento acadêmico e profissional, investindo no seu desenvolvimento.
  • Parcerias com Desconto: Vantagens exclusivas em uma variedade de produtos e serviços por meio de parcerias estratégicas.
  • Dia Livre: Flexibilidade com um dia livre para recarregar energias e equilibrar responsabilidades.
  • Totalpass - Incentivo à Saúde: Acesso a uma ampla rede de atividades físicas, promovendo um estilo de vida ativo e saudável.
  • Ginastica Laboral: Promovendo bem-estar e motivação aos nossos colaboradores

Informações adicionais:
Oferecemos um ambiente dinâmico e cheio de oportunidades, onde todos estão imbuídos de fazer diferença nas vidas de nossos clientes. Conscientes do desafiador cenário do mercado financeiro, gostamos da intensidade que ele oferece. Vivemos um momento de transformação ativa, especialmente com a crescente influência do mundo digital em nosso setor. Estamos cheios de desafios, e convidamos você a fazer parte dessa jornada de sucesso, onde #vemserDaycoval é mais do que um convite, é um chamado para fazer história.

Это сохранённая копия объявления, опубликованного в другом месте. Вакансии снимают без предупреждения — перед откликом проверьте сайт работодателя. mentors.coach не является нанимающей стороной.

SRE

ANALISTA CLOUD OPS SÊNIOR

Proative Soluções em Tecnologia da Informação Ltda

Barueri

Откликнуться на сайте работодателя

Описание вакансии

A Proative Technology é especialista em serviços gerenciados de TI e acredita que pessoas incríveis constroem empresas extraordinárias. Somos reconhecidos como Great Place to Work pelo segundo ano consecutivo, reforçando nosso compromisso com um ambiente inclusivo, colaborativo e orientado ao desenvolvimento.

Se você busca um ambiente onde possa atuar com tecnologia de ponta, ambientes críticos, Cloud Computing e desafios que exigem alto nível de conhecimento técnico, a Proative é o lugar certo para você.

Estamos em busca de uma pessoa para atuar como Analista Cloud Ops Sênior, com foco na sustentação, confiabilidade e evolução de ambientes cloud críticos. Essa posição é ideal para profissionais que desejam atuar como referência técnica, contribuindo para a estabilidade dos serviços, resolução de incidentes complexos e evolução contínua da operação.

Responsabilidades

  • Liderar o diagnóstico e a resolução de incidentes críticos e de alta complexidade em ambientes cloud;
  • Conduzir análises de causa raiz (RCA) e apoiar iniciativas de Problem Management;
  • Definir e acompanhar planos de ação corretivos e preventivos para eliminação de recorrências;
  • Projetar e implementar automações e melhorias de arquitetura que aumentem a confiabilidade e eficiência operacional;
  • Atuar como referência técnica para os times de operação, apoiando e desenvolvendo analistas de diferentes níveis;
  • Revisar e evoluir runbooks, procedimentos e boas práticas operacionais;
  • Participar de processos de Change Management, garantindo governança e redução de riscos;
  • Interagir com times de engenharia, cloud, infraestrutura e fornecedores para garantir a continuidade dos serviços;
  • Apoiar iniciativas de melhoria contínua relacionadas à observabilidade, automação e performance;
  • Garantir o cumprimento de SLAs e a qualidade operacional dos ambientes.

Qualificações Necessárias

  • Ensino Superior completo em Tecnologia da Informação, Engenharia ou áreas correlatas;
  • Experiência sólida em operações e sustentação Cloud, atuando em ambientes produtivos;
  • Experiência na resolução de incidentes de alta complexidade e gestão de problemas;
  • Capacidade de atuar como referência técnica e apoiar times de operação;
  • Boa comunicação e capacidade de interação com áreas técnicas e stakeholders.

Conhecimentos Técnicos

  • Experiência em ambientes AWS, Azure ou GCP;
  • Conhecimento avançado em: Compute, Storage, Banco de Dados, Logging/Monitoring, Redes e Segurança.
  • Sistemas Operacionais Linux e Windows;
  • Automação e Infraestrutura como Código (Terraform, Ansible ou similares);
  • Linguagens de script (Python, Shell ou similares);
  • Ferramentas de observabilidade e monitoramento;
  • Conceitos de SRE, observabilidade, troubleshooting e gestão de incidentes;
  • Processos ITSM (Incidente, Problema e Mudança).

Desejável

  • Certificações Cloud (AWS, Azure ou GCP);
  • Conhecimento em Kubernetes e containers;
  • Experiência com pipelines CI/CD;
  • Conhecimento em observabilidade avançada e práticas de SRE;
  • Vivência com ambientes multi-cloud;

Это сохранённая копия объявления, опубликованного в другом месте. Вакансии снимают без предупреждения — перед откликом проверьте сайт работодателя. mentors.coach не является нанимающей стороной.

Ещё 17 вакансий по этой категории в этой стране

8092 - Analista SRE SêniorB3 · Brazil

Откликнуться на сайте работодателя