openqareer

Cloud Engineer / Site Reliability Engineer (SRE) – Pleno

groove tech · São Paulo, SP

# Cloud Engineer / Site Reliability Engineer (SRE) – Pleno **groove tech** · São Paulo, SP · `On-site` 🕒 **Статус:** *Опубликовано: 4 дня назад* · *Источник: Indeed* --- ### About the Role Na GrooveTech, conectamos talentos de alta performance a desafios de tecnologia que transformam negócios. Buscamos um(a) Cloud Engineer / SRE Pleno com perfil hands-on para atuar na sustentação, resiliência e escalabilidade de uma plataforma crítica em um projeto estratégico. O ambiente é 100% Google Cloud Platform (GCP), tendo Kubernetes (GKE) como núcleo da arquitetura. Suas Principais Responsabilidades Infraestrutura Cloud & GKE: Sustentar e evoluir o ambiente GCP (GKE, Compute Engine, Cloud SQL, Storage, VPC, Load Balancers, Pub/Sub, BigQuery). Cultura e Práticas de SRE: Aplicar conceitos de SLIs, SLOs e Error Budgets, garantindo alta disponibilidade e estratégias de autoscaling. Observabilidade: Evoluir a stack de monitoramento (New Relic, OpenTelemetry, Prometheus, Grafana e Cloud Monitoring), criando dashboards e alertas acionáveis. IaC, CI/CD e GitOps: Construir infraestrutura como código via Terraform e apoiar esteiras de deploy com GitHub Actions e ArgoCD. Automação & Scripting: Desenvolver automações para rotinas operacionais utilizando Go, Python e/ou Bash. Gestão de Incidentes: Atuar no troubleshooting de produção (Linux, Redes, Kubernetes) e conduzir análises de causa-raiz (postmortems blameless). Segurança & FinOps: Aplicar políticas de governança (IAM/RBAC, Secret Manager) e iniciativas de otimização de custos de nuvem Requisitos: 3+ anos de experiência em infraestrutura de produção em Nuvem. Vivência sólida e prática em Google Cloud Platform (GCP) e Kubernetes em produção (GKE). Domínio de Terraform (criação e manutenção de módulos, gerenciamento de estado). Experiência com automação de pipelines de CI/CD (GitHub Actions) e práticas de GitOps (ArgoCD). Domínio de scripting em Go, Python e/ou Bash. Sólidos conhecimentos em troubleshooting de redes (TCP/IP, DNS, HTTP/HTTPS, TLS), Linux e Load Balancers. Diferenciais Técnicos (Nice to Have) Experiência com FinOps, estratégias de Disaster Recovery ou Service Mesh (Istio, Linkerd). Vivência na construção de portais de desenvolvedor ou esteiras self-service (Platform Engineering). Certificações GCP (ex: Professional Cloud Architect/DevOps) ou Kubernetes (CKA/CKAD). Habilidades Comportamentais (Soft Skills) Resiliência e Adaptabilidade: Energia para lidar com ambiguidades e transformar aprendizados vindos de incidentes em melhorias. Comunicação Clara e Colaboração: Facilidade para articular ideias técnicas com clareza e trabalhar em parceria com Engenharia e Produto. Visão Sistêmica e Orientação a Resultados: Capacidade analítica para tomar decisões pautadas em dados, focando no impacto para o negócio. Protagonismo: Postura proativa para assumir frentes do início ao fim com senso de dono Benefícios Modelo de Contratação: PJ Formato de Trabalho: Remoto (Com idas presenciais esporádicas em SP) Saúde e Bem-Estar: Acesso ao pacote Wellhub (Gympass). Segurança: Seguro de Vida corporativo incluso.

Наблюдалась 2026-10-07, впервые 2026-10-02, источник — Indeed.

Открыть у работодателя