Cosourcing | Pessoa SRE Sênior (GCP)
Job Summary
Na Viaflow conectamos talentos de elite a projetos que transformam o mercado. Estamos em busca de uma Pessoa Site Reliability Engineer (SRE) GCP Platform de altíssimo nível para atuar em um cliente global com foco em aumentar a confiabilidade escalabilidade e resiliência de plataformas digitais e infraestrutura em nuvem.
Se você tem domínio em GCP Terraform Kubernetes automação e práticas de SRE com paixão por eliminar tarefas manuais e garantir a alta disponibilidade de sistemas distribuídos #VemPraViaflow!
Se identificou Então vem com a gente!
Responsibilities
- Automação e Redução de Toil: Projetar construir e manter ferramentas de automação e Infraestrutura como Código (IaC) para eliminar tarefas operacionais manuais e otimizar fluxos de implantação.
- Gestão de Nível de Serviço: Colaborar com times de produto e desenvolvimento para definir monitorar e aplicar Indicadores de Nível de Serviço (SLIs) e Objetivos de Nível de Serviço (SLOs) para serviços críticos.
- Observabilidade e Monitoramento: Projetar e implementar sistemas robustos de monitoramento alertas e logging para garantir visibilidade profunda sobre a saúde das aplicações e da infraestrutura.
- Gestão de Incidentes e Post-Mortems: Participar de escala de sobreaviso (on-call) fornecendo suporte operacional; liderar e participar de post-mortems sem atribuição de culpa (blameless post-mortems) para identificar causas-raiz e implementar medidas preventivas.
- Arquitetura em Nuvem e Escalabilidade: Otimizar a infraestrutura GCP em termos de performance custo e escalabilidade gerenciando configurações de balanceamento de carga roteamento de tráfego e auto-scaling.
- Engenharia de Pipelines CI/CD: Suportar e aprimorar pipelines de integração e entrega contínuas (CI/CD) para garantir lançamentos de software seguros previsíveis e frequentes.
- Recuperação de Desastres e Resiliência: Planejar implementar e testar estratégias de recuperação de desastres (DR) failover e backups para garantir a continuidade dos negócios.
- Colaboração e Code Review: Revisar arquitetura de aplicações e código para garantir adesão aos padrões de prontidão para produção melhores práticas de segurança e diretrizes de escalabilidade.
Prerequisites
- Sólida Experiência em funções de SRE DevOps ou Engenharia de Sistemas em Nuvem (ou formação/experiência equivalente).
- Plataforma Cloud (GCP): Experiência prática na implantação e gerenciamento de workloads na Google Cloud Platform (GCP) incluindo serviços como GKE (Google Kubernetes Engine) Compute Engine Cloud Run Cloud Functions e BigQuery.
- Containers e Orquestração: Domínio na gestão implantação e solução de problemas com Docker e Kubernetes.
- Infraestrutura como Código (IaC): Experiência prática com ferramentas como Terraform para provisionamento e gestão de infraestrutura em nuvem.
- Sistemas Linux/Unix: Conhecimento profundo em administração de Linux/Unix protocolos de rede (TCP/IP DNS HTTP/S) e funcionamento interno do sistema.
- Programação e Scripting: Proficiência em pelo menos uma linguagem voltada para automação (ex: Python Go ou Bash).
- Stack de Observabilidade: Experiência com GCP Cloud Monitoring/Logging (Stackdriver) ou ferramentas open-source correlatas (Prometheus Grafana ELK stack).
- Ferramentas de CI/CD: Vivência com pipelines modernos e controle de versão (ex: GitHub Actions GitLab CI Jenkins ou Google Cloud Build).
- Certificação Google Cloud Certified Professional Cloud DevOps Engineer ou Professional Site Reliability Engineer.
- Certificação Certified Kubernetes Administrator (CKA).
- Vivência sólida em arquiteturas de sistemas distribuídos de grande escala e tolerantes a falhas.
- Excelente capacidade analítica e de solução de problemas complexos sob pressão.
- Forte orientação à cultura SRE com foco em correções sistêmicas (blameless culture).
- Domínio de fluxos modernos de Gestão de Mudanças e GitOps.
- Ótima comunicação interpessoal e colaboração com desenvolvedores produtos segurança e stakeholders.
Idioma: Inglês Avançado/Fluente para comunicação com time internacional.
Experiences
- Contratação via modelo cooperativa
- Auxílio Híbrido
- People Hub - Clube de Benefícios
- DIT - Diária de Incapacidade Temporária
- Day off de aniversário - afinal é dia de festa!
- TotalPass
- Treinamentos e Certificações
- Clube do iFood gratuito
- Pacote Colab com acesso a WellHub Avus e Starbem
- Atuação híbrida (3x por semana na região da Av. Paulista)
About Company
Consultoria e tecnologia com mindset de inovação! Olá! Que bom ter você por aqui 💙 Na Viaflow, acreditamos que transformar negócios é mais do que implementar tecnologia — é criar experiências, gerar valor e construir o futuro com propósito. Somos uma empresa de consultoria e tecnologi ... View more