DevOps Engineer
Software Engineering
São Paulo, SP, Brazil
Sobre a Empresa
A Hero Seguros é uma insurtech em crescimento, referência em Seguro Viagem e em expansão na América Latina. Nossa plataforma possui aplicações críticas para cotação, emissão, pagamento, integrações com parceiros, APIs, whitelabels e rotinas de processamento. Trabalhamos principalmente com aplicações PHP/Laravel, microsserviços, bancos de dados relacionais, filas, containers e serviços gerenciados da AWS.
Sobre a Função
Buscamos uma pessoa DevOps Engineer Sênior, com perfil técnico e operacional, para manter o ambiente atual, aumentar sua segurança, melhorar a observabilidade e conduzir nossa evolução de ECS para Kubernetes. Esta não é uma posição exclusivamente estratégica ou de arquitetura. Precisamos de alguém que consiga investigar incidentes, acessar logs, analisar rede, revisar pipelines, corrigir configurações, automatizar atividades e executar mudanças com segurança.
Responsabilidades
- AWS e infraestrutura
- Administrar e evoluir ambientes de desenvolvimento, homologação e produção na AWS.
- Criar e manter recursos como ECS, EKS, EC2, RDS, ElastiCache, Load Balancers, S3, ECR, Lambda, SQS, SNS, Route 53 e CloudWatch.
- Analisar consumo de CPU, memória, disco, rede, conexões, filas, banco de dados e containers.
- Identificar gargalos, indisponibilidades, configurações incorretas e recursos subdimensionados ou superdimensionados.
- Participar de decisões de arquitetura considerando disponibilidade, segurança, custo e capacidade operacional.
- Criar estratégias de backup, restore, failover e recuperação de desastre.
- Realizar testes de restauração e apoiar a definição de RTO e RPO.
- Atuar na análise e redução de custos da infraestrutura AWS.
- Containers, ECS e Kubernetes
- Manter aplicações containerizadas executadas em Amazon ECS e AWS Fargate.
- Criar e revisar Dockerfiles, imagens, configurações de containers e políticas de publicação no ECR.
- Conduzir a migração gradual de aplicações e serviços para Kubernetes e Amazon EKS.
- Criar e manter Deployments, Services, ConfigMaps, Secrets, Jobs, CronJobs, Ingresses, Health Checks e políticas de autoscaling.
- Trabalhar com Helm para empacotamento e implantação de aplicações.
- Configurar requests, limits, readiness probes, liveness probes e estratégias de rollout.
- Investigar problemas como pods reiniciando, falta de memória, falhas de DNS, indisponibilidade de serviços, erros de rede e problemas de comunicação com bancos ou filas.
- Apoiar a definição de estratégia de rollback, rolling update e blue-green deployment.
- Estruturar boas práticas para isolamento entre ambientes e aplicações.
- CI/CD e automação
- Manter e evoluir pipelines utilizando AWS CodePipeline, CodeBuild e ferramentas relacionadas.
- Automatizar build, testes, criação de imagens, publicação no ECR e deploy.
- Implementar validações para impedir que imagens ou configurações inseguras sejam promovidas para produção.
- Criar scripts de automação utilizando Bash, Shell Script ou Python.
- Reduzir atividades manuais e repetitivas do processo de deploy e operação.
- Implementar ou evoluir infraestrutura como código utilizando Terraform.
- Criar módulos reutilizáveis e separar adequadamente os estados e ambientes do Terraform.
- Garantir que mudanças de infraestrutura sejam revisáveis, rastreáveis e reproduzíveis.
- PHP, Laravel e operação das aplicações
- Não é necessário atuar como desenvolvedor PHP, mas é obrigatório compreender como aplicações PHP/Laravel funcionam em produção.
- O profissional deverá conseguir:
- Administrar containers e servidores com PHP-FPM e Nginx.
- Analisar logs e erros de aplicações Laravel.
- Entender variáveis de ambiente e arquivos de configuração.
- Apoiar a configuração de workers, filas, schedulers e comandos Artisan.
- Investigar problemas relacionados a cache, sessões, filas e conexão com banco.
- Compreender o funcionamento de Composer e dependências PHP.
- Apoiar deploys que envolvam migrations de banco de dados.
- Identificar problemas de permissão, timeout, memória, disco, processos e configuração do PHP.
- Trabalhar em conjunto com os desenvolvedores para localizar se a origem de um incidente está na aplicação, infraestrutura, rede, banco ou integração externa.
- Bancos de dados, filas e cache
- Administrar e monitorar bancos de dados executados em Amazon RDS.
- Investigar consumo de CPU, memória, storage, conexões, locks, queries lentas e problemas de replicação.
- Apoiar ajustes de parâmetros e dimensionamento de instâncias.
- Acompanhar backups, snapshots, restores e failover.
- Trabalhar com bancos MySQL e PostgreSQL.
- Administrar e monitorar Redis por meio do Amazon ElastiCache.
- Investigar filas paradas, aumento de mensagens, falhas de consumidores e mensagens em Dead Letter Queue.
- Trabalhar com Amazon SQS, SNS e integrações assíncronas.
- Apoiar operações envolvendo DocumentDB e processos de migração de dados quando necessário.
- Executar mudanças de banco com atenção a indisponibilidade, lock e impacto em produção.
- Redes e conectividade
- Administrar VPCs, subnets públicas e privadas, tabelas de rotas, Internet Gateway e NAT Gateway.
- Configurar e revisar Security Groups e Network ACLs.
- Implementar restrições e liberações de acesso por IP.
- Configurar acessos por VPN e redes privadas.