Buscamos uma Pessoa Engenheira de Plataforma de IAde alto nível para construir nossa plataforma de IA corporativa, focada em segurança, governança e escala.
Se você domina a infraestrutura de workloads de IA e aplicações críticas, #VemPraViaflow!
O desafio
Arquitetar a base técnica do projeto, garantindo ambientes escaláveis, seguros e observáveis. Seu foco será unir Kubernetes, automação, segurança proativa e FinOps para sustentar nossos serviços.
✨ Se identificou? Então vem com a gente!
- Projetar, implementar e evoluir ambientes cloud e Kubernetes para execução de aplicações, APIs, agentes, serviços de IA e pipelines de dados.
- Construir e manter pipelines de CI/CD, com foco em segurança, padronização, rastreabilidade e velocidade de entrega.
- Automatizar o provisionamento de infraestrutura com práticas de Infrastructure as Code.
- Implementar padrões de observabilidade, incluindo logs, métricas, tracing, dashboards, alertas e indicadores de saúde da plataforma.
- Apoiar a operação de workloads de IA, incluindo serviços de inferência, embeddings, orquestração de agentes e componentes de integração.
- Garantir boas práticas de segurança, segregação de ambientes, gestão de segredos, controle de acesso e políticas de infraestrutura.
- Trabalhar com performance, disponibilidade, escalabilidade, resiliência e otimização de custos.
- Criar padrões reutilizáveis para ambientes, deploys, monitoramento, segurança e operação.
- Atuar próximo aos times de IA, Dados, Produto, Full Stack e Machine Learning para transformar necessidades técnicas em capacidade de plataforma.
- Experiência prática com cloud, preferencialmente AWS, Azure ou GCP.
- Experiência com Kubernetes, containers, Docker, Helm e serviços gerenciados de cloud.
- Conhecimento em CI/CD, GitHub Actions, GitLab CI, Azure DevOps, Jenkins ou ferramentas equivalentes.
- Experiência com Terraform, Pulumi, CloudFormation ou ferramentas similares de IaC.
- Conhecimento em observabilidade, monitoramento, logging e tracing.
- Boa compreensão de redes, balanceamento de carga, segurança, autenticação, autorização e alta disponibilidade.
- Experiência com ambientes produtivos, incidentes, operação de serviços críticos e melhoria contínua.
- Capacidade de documentar padrões técnicos e apoiar decisões de arquitetura.
Diferenciais
- Experiência com MLOps, LLMOps, plataformas de IA, model serving ou workloads com GPU.
- Familiaridade com vLLM, Triton, NVIDIA NIM, MLflow, Kubeflow, Ray ou ferramentas similares.
- Experiência com API Gateway, service mesh, secrets management e políticas de segurança em cloud.
- Conhecimento em FinOps e otimização de custos de infraestrutura.
- Vivência em ambientes corporativos com requisitos de auditoria, LGPD, RBAC e governança.
Perfil que buscamos
Buscamos uma pessoa técnica, pragmática e confiável. Alguém que entenda que plataforma boa é aquela que reduz fricção, aumenta segurança e permite que o time entregue mais rápido sem perder controle.
Indicadores de sucesso
- Ambientes mais padronizados, seguros e rastreáveis.
- Redução de esforço manual em deploys, provisionamento e operação.
- Melhoria da observabilidade e da confiabilidade da plataforma.
- Base técnica preparada para escalar novos clientes, casos de uso e workloads de IA.
Informações adicionais
-
Contratação: Via modelo cooperativa.
-
Modelo de Trabalho:Anywhere Office - trabalhe de onde se sentir confortável.
-
Tecnologia: Reembolso BYOD para aquisição de máquina e Auxílio BYOD para utilização de máquina própria.
-
Auxílios: Auxílio home office no cartão iFood Benefícios na categoria saldo livre para usar onde quiser.
-
Bem-Estar: TotalPass, Pacote Colab+ com acesso a WellHub, Avus, Starbem e Dasa+ Saúde.
-
Benefícios Adicionais: DIT - Diária de Incapacidade Temporária, People Hub - Clube de Benefícios, Day off de aniversário.
-
Desenvolvimento: Treinamentos e Certificações.
Originally posted on Himalayas