[Job-32080] Senior SRE / Cloud Engineer (Pessoa Engenheira de Plataforma), Brazil
CI&T Brazil
IT Services and IT Consulting · 5,001-10,000 employees
About the role
Design and maintain critical infrastructure for AI agent operations on Oracle Cloud Infrastructure. Manage OKE clusters, ensure high availability, and optimize costs through FinOps practices.
What they look for
Requirements
Requires extensive experience with Oracle Cloud Infrastructure, Kubernetes, and Terraform. Proficiency in networking, observability tools, and SRE practices is essential for this role.
Benefits
Full description
Na CI&T , ajudamos grandes empresas a transformar o potencial da AI em impacto real nos negócios com AI Deployment, execução AI-native e tech-integrated business solutions.
Com 30 anos de experiência em transformação tecnológica, aceleramos inovação com expertise em agentic SDLC, application modernization, Data & AI, martech e business strategy.
Somos 8.000 CI&Ters em mais de 25 países, colaborando para construir soluções com impacto real. AI já faz parte da forma como trabalhamos, evoluímos e inovamos todos os dias.
Importante: se você reside na Região Metropolitana de Campinas, sua presença nos escritórios da cidade será obrigatória, conforme a política de frequencia vigente.
A CI&T busca uma pessoa Engenheira de Plataforma Sênior para projetar e manter a infraestrutura crítica que suporta a operação de agentes de IA em Oracle Cloud Infrastructure (OCI), garantindo disponibilidade de 99,95% e latências de resposta rigorosas.
Responsabilidades:
- Provisionar recursos OCI via Terraform, garantindo infraestrutura como código robusta e auditável.
- Gerenciar clusters OKE com node pools de GPU para inferência, assegurando performance e disponibilidade.
- Configurar autoscaling (HPA) baseado em latência e carga dos agentes de IA.
- Garantir segurança de rede em VCNs privadas, incluindo configuração de NSGs e Service Gateways.
- Gerenciar segredos no OCI Vault, mantendo conformidade e proteção de credenciais.
- Monitorar proativamente a plataforma através do OCI Observability (Monitoring, Logging, APM).
- Atuar em FinOps para controle e otimização de custos de GPU e tokens de IA generativa.
Requisitos para este desafio:
- Experiência com Oracle Cloud Infrastructure (OCI).
- Conhecimento em Kubernetes (OKE) e GPU Node Pools.
- Proficiência em Terraform para infraestrutura como código.
- Conhecimento em redes: VCN, NSG e Service Gateway.
- Experiência com ferramentas de observabilidade (OCI Monitoring/APM).
[Opcional] Diferenciais:
- Experiência com FinOps para IA Generativa.
- Conhecimento em Service Mesh (mTLS interno).
- Familiaridade com OCI Streaming (Kafka API).
- Experiência com gestão de GPU Runtimes (vLLM/Triton).
- Conhecimento em práticas de SRE e definição de SLOs.
#LI-DJ1 #LI-midsenior
\n
\nNossos benefícios:
- Plano de saúde e odontológico;
- Vale alimentação e refeição;
- Auxílio-creche;
- Licença parental estendida;
- Parceria com academias e profissionais de saúde e bem-estar via Wellhub (Gympass) TotalPass;
- Participação nos Lucros e Resultados (PLR);
- Seguro de Vida;
- Plataforma de aprendizagem contínua (CI&T University);
- Clube de descontos;
- Plataforma online gratuita dedicada à promoção da saúde física, mental e bem-estar;
- Curso gestante e parentalidade responsável;
- Parceria com plataformas de cursos online;
- Plataforma para aprendizagem de idiomas;
- E muitos outros
Mais detalhes sobre os nossos benefícios aqui: https://ciandt.com/br/pt-br/carreiras
Na CI&T, a inclusão começa no primeiro contato. Se você é pessoa com deficiência, é importante apresentar o seu laudo durante o processo seletivo. Consulte quais dados são necessários conter no laudo clicando aqui. Assim, podemos garantir o suporte e as adaptações que você merece. Se ainda não tem o laudo caracterizador, não se preocupe: podemos te apoiar para obtê-lo.
Temos um time dedicado de Saúde e Bem-estar, especialistas em inclusão e grupos de afinidade que estarão com você em todas as etapas. Conte com a gente para fazer essa jornada lado a lado.
Similar roles
-
Site Reliability Engineer
Aussie Broadband Australia
-
Site Reliability Engineer
Department of Education Sydney, New South Wales, Australia · A$133K–A$147K/yr
-
Site Reliability Engineering Technical Leader
Cisco San Francisco, California, United States · $187K–$268K/yr
-
Site Reliability Engineering Lead
RELX Washington, District of Columbia, United States · $118K–$220K/yr
-
Site Reliability Engineer Intern
CarGurus Early Careers Boston, Massachusetts, United States · $73K/yr
-
Sr. Manager, SRE, Operations & Product Support
American Bureau of Shipping Knoxville, Tennessee, United States