Introduction
A career in IBM Consulting is built on long-term client relationships and close collaboration worldwide. You’ll work with leading companies across industries, helping them shape their hybrid cloud and AI journeys. With support from our strategic partners, robust IBM technology, and Red Hat, you’ll have the tools to drive meaningful change and accelerate client impact. At IBM Consulting, curiosity fuels success. You’ll be encouraged to challenge the norm, explore new ideas, and create innovative solutions that deliver real results. Our culture of growth and empathy focuses on your long-term career development while valuing your unique skills and experiences.
Your role and responsibilities
Atuação Consultiva e Parceria: atuar como consultor interno para os times de desenvolvimento, influenciando decisões de arquitetura de software e promovendo a cultura de confiabilidade.
Evangelização do Build to Manage: capacitar e mentorar as equipes para que novos recursos e serviços já nasçam com capacidades nativas de gerenciamento, resiliência e suporte em produção.
Garantia de Confiabilidade: garantir alta disponibilidade, confiabilidade e desempenho dos sistemas por meio de práticas de Engenharia de Confiabilidade de Sites (SRE).
Automação e Healing via Software: desenvolver automações e microsserviços/operadores customizados para tarefas repetitivas, reduzindo esforço manual e riscos operacionais.
Desenvolvimento de Plataforma: escrever, testar e manter softwares e CLIs internas para automatizar o ciclo de vida das aplicações e melhorar a experiência de outras equipes de engenharia.
Observabilidade e Instrumentação: orientar os times a instrumentar as aplicações (ex.: OpenTelemetry) para coleta de métricas, traces e logs estruturados.
Gestão de Engenharia de Resiliência: facilitar workshops de definição de SLIs, SLOs e SLAs com stakeholders de tecnologia e negócios, além de liderar estratégias de chaos engineering e testes de carga.
Gestão de Incidentes Consultiva: liderar a análise de causa raiz (RCA) após incidentes críticos e criar práticas voltadas à construção de postmortems.
Required technical and professional expertise
*
Perfil Consultivo e Mentoria: Capacidade comprovada de atuar como facilitador, liderar discussões técnicas, traduzir conceitos complexos e treinar times de engenharia.
*
Experiência com Desenvolvimento de Software: Sólido conhecimento e proficiência prática em linguagens de programação backend (como Go, Python, Java, C# ou Rust), com capacidade de ler, debugar e corrigir bugs diretamente no repositório da aplicação.
*
Práticas Build to Manage e Observabilidade: Experiência prática na criação de códigos "gerenciáveis" (logs estruturados, tratamento de exceções e pontos de checagem de saúde da aplicação - Health, Readiness e Liveness probes).
*
Práticas de SRE: Vivência na definição e integração de SLIs, SLOs e SLAs aos sistemas distribuídos.
*
Arquiteturas Escaláveis: Sólido conhecimento em design e implementação de arquiteturas de microsserviços resilientes e escaláveis.
*
Kubernetes e Contêineres: Experiência prática com Kubernetes e gestão de clusters em ambientes de produção.
*
Excelente comunicação verbal e escrita para interagir com times multidisciplinares e stakeholders.
*
Alta capacidade de priorizar demandas em ambientes dinâmicos de ritmo acelerado.
*
Formação superior completa.
Preferred technical and professional experience
- Experiência em consultoria técnica: desejável passagem prévia por consultorias de tecnologia ou atuação como Technical Product Manager, Solutions Architect ou Developer Advocate.
- Instrumentação Avançada (Build to Manage): desejável conhecimento em exposição de métricas customizadas de negócio e performance diretamente na camada de código da aplicação (ex.: Prometheus de forma nativa ou SDKs de OpenTelemetry).
- Histórico no Desenvolvimento: desejável experiência prévia consolidada como Engenheiro(a) de Software Backend antes da transição para a cultura de SRE.
- Padrões de Resiliência no Código: desejável conhecimento prático na implementação de design patterns de resiliência diretamente na aplicação (como Circuit Breaker, Bulkhead, Retry Policies e Rate Limiting).
- Engenharia do Caos Avançada: desejável conhecimento avançado em práticas de chaos engineering e ferramentas de testes de resiliência destrutivos.
IBM is committed to creating a diverse environment and is proud to be an equal-opportunity employer. All qualified applicants will receive consideration for employment without regard to race, color, religion, sex, gender, gender identity or expression, sexual orientation, national origin, caste, genetics, pregnancy, disability, neurodivergence, age, veteran status, or other characteristics. IBM is also committed to compliance with all fair employment practices regarding citizenship and immigration status.