
Engenheiro(a) Sênior Principal de Software - Infra TI
Engenheiro(a) Sênior Principal de Software - Infra TI
Esta não é uma função tradicional focada em ferramentas de infraestrutura ou desenvolvimento de scripts. Não estamos procurando alguém para criar scripts pontuais, administrar um servidor Jenkins ou desenvolver dashboards. Se sua função atual consiste principalmente em integrar ferramentas de diferentes fornecedores e criar scripts de apoio para conectá-las, esta posição provavelmente não é a mais adequada para você.
Estamos construindo uma plataforma corporativa compartilhada de automação que sustenta as operações de infraestrutura nos domínios de Computação, Rede e Storage. Nessa plataforma, toda ação operacional é executada por meio de pipelines, toda resposta a incidentes tem início com um agente automatizado e cada evento resolvido alimenta uma base de conhecimento que torna as respostas futuras mais rápidas e eficientes. Sua responsabilidade será projetar, desenvolver e liderar a evolução dessa plataforma. Procuramos um(a) engenheiro(a) de software que desenvolva soluções para equipes de infraestrutura, e não um(a) profissional de infraestrutura que eventualmente programe.
Junte-se a nós como Engenheiro(a) Sênior Principal de Software - Infra TI em nossa equipe de Engenharia de Infraestrutura para fazer o melhor trabalho da sua carreira e gerar um impacto social profundo na nossa equipe em Eldorado do Sul - RS.
O que você conquistará
Como Engenheiro(a) Sênior Principal de Software - Infra TI, você será responsável por projetar, desenvolver e administrar a plataforma compartilhada de automação que suporta as operações de infraestrutura nos domínios de Computação, Rede e Storage. Você atuará na construção de capacidades escaláveis de automação, fluxos de remediação orientados por eventos, integrações corporativas e soluções operacionais assistidas por inteligência artificial, promovendo confiabilidade, eficiência operacional e aumento das taxas de resolução autônoma em ambientes corporativos de grande porte.
Qualifications
Dê o primeiro passo para a carreira dos seus sonhos
Todas as pessoas da nossa equipe agregam algo único. Veja o que estamos buscando para esta posição
Requisitos Essenciais:
- Ensino superior completo em Ciência da Computação, Tecnologia da Informação, Engenharia ou áreas correlatas, com experiência em Automação de Infraestrutura, Engenharia de Plataforma, DevOps, Site Reliability Engineering (SRE) ou desenvolvimento de ferramentas corporativas em larga escala.
- Mínimo de 5 anos de experiência em automação de infraestrutura, engenharia de plataformas ou desenvolvimento de soluções DevOps/SRE em ambientes corporativos de grande porte bem como experiência avançada com Ansible em larga escala, incluindo módulos personalizados, inventários dinâmicos, frameworks de execução, componentes reutilizáveis e arquiteturas baseadas em roles para ambientes multidomínio. Experiência na concepção e implementação de capacidades de CI/CD utilizando GitLab CI ou tecnologias equivalentes, incluindo templates de pipelines, runners compartilhados, modelos self-service e fluxos corporativos de execução.
- Experiência na integração de plataformas de infraestrutura por meio de APIs, contemplando pelo menos dois dos seguintes domínios: virtualização, gerenciamento de servidores, infraestrutura de rede ou plataformas corporativas de storage. Experiência comprovada com fluxos de desenvolvimento baseados em Git, práticas de infraestrutura como código e implementação prática de GitOps.
- Forte conhecimento em engenharia de software utilizando Python, com experiência no desenvolvimento de aplicações de nível produtivo, tratamento de erros, testes, documentação e práticas de sustentação operacional e capacidade comprovada para diagnosticar e resolver falhas complexas de automação que impactem múltiplas camadas da infraestrutura por meio da análise de logs estruturados, telemetria, rastreamento de pipelines e dados operacionais assim como forte capacidade de análise de incidentes, troubleshooting e gerenciamento de problemas, incluindo identificação de causa raiz, aprimoramento de controles de segurança, otimização de automações e evolução dos mecanismos de resolução autônoma.
- Inglês avançado ou fluente, com capacidade de colaborar efetivamente com equipes globais.
Requisitos Desejáveis
- Experiência com arquiteturas de automação orientadas por eventos integrando plataformas de monitoramento, observabilidade ou AIOps a fluxos automatizados de remediação, tecnologias de LLM, plataformas de IA agentic ou automação operacional assistida por inteligência artificial, ServiceNow CMDB e NetBox como fontes oficiais para inventário e automação de infraestrutura, Moogsoft ou plataformas similares de correlação de eventos e AIOps e experiência na construção de plataformas internas para equipes de engenharia, portais de automação self-service, API gateways, plataformas para desenvolvedores ou soluções similares.
- Experiência com soluções de roteamento e transformação de telemetria, como Cribl, Kafka ou tecnologias equivalentes, experiencia de integração com plataformas de observabilidade e monitoramento como Zabbix, vROps, Dynatrace ou ferramentas corporativas equivalentes bem como familiaridade com ambientes regulados por requisitos de conformidade como SOX, PCI-DSS e ISO 27001, incluindo geração automatizada de evidências para auditoria.
Responsibilities
Você irá:
- Projetar, desenvolver e manter a plataforma corporativa de automação utilizada pelas equipes de SRE de Infraestrutura, incluindo frameworks Ansible, inventários dinâmicos, templates GitLab CI/CD, integrações por API e automações reutilizáveis para provisionamento, gerenciamento de firmware, correção de desvios de configuração, capacidade e remediação de incidentes; desenvolver frameworks de automação orientados por eventos integrando plataformas de monitoramento e AIOps a fluxos automatizados de diagnóstico e remediação, garantindo segurança, concorrência controlada, rollback, resiliência e confiabilidade.
- Desenvolver e evoluir recursos corporativos de IA agentic, incluindo agentes baseados em LLM para consumo de telemetria, correlação de eventos, execução de runbooks, resolução autônoma de incidentes e escalonamento quando necessário; construir e manter uma base de conhecimento estruturada para suporte à tomada de decisão humana e recuperação por agentes de IA.
- Gerenciar a integração da plataforma de automação com sistemas corporativos, incluindo ServiceNow CMDB, NetBox, ServiceNow ITSM, Jira, Archer e plataformas de infraestrutura de Computação, Rede e Storage; atuar em parceria com equipes de Observabilidade para garantir o consumo eficiente de telemetria e desenvolver contratos de APIs, SDKs e frameworks de onboarding para integração das automações de domínio à plataforma compartilhada.
- Definir e operar práticas de SRE para a plataforma de automação por meio da gestão de SLIs, SLOs, error budgets, observabilidade, monitoramento, desempenho, auto-recuperação e análise de incidentes; conduzir postmortems sem atribuição de culpa, produzir análises estruturadas de causa raiz e desenvolver capacidades compartilhadas para automação de processos e resolução de falhas recorrentes entre múltiplos domínios de infraestrutura.
Colaborar com equipes de SRE, Engenharia de Infraestrutura e GRC para integrar automações, definir contratos, requisitos de testes, controles de segurança, políticas como código e evidências de conformidade para SOX, PCI-DSS e ISO 27001; liderar iniciativas de melhoria contínua por meio da evolução da cobertura de automação, resolução autônoma, eficiência operacional e adoção da plataforma, além de participar da escala de plantão responsável pela disponibilidade e confiabilidade dos serviços compartilhados.
We believe that each of us has the power to make an impact. That’s why we put our team members at the center of everything we do. If you’re looking for an opportunity to grow your career with some of the best minds and most advanced tech in the industry, we’re looking for you.
Dell Technologies is a unique family of businesses that helps individuals and organizations transform how they work, live and play. Join us to build a future that works for everyone because Progress Takes All of Us.
Dell Technologies is committed to the principle of equal employment opportunity for all employees and to providing employees with a work environment free of discrimination and harassment. Read the full Equal Employment Opportunity Policy.
Visit our Culture Code page to learn more about how we work and lead.
