Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) – Storage
🇧🇷 Brazil
Python
Git
Ansible
Machine Learning
Devops
Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) – Storage
from 🇧🇷 Brazil
We believe that each of us has the power to make an impact. That’s why we put our team members at the center of everything we do. If you’re looking for an opportunity to grow your career with some of the best minds and most advanced tech in the industry, we’re looking for you.
Dell Technologies is a unique family of businesses that helps individuals and organizations transform how they work, live and play. Join us to build a future that works for everyone because Progress Takes All of Us.
Dell Technologies is committed to the principle of equal employment opportunity for all employees and to providing employees with a work environment free of discrimination and harassment.Read the full Equal Employment Opportunity Policy.
Visit ourCulture Code page to learn more about how we work and lead.
Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) – Storage
Esta não é uma função tradicional de administração de storage. Não estamos procurando alguém para provisionar LUNs manualmente, responder a alertas de arrays de forma manual ou gerenciar a integridade da replicação acessando consoles de fabricantes. Se essa é a descrição da sua função atual e você deseja continuar trabalhando dessa forma, esta posição provavelmente não é a mais adequada para você.
Estamos construindo um modelo operacional de storage no qual a automação é responsável por todo o ciclo de vida do serviço, incluindo provisionamento, gerenciamento de capacidade, monitoramento da integridade da replicação, atualização de firmware e descomissionamento, tudo executado por meio de pipelines, sem interação direta com os arrays em ambiente de produção. Sua função será projetar, desenvolver e evoluir essa automação. Procuramos um(a) engenheiro(a) com sólida expertise em armazenamento, e não um(a) administrador(a) de storage que eventualmente desenvolve scripts.
Junte-se a nós comoEngenheiro(a) Sênior de Confiabilidade de Sites (SRE) – Storage em nossa equipe deEngenharia de Infraestrutura para fazer o melhor trabalho da sua carreira e gerar um impacto social profundo emEldorado do Sul - RS.
O que você conquistará
ComoEngenheiro(a) Sênior de Confiabilidade de Sites (SRE) – Storage, você será responsável por projetar, desenvolver e administrar automações para todo o ciclo de vida dos serviços de armazenamento, garantindo escalabilidade, disponibilidade, desempenho e confiabilidade dos ambientes corporativos que suportam cargas de trabalho críticas. Você trabalhará com equipes de Engenharia de Storage, Automação de Plataforma, Observabilidade e Infraestrutura para entregar uma operação altamente automatizada por meio de práticas modernas de SRE, automação e engenharia de confiabilidade.
Dê o primeiro passo para a carreira dos seus sonhos
Todas as pessoas da nossa equipe agregam algo único. Veja o que estamos buscando para esta posição:
Requisitos Essenciais
- Ensino superior completo em Ciência da Computação, Tecnologia da Informação, Engenharia ou áreas correlatas, com experiência em Engenharia de Storage, Operações de Armazenamento, Site Reliability Engineering (SRE) ou Infraestrutura corporativa de grande porte.
- Inglês avançado ou fluente, com capacidade de colaborar efetivamente com equipes globais.
- Mínimo de 5 anos de experiência em Engenharia de Storage ou Operações de Storage em ambientes corporativos de grande porte.
- Experiência prática avançada em pelo menos duas das seguintes áreas: armazenamento SAN/Block, NAS/File Storage, Object Storage ou plataformas corporativas equivalentes, incluindo Dell PowerMax, PowerStore, ECS, Pure Storage, NetApp ONTAP, HPE Nimble, HPE Primera, Pure FlashBlade, PowerScale/Isilon, plataformas compatíveis com S3 ou tecnologias similares.
- Experiência comprovada no desenvolvimento de automações para plataformas de armazenamento utilizando Ansible, Python, APIs REST, Git, pipelines CI/CD e práticas de GitOps, incluindo provisionamento, replicação, gerenciamento de capacidade, monitoramento e ciclo de vida dos ambientes.
- Conhecimento sólido em observabilidade, monitoramento, confiabilidade de serviços, análise de incidentes, troubleshooting e resolução de falhas complexas envolvendo degradação de desempenho, replicação, capacidade, controladoras, discos e arquiteturas de armazenamento multicamadas, utilizando telemetria, histórico de mudanças e dados estruturados de diagnóstico.
- Forte capacidade analítica e de resolução de problemas para identificar oportunidades de automação, lacunas de observabilidade, melhorias de monitoramento e redução contínua do esforço operacional por meio da análise de incidentes.
Requisitos Desejáveis:
- Experiência com ambientes multivendor de storage, plataformas de monitoramento como Zabbix ou vROps, ServiceNow CMDB, GitLab CI, serviços de armazenamento em nuvem, arquiteturas híbridas e práticas formais de Site Reliability Engineering (SRE).
- Familiaridade com plataformas corporativas de automação assistida por IA, soluções agentic AI, integração de LLMs em processos operacionais, ambientes regulados por requisitos de conformidade (SOX, PCI-DSS e ISO 27001), geração de evidências para auditoria e práticas avançadas de engenharia de confiabilidade.







