[Job-31065] Engenheiro de Dados Sênior , Brazil
On-siteCampinas, São Paulo, Brazil
Job Summary
Develop and maintain MLOps pipelines for model deployment and management within production environments. Construct data preparation, transformation, and validation pipelines using PySpark and Databricks. Automate training, validation, deployment, and monitoring processes while implementing CI/CD practices via GitHub. Monitor performance, availability, data quality, and model stability indicators to ensure scalability and governance. Collaborate with data scientists, analytics, and business units to deliver scalable solutions, optimizing processing pipeline performance and operational efficiency. Requires advanced Databricks and Azure expertise with a focus on secure, governed model lifecycle management.
Required Qualifications
- Experiência sólida em implantação e operacionalização de modelos de Machine Learning
- Experiência avançada com Databricks
- Conhecimento avançado em Azure
- Domínio de PySpark para processamento distribuído de dados
- Experiência com GitHub e práticas de versionamento de código
- Conhecimento em MLOps, incluindo automação, monitoramento, governança e gerenciamento do ciclo de vida de modelos
- Experiência com construção e manutenção de pipelines de dados e Machine Learning
- Vivência com ambientes de produção e arquiteturas escaláveis
- Conhecimento em CI/CD aplicado a projetos de Machine Learning
- Experiência com monitoramento de modelos, qualidade de dados e observabilidade
- Importante: se você reside na Região Metropolitana de Campinas, sua presença nos escritórios da cidade será obrigatória, conforme a política de frequencia vigente
Desired Qualifications
- Experiência com MLflow, Azure Machine Learning ou ferramentas similares
- Conhecimento em arquitetura Lakehouse
Hiring someone like this?
Get your role in front of qualified candidates on Sorce.