Senior Devops - F/H/NB
On-siteParis, Île-de-France, France
Job Summary
Optimize AI model inference to reduce latency and improve global performance while managing infrastructure costs for GPU and cloud resources. Deploy, host, and maintain production models, ensuring scalability to handle thousands of simultaneous requests. Collaborate with Data Science teams on the transition between training and production phases, intervening on dedicated ML infrastructure servers and specialized resources. Continuously enhance system performance and reliability using Python, Linux, and shell scripting for automation and load testing. Master Kubernetes environments, observability pipelines, and protocols like gRPC and HTTP/2.
Required Qualifications
- Expérience dans le déploiement, la configuration et l'optimisation des performances de serveurs d'inférence ML modernes (comme Triton Inference Server, vLLM, TensorRT-LLM, etc.)
- Expérience avérée dans la gestion, la scalabilité et l'automatisation d'environnements Kubernetes de niveau production
- Expérience pratique avec des pipelines d'observabilité
- Maîtrise de Python, Linux et du scripting shell pour l'automatisation d'infrastructure, le profiling de performance et les frameworks de tests de charge
- Bonne compréhension des protocoles réseau (gRPC, HTTP/2), des systèmes distribués et des principes d'infrastructure as code
- Bon relationnel et bonne capacité à communiquer en anglais
Desired Qualifications
- Compréhension de base de Rust
- Expérience avec les systèmes de matchmaking à grande échelle ou les contraintes de faible latence typiques des services de jeux multijoueurs en ligne
Hiring someone like this?
Get your role in front of qualified candidates on Sorce.