Aller au contenu
Whileresume
Classement Créer mon CV Recruter Se connecter

Staff Machine Learning Performance Engineer, Inference Optimisation

Cette offre est-elle pour vous ?

Créez votre CV et découvrez votre pourcentage de correspondance avec ce poste — et avec tous les autres.

Créer mon CV
Suivez vos candidatures sur mobile L'application Whileresume, gratuite, sur iPhone et Android.

Le poste

Lead high-impact projects to optimize ML inference on edge accelerators and GPUs for low-cost, low-power devices.
Advance transformer-based model deployment through ML compiler and kernel optimizations.
Develop cross-platform solutions targeting Nvidia Thor/Orin, Qualcomm, and other SoCs.
Build technical roadmaps and execute with multi-team collaboration across model developers and engineers.
Mentor and guide a growing engineering team, shaping architecture, best practices, and performance benchmarks.
Deliver measurable gains in latency, throughput, and energy efficiency via rigorous testing and benchmarking.

Voir l'offre en entier

Missions, profil recherché, compétences et avantages — en créant votre compte gratuitement.

6 caractères minimum. Plus il est long, plus il est sûr.
ou

Déjà un compte ?

Ces offres pourraient vous intéresser

Aucune offre vraiment proche pour l'instant — voici les plus récentes.

Votre lieu

Les offres et entreprises seront filtrées sur ce pays.

Suggérés

Tous les pays 65