Toutes les offres
Atos

Atos

Principal Llm Inference Engineer H/F

Le bar-Sur-Loup, grasseCDI80k€ – 95k€ / anil y a 1h

Postulez maintenant

Vous allez être redirigé vers le site de Atos.

Postuler chez Atos

Postée il y a 1h · CDI

Description du poste

* Serving et Runtime des modèles : Concevoir et optimiser la plateforme de serving basée sur vLLM, configurer le parallélisme selon l'architecture du modèle et l'interconnexion de l'infrastructure cible, et installer/maintenir llm-d pour l'inférence distribuée et désagrégée (préremplissage/décodage désagrégés, routage conscient du cache KV).

📬 Newsletter gratuite

Les compétences IA qui comptent, chaque soir

L'essentiel de l'actu IA décrypté en 5 min, pour rester à jour. Gratuit.

Le brief IA que lisent les pros

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Chaque soir à 19h

Gratuit · Pas de spam · Désabonnement en 1 clic