GENAI DAYS
Speaker To Be Announced
"Je veux internaliser mon inference mais c'est cher et lent"
Speaker To Be Announced · Pour ceux qui implémentent · 09:40 · 80 min
"Je veux internaliser mon inference mais c'est cher et lent"
Self-hosting, inference & infrastructure
Comment internaliser l’hébergement de ses GPUs sans faire exploser les coûts ni les délais d’approvisionnement, entre choix de matériel, dimensionnement et architecture.
Cette session détaille les leviers concrets, choix de matériel, mutualisation des ressources, optimisation du taux d’utilisation, pour rendre le self-hosting de GPUs réellement viable en interne.
Speaker To Be Announced