BEGIN:VCALENDAR
VERSION:2.0
PRODID:-//Capitole du Libre//Programme 2026//FR
CALSCALE:GREGORIAN
METHOD:PUBLISH
BEGIN:VEVENT
UID:LSBRQY@capitoledulibre.org
DTSTAMP:20260911T114537Z
DTSTART:20261114T140000Z
DTEND:20261114T145500Z
SUMMARY:Une plateforme IA à la demande\, 100 % open source : du GPU local 
 au cloud souverain — Julien Del Rio
LOCATION:ENSEEIHT — Salle A202
DESCRIPTION:Format : Conférence 55min\nPublic visé : Développeurs et exp
 erts en hébergement souverain\n\nVous voulez déployer de l'IA générati
 ve pour vos équipes\, et chaque option coince. Le tout-cloud propriétair
 e est puissant\, mais vos données partent chez un tiers\, la facture se d
 isperse entre dix fournisseurs et vous êtes captif de leurs API. Le tout-
 local est souverain et maîtrisé\, mais borné par votre budget GPU et pa
 r les modèles que vous pouvez réellement faire tourner. Et si on refusai
 t de choisir ? Je présente une plateforme d'IA « à la demande » qui co
 uvre toute la chaîne\, du GPU sous le bureau jusqu'aux grands clouds\, av
 ec une brique d'orchestration 100 % open source. Trois cartes RTX 6000 Pro
  font tourner des modèles en open weights (famille Qwen) en interne via v
 LLM. LiteLLM sert de passerelle unique : un seul endpoint compatible OpenA
 I\, une simple clé d'API\, et derrière\, le routage vers le bon modèle 
 selon l'usage. Open WebUI donne aux utilisateurs finaux une interface de c
 hat auto-hébergée\, pendant que les développeurs consomment exactement 
 le même socle via l'API — ils ne voient qu'une URL et un endpoint. La l
 ogique est en paliers : d'abord les modèles 100 % internes\, puis des mod
 èles open weights plus gros hébergés en France (Scaleway\, OVH) pour la
  souveraineté\, et enfin\, seulement quand c'est nécessaire\, typiquemen
 t le développement agentique\, un relais vers les clouds américains. Le 
 tout piloté au même endroit : qui a droit à quels modèles\, quelle con
 sommation\, quels quotas\, et une facturation simplifiée à un seul jeton
  par fournisseur. Je partagerai l'architecture réelle\, les choix\, les p
 ièges\, et un retour d'expérience concret : 4 mois de POC et 2 mois de p
 roduction au compteur au moment du talk. Vous repartirez avec un schéma r
 eproductible pour bâtir votre propre passerelle IA souveraine et réversi
 ble\, et une idée claire de là où l'open source vous rend libre\, et de
  là où il vous donne surtout du levier sur le propriétaire.
URL:https://capitoledulibre.org/programme/talk/LSBRQY/
END:VEVENT
END:VCALENDAR