Serverless GPU ou comment déployer facilement son LLM @DevFest Afrique Francophone

Serverless GPU ou comment déployer facilement son LLM @DevFest Afrique Francophone

Les solutions d'IA fleurissent : de bonnes pratiques se mettent en place, des frameworks deviennent populaires, le changement de LLM est moins contraignant...

Par contre, quand il faut aller en production afin de pouvoir héberger son propre LLM pour assurer la sécurité, il n'y a moins de monde.

Une solution intéressante est de s'appuyer sur les solutions Serverless avec du GPU pour passer moins de temps sur l'infrastructure et plus de temps ailleurs !

Durant ce talk, nous regarderons comment utiliser Cloud Run GPU de la plateforme Google Cloud pour déployer un LLM open (Gemma3).

More Decks by Julien Landuré

See All by Julien Landuré

Kiro : Ne codez plus seul, pilotez vos agents de code @AWS Nantes

June 11, 2026 · AWS Nantes

Antigravity et l'agent manager, ou comment mixer Code & IA pour être vraiment productif @La Nuit des Communautés 2026

May 28, 2026 · Nuit des Communautés 2026

Récap Cloud Next 2026 @ GDG Cloud Nantes & GDG Rennes

May 5, 2026 · GDG Cloud Nantes & GDG Rennes