Cherchant à simplifier au maximum la complexité technique de l’optimisation des charges de travail d’inférence pour les LLM sur un GPU ou un accélérateur d’IA particulier, Hugging Face lance un service dédié baptisé HUGS au prix de 1 dollar par heure par conteneur.

A découvrir également : Des modèles d’OpenAI, Anthropic et Meta ont piraté de vraies entreprises : derrière les scénarios catastrophistes, ce qui s’est réellement passé