IA5 min read
Inference Endpoints
Hugging Face mise sur le levier de l'infrastructure, pas sur celui du modèle
Hugging Face remanie son service Inference Endpoints, mettant l'accent sur la facilité de déploiement plutôt que sur les performances brutes du modèle. La plateforme prend désormais en charge vLLM, SGLang, llama.cpp et des conteneurs personnalisés, avec mise à l'échelle automatique et paiement à l'utilisation. L'argument : sautez le travail d'exploitation et concentrez-vous sur le modèle.
2026-07-24