vLLM 0.31.0 réunit 717 commits de 307 contributeurs et garde les poids en mémoire GPU entre deux redémarrages
Le 5 octobre 2026, le projet vLLM a publié la version 0.31.0 de son moteur d'inférence, qui rassemble 717 commits de 307 contributeurs, dont 96 nouveaux. Une nouvelle commande, vllm preload, lance un… Lire la brève