Tag
#optimization
2 articles sur ce sujet.
Avancé3 min·20 juillet 2026
LoRA Speedrun : le championnat public du fine-tuning rapide
Un classement public chronométré pour affiner des modèles plus vite : compétition transparente, vérification triple, zéro marketing.
#lora#finetuning#leaderboard
Intermédiaire2 min·22 mai 2026
KVBoost : accélère tes LLM de 5 à 48× sans GPU supplémentaire
Réutilise les caches d'un modèle LLM sur HuggingFace pour diviser par 5 le temps de réponse — et fais tourner du 32B sur 8 GB de RAM.
#llm#inference#optimization