Performance Décodage accéléré : spéculatif, MTP, EAGLE et draft models Speculative decoding, Multi-Token Prediction, EAGLE-3, Medusa : comment générer plusieurs tokens par passe sans dégrader la qualité du LLM. 1 juin 2026 · Antoine Michéa