Référence
Le paysage des modèles ouverts à la mi-2026
Qwen3.8, Kimi K3, GLM-5.2, MiniMax M3, DeepSeek V4 : panorama des modèles open-weight fin 2026 et pourquoi l'attention linéaire hybride change la donne.
Référence
Qwen3.8, Kimi K3, GLM-5.2, MiniMax M3, DeepSeek V4 : panorama des modèles open-weight fin 2026 et pourquoi l'attention linéaire hybride change la donne.
Inférence LLM
Retour d'expérience SoberCloud : à fichier équivalent, un Mixture-of-Experts 35B-A3B sert plus vite qu'un modèle dense 27B sur un iGPU à mémoire unifiée.