---
title: La sobriété n'est pas de la décroissance
description: Un modèle de 110 Go qui refuse de démarrer, un autre quatre fois
  plus petit qui sert mieux. Ce que ça dit de qui a le droit de faire de l'IA.
date: 2026-08-07T00:00:00.000Z
dateModified: 2026-08-07T00:00:00.000Z
author:
  name: Mathias Pieroni
  url: https://sobercloud.fr/
  sameAs:
    - https://www.linkedin.com/in/mathias-pieroni/
tags:
  - sobriete
  - souverainete
  - opinion
  - ia
section: Opinion
canonical: https://sobercloud.fr/decouvertes/sobriete-nest-pas-decroissance/
---

# La sobriété n'est pas de la décroissance

Le 16 mai, on a voulu charger un modèle de 110 gigaoctets sur une machine qui en compte 128. Échec avant même le premier token. Quelques jours plus tard, après un balayage complet, celui qu'on a retenu tenait dans 26 gigaoctets et servait autour de 73 tokens par seconde sur cette même machine, qui n'a aucune carte graphique dédiée.

Entre les deux, on n'avait rien acheté.

C'est à peu près tout ce que le mot sobriété veut dire quand on a les mains dans les machines. Et c'est à peu près l'inverse de ce que lui font dire les deux camps qui se disputent son usage.

## Juste ce qu'il faut

Chez un investisseur de la tech, sobriété sonne comme un aveu de faiblesse. Chez un militant, comme une vertu. Ni l'un ni l'autre ne désigne la même chose que nous.

Un ingénieur qui dit sobre ne dit pas moins. Il dit dimensionné.

Personne n'a jamais félicité un constructeur pour un pont deux fois trop lourd. On appelle ça une erreur de calcul, ça se paie en béton et en fondations, et ça ne se présente pas en réunion comme une preuve d'ambition. L'informatique a passé des années à applaudir l'inverse, jusqu'à faire du surdimensionnement une signature de sérieux — la seule métrique restée universelle étant la taille de ce qu'on achète.

## Les deux erreurs

Le camp majoritaire est celui de la fuite en avant. Plus de paramètres, plus de GPU, plus de mégawatts, la qualité suivra. On verra plus tard pour l'énergie, plus tard pour le foncier, plus tard pour l'eau. On a vu passer assez de présentations bâties sur ce plan-là pour savoir qu'il n'y a jamais de dernière diapositive consacrée au « plus tard ».

Dans ce cadre, optimiser plutôt qu'acheter ne peut vouloir dire qu'une chose : ne pas avoir les moyens d'acheter. On vous concède la vertu et on vous retire la compétence. C'est un raisonnement confortable, puisqu'il dispense d'avoir à défendre le gaspillage. Il suffit de le rebaptiser ambition.

En face, l'IA est coupable par construction. Chaque requête vaut dette climatique, chaque modèle vaut excès, et la seule sobriété recevable consiste à s'abstenir.

Ce camp-là a raison sur les faits, et autant le dire sans réserve : le gaspillage existe, il est massif, des grappes entières tournent à vide, et des modèles quinze fois trop gros répondent à des questions qu'un petit traiterait mieux. Le procès est fondé.

Regardez pourtant ce que les deux partagent. Pour avoir plus d'IA, il faudrait plus de machines. Le premier s'en réjouit, le second s'en désole, aucun ne le discute.

C'est ce postulat qui est faux.

## 2026 a envoyé la facture

Les prix de la DRAM ont doublé cette année, ceux des SSD aussi, et personne n'attend de détente avant fin 2027. En quelques mois, « j'achète plus gros » est devenue la stratégie la plus chère et la plus exposée du marché. Ceux qui avaient conçu sous contrainte, eux, ont continué à travailler sans rien changer.

Le modèle du 16 mai n'est pas passé parce qu'il pesait 110 Go. Celui qu'on utilise depuis compte 35 milliards de paramètres, dont 3 milliards seulement s'activent à chaque token : il lit beaucoup moins de poids par token, donc il va plus vite, sur du matériel qu'on peut poser sur un bureau. Le 23 mai, un modèle dense pourtant plus petit sur le disque s'est révélé plus lent que lui. Le détail des mesures est dans [Dense ou MoE sur Strix Halo](/decouvertes/dense-vs-moe-strix-halo/), la lecture économique dans [notre analyse de la pénurie](/decouvertes/penurie-memoire-2026/).

Aucune de ces techniques n'est un secret propriétaire. Elles sont publiées, documentées, disponibles dans des moteurs open source que n'importe qui installe en une soirée. C'est ce qui rend la position du premier camp intenable : il défend une dépense que l'état de l'art a rendue facultative.

## Là où ça devient politique

Tant qu'on reste entre techniciens, tout ceci passe pour une querelle de méthode. Ça n'en est pas une.

Si faire de l'IA suppose un datacenter à un milliard, le nombre d'acteurs capables d'en faire tient dans une main, et aucun n'est européen. Chaque palier de puissance qu'on décrète nécessaire fonctionne comme un filtre. Il ne dit pas combien ça coûte. Il dit qui reste dans la pièce.

Un modèle qui tourne sur une machine posée sur un bureau, c'est une PME qui traite ses contrats sans les expédier ailleurs. Une commune qui garde ses fichiers. Un cabinet qui s'équipe sans signer pour trois ans. La sobriété est la condition matérielle de tout ça, et elle décide de qui aura le droit d'y toucher.

On ne devient pas souverain en imprimant le mot sur une plaquette. On le devient en sachant faire tourner la chose sur ce qu'on possède, sans demander la permission à personne. Ce point mérite son propre texte, il l'aura.

## Ce qu'on en fait

Notre datacenter est à 1 326 mètres, refroidi par l'air des Alpes, alimenté au solaire, sans eau, avec des machines qui s'éteignent quand plus personne ne s'en sert. On pourrait vendre ça comme un geste écologique et s'arrêter là.

La vérité est plus intéressée que ça. La contrainte nous a obligés à comprendre nos machines, cette compréhension est devenue le métier, et le jour où le prix de la mémoire a doublé, elle s'est transformée en avantage. On applique la même règle aux sites qu'on livre, d'ailleurs : l'[éco-conception](/RSE/eco-conception/) n'y est pas un mode dégradé, c'est du travail fait correctement.

La décroissance demande qu'on renonce. On demande seulement qu'on arrête de payer pour ce qui ne sert à rien. Entre les deux, il y a la distance qui sépare une morale d'un métier.

## Pour aller plus loin

- [Pénurie de mémoire 2026 : quand la sobriété devient un avantage](/decouvertes/penurie-memoire-2026/)
- [Dense ou MoE ? Pourquoi un 35B-A3B bat le 27B dense](/decouvertes/dense-vs-moe-strix-halo/)
- [Choisir son matériel pour l'inférence LLM locale](/decouvertes/choix-du-materiel/)
- [Notre démarche d'éco-conception](/RSE/eco-conception/)
- [La charte des valeurs SoberCloud](/RSE/charte-des-valeurs/)
