IA locale
Un classement dynamique des modèles à poids ouverts pour écrire en français, avec filtres de quantification et repères mémoire.
Des enquêtes fondées sur les données du Baromètre pour mesurer comment les modèles, les réglages de génération et les protocoles d’évaluation influent sur la qualité des textes.
Un classement dynamique des modèles à poids ouverts pour écrire en français, avec filtres de quantification et repères mémoire.
Même fichier, mêmes consignes, un seul interrupteur. Sur 21 modèles locaux, le raisonnement apporte en moyenne 31,0 points à la famille Qwen et 6,7 aux grands Gemma 4 ; les petits Gemma E2B et E4B n’y gagnent rien et y perdent parfois.
Parfois rien, parfois vingt points. Sur les consignes françaises, Qwen3.8 27B écrit aussi bien en Q4_K_M qu’en Q8_0 avec un fichier deux fois plus petit ; Gemma 4 31B est meilleur en Q6_K qu’en Q8_0 ; Granite 4.2 30B s’effondre à tous les niveaux. La règle générale : il n’y a pas de règle générale.
Mise à jour avec 1 500 duels classants par fichier et par langue. Le fichier K-Quant Dynamic est le meilleur modèle local pour écrire en anglais, à 77,6 points ; en français, en allemand et en espagnol, c’est le fichier 17GB, plus petit, qu’il faut télécharger.
Deux de nos cinq juges accordent un net bonus à leur propre modèle : GPT-5.6 Sol donne à ses textes jusqu’à 21 points de plus que les autres juges, Claude Opus 5 jusqu’à 11. Les deux juges Fable font l’inverse et se notent plus sévèrement.
Claude Opus 5 et GPT-5.6 Sol, qui fournissent la plupart des verdicts, penchent du même côté pour environ neuf paires de modèles sur dix. Les désaccords sont ailleurs : Sol ne déclare presque jamais d’égalité, Claude Fable 5.1 le fait jusqu’à une fois sur six, et Claude Opus 4.8 ne rejoint les autres que deux fois sur trois.
Quatre-vingt-onze modèles sont classés dans les quatre langues. Le trio de tête bouge à peine : Claude Opus 5, Claude Fable 5 et Claude Fable 5.1 sont partout dans les quatre premiers. En dessous, GLM 5.3 Flash est 10e en anglais et 53e en allemand, Grok 4.6 25e en anglais et 61e en français.