Presque au niveau des meilleurs modèles du monde.

Deux classements indépendants, relevés ce jour. Nous ne publions pas de scores Numezis : nous publions ce que les tiers mesurent.

01 · Indice d'intelligence4,8 %

L'écart entre le meilleur modèle ouvert et le meilleur modèle fermé, sur 127 modèles mesurés aux mêmes 22 benchmarks. Artificial Analysis, 29.08.2026.

02 · Arena code1 %

L'écart entre le meilleur modèle ouvert (Kimi K3, 1 674) et le meilleur modèle fermé (Claude Opus 5, 1 691), sur des votes humains anonymes. LMArena, 29.08.2026.

03 · Le meilleur installable15ᵉ / 127

Le rang du modèle le plus puissant qu'une organisation peut réellement faire tourner dans ses murs — GLM-5.3-Flash. Devant la moitié des modèles du marché.

04 · Coût par tâche×26

Ce que facture une tâche sur l'API haut de gamme (2,34 $) par rapport à un modèle ouvert installé (0,09 $). Artificial Analysis, 29.08.2026.

Ce que les tiers mesurent.

Chaque rang est vérifiable sur la page source, à la date du relevé. Les classes changent chaque trimestre ; ce qui ne change pas, c'est l'ordre de grandeur.

Arena code · LMArena · 29.08.2026
ModèleScoreType
1Claude Opus 5 (max)API1 691
2Kimi K3 (max)OUVERT1 674
3Qwen 3.8 MaxOUVERT1 669
4Claude Opus 5 (high)API1 663
5GLM-5.3 (max)OUVERT1 599
6Qwen 3.8 27BOUVERT1 595
7Gemini 3.7 Flash (high)API1 587
Indice d'intelligence · Artificial Analysis · 29.08.2026
ModèleRangScoreMachine
Qwen 3.8 27BOUVERT30sur 127 modèles52N1 · N2 · N4
Qwen 3.8 Flash-NextOUVERT20sur 127 modèles56N2 · N4
GLM-5.3-FlashOUVERT15sur 127 modèles57N2 · N4
DeepSeek V4 FlashOUVERT31sur 127 modèles52N4
Claude Opus 5 (high)API4sur 127 modèles61
Claude Opus 5 (max)API1sur 127 modèles63

Les versions « max » qui dominent les classements (Kimi K3 : 2 800 milliards de paramètres, Qwen 3.8 Max, GLM-5.3) exigent des grappes de plusieurs dizaines de cartes et restent des services API. Elles servent ici de référence de niveau. Ce que la machine installe est le catalogue ci-dessus — les modèles les plus puissants qu'une organisation peut réellement faire tourner dans ses murs.

Sources : LMArena ↗ · Artificial Analysis ↗ · Deloitte ↗relevés le 29.08.2026

La puissance, ce n'est pas ce qui coûte.

Un modèle ouvert installé a un coût marginal qui tend vers zéro. Le même travail, sur API, se paie à chaque tâche.

Le calculateur
01 · Par tâche0,09 $

Le prix d'une tâche sur GLM-5.3-Flash, installé chez vous. L'API haut de gamme facture 2,34 $ la même tâche.

02 · Par an70 000 – 134 000 CHF

C'est la facture API évitée pour une organisation de 20 personnes en usage régulier — 73 000 tâches par an. Le calculateur fait la courbe avec vos chiffres.

03 · Sur trois ans50 %

Des coûts d'inférence économisés sur site par rapport au cloud public, à volume significatif. Deloitte, State of AI in the Enterprise.

Pas des promesses. Des modèles nommés.

Vérifiés sur leurs cartes officielles, le 29 août 2026 : taille, mémoire, licence. C'est ce qui est installé, pas les versions API des classements.

ModèleParamètresMémoire (BF16)MachineLicence
Qwen 3.8 27BAlibaba · 256 k tokens27 B · dense≈ 56 Go (BF16)N1 · N2 · N4Apache 2.0
GLM-5.3-FlashZ.ai · 256 k tokens320 B · 18 B actifs≈ 320 Go (BF16)N2 · N4MIT
DeepSeek V4 FlashDeepSeek · 1 M tokens284 B · 13 B actifs≈ 291 Go (BF16)N4MIT
Apertus 70BSUISSEEPFL / ETH / CSCS · 131 k tokens71 B · dense≈ 142 Go (BF16)N2 · N4Apache 2.0
Apertus v1.5 8BSUISSEEPFL / ETH / CSCS · 131 k tokens9 B · dense≈ 18 Go (BF16)N1 · N2 · N4Apache 2.0

Mémoire : taille des poids du modèle en BF16, hors mémoire de contexte. La bascule entre modèles est incluse au service, chaque trimestre. Apertus est le modèle suisse (EPFL / ETH / CSCS), proposé par défaut pour le secteur public et parapublic.

100 % ne s'applique qu'à l'architecture.

Un benchmark mesure ce qu'un modèle sait faire. Il ne mesure pas où vos documents sont quand il le fait.

Parler à un ingénieur
01 · Vos donnéesNe sortent pas

La différence de fond : un modèle à 97 % qui tourne dans votre bâtiment bat un modèle à 100 % qui tourne chez quelqu'un d'autre.

02 · Ce qui est 100 %L'absence de flux

Aucun flux sortant de contenu client, par construction — pas par promesse. Attesté chaque année par le rapport annuel, opposable à votre réviseur.

03 · Ce qui n'est jamais 100 %Aucun système

Aucune architecture n'est à l'abri de tout risque. La différence est de savoir ce que l'on peut prouver — et de le produire, devant son ordre.