StartInstallierte Modelle

Was bei Ihnen läuft. Nicht was eine Rangliste anführt.

Offene Modelle mit herunterladbaren Gewichten, auf der Maschine installiert und quartalsweise aktualisiert. Jede Zeile wurde an der Model Card des Herstellers geprüft.

Erhebung
29.08.2026
Modelle
5
Aktualisierung
quartalsweise

Offen, installierbar, Ihre.

Ein offenes Modell bleibt nach Vertragsende auf der Maschine: Das unterscheidet ein heruntergeladenes Gewicht von einem API-Schlüssel.

Der Nachweis
ModellGrösseGPU-SpeicherKontextLizenzMaschinen
Qwen 3.8 27BAlibaba · Hauptmodell27 B · dense≈ 56 Go (BF16)256 k tokensApache 2.0N1 · N2 · N4
GLM-5.3-FlashZ.ai320 B · 18 B actifs≈ 320 Go (BF16)256 k tokensMITN2 · N4
DeepSeek V4 FlashDeepSeek284 B · 13 B actifs≈ 291 Go (BF16)1 M tokensMITN4
Apertus 70BEPFL / ETH / CSCS · Suisse71 B · dense≈ 142 Go (BF16)131 k tokensApache 2.0N2 · N4
Apertus v1.5 8BEPFL / ETH / CSCS · Suisse9 B · dense≈ 18 Go (BF16)131 k tokensApache 2.0N1 · N2 · N4

Die Modelle an der Spitze der Ranglisten passen nicht in ein Gebäude.

Die «Max»-Versionen, die die Ranglisten dominieren (Kimi K3: 2 800 Milliarden Parameter, Qwen 3.8 Max, GLM-5.3), erfordern Cluster aus mehreren Dutzend Karten und bleiben API-Dienste. Sie dienen hier als Niveau-Referenz. Was die Maschine installiert, ist das obige Verzeichnis — die leistungsfähigsten Modelle, die eine Organisation wirklich in ihren eigenen Räumlichkeiten betreiben kann.

Quellen der zitierten Rankings, erhoben am 29.08.2026 : LMArena, Artificial Analysis.