Start/Installierte Modelle
Was bei Ihnen läuft. Nicht was eine Rangliste anführt.
Offene Modelle mit herunterladbaren Gewichten, auf der Maschine installiert und quartalsweise aktualisiert. Jede Zeile wurde an der Model Card des Herstellers geprüft.
- Erhebung
- 29.08.2026
- Modelle
- 5
- Aktualisierung
- quartalsweise
01 — DER KATALOG
Offen, installierbar, Ihre.
Ein offenes Modell bleibt nach Vertragsende auf der Maschine: Das unterscheidet ein heruntergeladenes Gewicht von einem API-Schlüssel.
Der Nachweis| Modell | Grösse | GPU-Speicher | Kontext | Lizenz | Maschinen |
|---|---|---|---|---|---|
| Qwen 3.8 27BAlibaba · Hauptmodell | 27 B · dense | ≈ 56 Go (BF16) | 256 k tokens | Apache 2.0 | N1 · N2 · N4 |
| GLM-5.3-FlashZ.ai | 320 B · 18 B actifs | ≈ 320 Go (BF16) | 256 k tokens | MIT | N2 · N4 |
| DeepSeek V4 FlashDeepSeek | 284 B · 13 B actifs | ≈ 291 Go (BF16) | 1 M tokens | MIT | N4 |
| Apertus 70BEPFL / ETH / CSCS · Suisse | 71 B · dense | ≈ 142 Go (BF16) | 131 k tokens | Apache 2.0 | N2 · N4 |
| Apertus v1.5 8BEPFL / ETH / CSCS · Suisse | 9 B · dense | ≈ 18 Go (BF16) | 131 k tokens | Apache 2.0 | N1 · N2 · N4 |
02 — WAS WIR NICHT INSTALLIEREN
Die Modelle an der Spitze der Ranglisten passen nicht in ein Gebäude.
Die «Max»-Versionen, die die Ranglisten dominieren (Kimi K3: 2 800 Milliarden Parameter, Qwen 3.8 Max, GLM-5.3), erfordern Cluster aus mehreren Dutzend Karten und bleiben API-Dienste. Sie dienen hier als Niveau-Referenz. Was die Maschine installiert, ist das obige Verzeichnis — die leistungsfähigsten Modelle, die eine Organisation wirklich in ihren eigenen Räumlichkeiten betreiben kann.
Quellen der zitierten Rankings, erhoben am 29.08.2026 : LMArena, Artificial Analysis.
Abstand zu geschlossenen Modellen, Kosten pro Aufgabe, Indizes: alles auf der Nachweisseite, mit Quelle und Datum.