Zum Inhalt springen

Technik-Datenblatt

Modelle & Hardware

Ihr Modell entsteht durch Feintuning eines offenen Basismodells: Qwen3.5-9B für Größe M, Qwen3.8-27B für Größe L. Das Feintuning läuft in 8-Bit-Präzision (FP8); ausgeliefert wird das Modell in NVFP4 (4 Bit) für Blackwell-Karten und in BF16 für alle anderen unterstützten Karten.

M

Ausgewogener Standard für die meisten Fachbereiche: breitere Wissensbasis, differenziertere Antworten.

Basismodell
Qwen3.5-9B
Modellgröße
9 Mrd.
Datenumfang
ZIP-Upload bis 8 GB
Was es realistisch kann

Das 9B-Modell ist die Empfehlung für einen zusammenhängenden Unternehmensbereich mit einheitlicher Sprache: ein Produktbereich, eine Abteilung, ein Regelwerk. Es fasst längere Dokumente zusammen, verfasst E-Mails, Angebote und interne Texte im Stil Ihres Unternehmens und beantwortet Fragen über eine größere Wissensbasis, auch bei Nuancen und mehrdeutigen Fragen. Stabiles Firmenwissen unterscheidet es dabei von tagesaktuellen Werten: Preise, Bestände oder Kontaktdaten behauptet es nicht; es verweist auf die verlässliche Quelle. Grenzen: Für sehr große Wissensbasen oder besonders analytische Aufgaben ist das 27B die richtige Wahl.

L

Das größte Modell, für große Wissensbasen und anspruchsvolle Fragen.

Basismodell
Qwen3.8-27B
Modellgröße
27 Mrd.
Datenumfang
ZIP-Upload bis 16 GB
Was es realistisch kann

Das 27B-Modell ist für Unternehmen gedacht, die viel Wissen bündeln und hohe Antwortqualität brauchen. Es arbeitet über sehr große Dokumentenbestände und hält dank eines nativen Kontexts von 262.000 Token auch sehr lange Dialoge und Dokumente zusammen; es deckt 201 Sprachen ab. Es eignet sich für Aufgaben, bei denen eine Antwort mehrere Zusammenhänge verbinden muss. Grenzen: Es ist auf Ihr Wissen fokussiert, kein universelles Modell wie die großen Cloud-Dienste; dafür läuft es vollständig lokal und gehört Ihnen. Der Hardwarebedarf ist am höchsten.

Gilt für beide Modelle: in FP8 feingetunt, für Ihre Hardware in NVFP4 (4 Bit) oder BF16 ausgeliefert, und auf Apache-2.0-Basis mit voller Rechteübertragung samt Eigentumszertifikat.

Empfohlene Hardware

Die Hardware beschaffen Sie selbst. Verfügbarkeit und Preise am Markt schwanken derzeit stark; statt Sie an ein bestimmtes Gerät oder einen Preis zu binden, überlassen wir Ihnen die Wahl. Die folgenden NVIDIA-Systeme dienen als Orientierung; unser Einrichtungsprogramm prüft Ihre Hardware und wählt den passenden Pfad für Ihr Modell.

Empfehlung

NVIDIA DGX Spark

GB10 Grace-Blackwell-Superchip

Unsere Empfehlung für die meisten: kompakt wie ein Buch, leise, steht im Regal und trägt Ihr feingetuntes Modell mit Reserven.

KI-Leistung
bis 1 PetaFLOP (FP4)
Speicher
128 GB einheitlich (CPU + GPU, LPDDR5X)
Prozessor
20 Arm-Kerne (GB10)
Gleichzeitige Nutzer
kleine Teams, ca. 5–15 aktive Chats flüssig
Massenspeicher
4 TB NVMe
Netzwerk
10 GbE, WLAN 7, ConnectX-7 (200 Gb/s)
Mehrbenutzer
eine gemeinsame Instanz
Format
150 × 150 × 50,5 mm, ca. 1,1 Liter
Mehr Compute

NVIDIA DGX Station

GB300 Grace-Blackwell-Ultra-Superchip

Für deutlich mehr Compute: mehrere Teams, größere Modelle, ein Gerät. Rechenzentrums-Klasse als Tower unter dem Schreibtisch.

KI-Leistung
bis 20 PetaFLOPS (FP4)
Speicher
748 GB kohärent (inkl. HBM3e-GPU-Speicher)
Prozessor
72-Kern NVIDIA Grace
Gleichzeitige Nutzer
ganze Abteilungen, 100+ aktive Chats flüssig
Massenspeicher
NVMe-SSD, konfigurationsabhängig
Netzwerk
ConnectX-8, bis 800 Gb/s
Mehrbenutzer
bis 7 getrennte Instanzen (MIG)
Format
Tower, flüssigkeitsgekühlt

Nutzerangaben: gleichzeitig aktive Chats bei unseren Modellgrößen (9B–27B), konservativ geschätzt. Die Systeme dienen als Orientierung; die Hardware beschaffen Sie selbst.

Empfohlene Hardware für den lokalen Betrieb · IonKon