NVIDIA RTX PRO 6000 Blackwell Server Edition 96GB GDDR7 ECC Grafikkarte
Kentino · Individueller KI-Server

NVIDIA RTX PRO 6000 Blackwell Server Edition 96 GB GDDR7 ECC

Plattform in Enterprise-Qualität, in der EU montiert und getestet.

€23.000,00 zzgl. MwSt. · Versand an der Kasse berechnet
Auf Lager — Versand aus dem EU-Lager
ISO 9001 · geprüfte HardwareEU-Lager & Garantie7+ Jahre in Enterprise-KIBurn-in-getestet vor dem Versand
Übersicht
FAQ
Versand & Garantie
Blackwell · 96 GB ECC · Passiv · Rack

NVIDIA RTX PRO 6000 Blackwell Server Edition — 96 GB

Die Rechenzentrums-Variante: 96 GB einheitlicher ECC-GDDR7-Speicher, passiv gekühlt für den Rack-Luftstrom von vorne nach hinten, mit konfigurierbarem Leistungsbudget von 400–600 W. Ausgelegt für den Dauerbetrieb im Servergehäuse statt auf dem Schreibtisch.

96 GB
GDDR7 ECC VRAM
24,064
CUDA-Kerne
~1.8 TB/s
Speicherbandbreite
400–600 W
Konfigurierbare TDP
Überblick

Gebaut für den 24/7-Rackbetrieb

Die Server Edition nutzt denselben Blackwell-Die und denselben 96-GB-ECC-Speicherpool wie die Workstation-Karten, ist aber für eine andere Umgebung konstruiert. Sie besitzt weder Lüfter noch Displayausgänge: Die Kühlung übernimmt das Gehäuse über einen Luftweg von vorne nach hinten — und genau das macht dichte Multi-GPU-Rack-Systeme überhaupt erst möglich. Das Leistungsbudget lässt sich zwischen 400 W und 600 W konfigurieren, sodass sich Packungsdichte und Wärmebudget gegen den Durchsatz je Karte abwägen lassen. Diese Karte steckt in den Multi-GPU-Rack-Servern der Reihe Kentino AI.

Spezifikationen

Technische Daten

GPU NVIDIA GB202 — Blackwell
Speicher 96 GB GDDR7 ECC, 512 Bit
Speicherbandbreite ~1.8 TB/s
CUDA-Kerne 24,064
Tensor-Kerne 752 (5. Generation) · ~2,000 TOPS INT8
RT-Kerne 188 (4. Generation)
Schnittstelle PCIe 5.0 ×16
Board-Leistungsaufnahme 400–600 W konfigurierbar
Kühlung Passiv — erfordert Gehäuse-Luftstrom von vorne nach hinten
Displayausgänge Keine
Formfaktor Dual-Slot, volle Bauhöhe
Garantie 3 Jahre Herstellergarantie
Am besten geeignet für

Wo sie passt

  • Dichte Multi-GPU-Rack-Server — 2, 4, 6 oder 8 Karten in einem einzigen Gehäuse.
  • Durchgehender 24/7-Inferenzbetrieb im Rechenzentrum oder Serverraum.
  • Gemeinsam genutzte oder mandantenfähige KI-Infrastruktur, in der ECC und Stabilität Pflicht sind.
  • Installationen, in denen die Leistung je Karte begrenzt werden muss, um das Wärmebudget des Racks einzuhalten.
  • Betrieb großer Modelle über mehrere Karten mit jeweils 96 GB einheitlichem VRAM.
Diese Karte kann sich nicht selbst kühlen. Sie benötigt ein Servergehäuse mit einem sauberen Luftweg von vorne nach hinten und ausreichend statischem Druck — in einem gewöhnlichen Desktop-Gehäuse überhitzt sie. Wenn Sie noch kein geeignetes Gehäuse betreiben, fragen Sie uns stattdessen nach einem komplett aufgebauten System.
Fragen

FAQ

Kann ich sie in einem Desktop-PC einsetzen?

Nein. Sie hat keinen Lüfter und ist vollständig auf einen Gehäuse-Luftstrom angewiesen, der für passive GPUs ausgelegt ist. In einem normalen Tower-Gehäuse drosselt sie zunächst und überhitzt dann. Für Tower- und Schreibtisch-Systeme verwenden Sie die Workstation- oder die Max-Q-Edition.

Wie schneidet sie im Vergleich zu den Workstation-Karten ab?

Identische GPU und identische 96 GB ECC-Speicher. Die Unterschiede sind physischer Natur: passive Kühlung, keine Displayausgänge und ein konfigurierbares Budget von 400–600 W für hohe Rack-Dichte. Wählen Sie sie nur, wenn Sie ein Servergehäuse dafür haben.

Warum auf 400 W begrenzen?

In einem dicht bestückten System sind in der Regel die Gesamtleistung und die Kühlung des Racks der begrenzende Faktor, nicht die einzelne Karte. Wer jede Karte begrenzt, bringt mehr GPUs in dasselbe Wärmebudget — und das ergibt meist mehr Gesamtdurchsatz als wenige Karten unter Volllast.

Liefern Sie damit auch komplette Server?

Ja. Die Rack-Serie Kentino AI ist um diese Karte herum aufgebaut — in Konfigurationen mit 1, 2, 4, 6 und 8 GPUs, vor der Auslieferung montiert, gebenchmarkt und in Betrieb genommen.

Der Preis dieser Variante wird auf Anfrage kalkuliert — die Kosten für Rechenzentrums-GPUs ändern sich von Woche zu Woche, und wir nennen Ihnen lieber einen aktuellen als einen veralteten Wert. Teilen Sie uns Stückzahl und Zielgehäuse mit, und wir melden uns mit einem verbindlichen Angebot samt Lieferzeit.

Die Fragen, die uns Käufer vor der Bestellung eines Servers am häufigsten stellen.

Wie lange dauert es?

Maschinen aus Komponenten, die wir vorrätig haben, werden schnell versandt; alles, was eine bestimmte GPU-Generation erfordert, hängt von der Verfügbarkeit ab. Wir nennen Ihnen ein Datum, bevor Sie zahlen, und wenn es sich verschiebt, sagen wir es Ihnen, statt Sie es selbst herausfinden zu lassen.

Kann die Konfiguration vor dem Bau noch geändert werden?

Fast immer. GPUs, Arbeitsspeicher, Storage und Kühlung werden je Bestellung ausgewählt, und die angegebene Konfiguration ist ein Ausgangspunkt und kein festes Paket. Wenn Sie mehr VRAM, schnelleren Storage oder ein anderes Kühlkonzept benötigen, sagen Sie es vor der Bestellung – wir kalkulieren die Änderung.

Kann ich den Server persönlich abholen?

Das können Sie. Unser Lager befindet sich in Prag, und die persönliche Abholung ist willkommen – die meisten, die vorbeikommen, nutzen den Besuch, um die Maschine gemeinsam mit unserem Ingenieur durchzugehen und die Fragen zu stellen, die per E-Mail unangenehm sind. Bei Bestellungen innerhalb Tschechiens versuchen wir außerdem, persönlich zu liefern und Sie vor Ort durch die Einrichtung zu führen.

Kann ich mit jemandem sprechen, der den Workload wirklich versteht?

Ja. Bei uns arbeitet ein Ingenieur speziell an KI-Systemen, kein allgemeines Vertriebsteam. Wenn Ihre Frage Batch-Größen, Quantisierung, Interconnect oder die Frage betrifft, wo Ihr Engpass liegen wird, stellen Sie sie — dieses Gespräch verändert die Konfiguration meist zum Besseren.

Welches Modell kann ich auf dieser Konfiguration betreiben?

Ja. Jede Maschine wird montiert, einem Burn-in-Test unterzogen und mit realen KI-Workloads gebenchmarkt, bevor sie ausgeliefert wird — und sie verlässt uns mit einem bereits installierten und laufenden LLM. Sie schließen sie an, verbinden sie mit Ihrem Netzwerk und legen los — die einzige verbleibende Entscheidung ist, welches Projekt zuerst darauf läuft.

Wie testen Sie einen Server vor dem Versand?

Wir testen ihn mit echten KI-Workloads statt mit synthetischen Benchmarks: Inferenz-Durchsatz, Verhalten unter Dauerlast und Thermik im Dauerbetrieb. Die Benchmark-Ergebnisse erhalten Sie zusammen mit der Maschine, sodass Sie die zugesagte Leistung vom ersten Tag an selbst überprüfen können.

Ist der Server bei Lieferung betriebsbereit?

Ja. Jede Maschine wird montiert, einem Burn-in-Test unterzogen und mit realen KI-Workloads gebenchmarkt, bevor sie ausgeliefert wird — und sie verlässt uns mit einem bereits installierten und laufenden LLM. Sie schließen sie an, verbinden sie mit Ihrem Netzwerk und legen los — die einzige verbleibende Entscheidung ist, welches Projekt zuerst darauf läuft.

Versand aus unserem EU-Lager. Schwere Artikel erfordern unter Umständen eine Speditionslieferung — kontaktieren Sie uns für ein Versandangebot und die Lieferzeit. 2 Jahre eingeschränkte Garantie mit erweitertem RMA-Support; Garantieverlängerung verfügbar.

Nicht ganz das, was Sie brauchen?

Nennen Sie uns Ihren Workload, und wir legen diese Plattform darauf aus – GPUs, Arbeitsspeicher, Storage und Kühlung passend zu Ihrem tatsächlichen Betrieb.