NVIDIA RTX PRO 6000 Blackwell Workstation Edition 96GB GDDR7 ECC Grafikkarte
Kentino · Individueller KI-Server

NVIDIA RTX PRO 6000 Blackwell Workstation Edition 96 GB GDDR7 ECC

Plattform in Enterprise-Qualität, in der EU montiert und getestet.

€0,00 zzgl. MwSt. · Versand an der Kasse berechnet
Auf Lager — Versand aus dem EU-Lager
ISO 9001 · geprüfte HardwareEU-Lager & Garantie7+ Jahre in Enterprise-KIBurn-in-getestet vor dem Versand
Übersicht
FAQ
Versand & Garantie
Blackwell · 96 GB ECC · 600 W

NVIDIA RTX PRO 6000 Blackwell Workstation Edition — 96 GB

Die Blackwell-Profikarte mit voller Leistungsfreigabe: 96 GB einheitlicher ECC-GDDR7-Speicher und 24,064 CUDA-Kerne bei einem Board-Limit von 600 W. Die schnellste Einzel-GPU-Option in unserem Programm für lokales Modelltraining, Fine-Tuning und anspruchsvolle Inferenz.

96 GB
GDDR7 ECC VRAM
24,064
CUDA-Kerne
~1.8 TB/s
Speicherbandbreite
600 W
Leistungsaufnahme der Karte
Überblick

Maximaler Durchsatz mit einer einzelnen GPU

Dies ist die uneingeschränkte Variante der Karte: derselbe einheitliche 96-GB-ECC-Speicherpool wie bei der Max-Q, jedoch mit einer auf 600 W angehobenen Leistungsgrenze, damit die GPU unter Dauerlast hohe Taktraten halten kann. Bei rechenlastigen Aufgaben — Fine-Tuning, lange Trainingsläufe, Batch-Inferenz, aufwendiges Rendering und Simulation — entsteht der Leistungsvorsprung genau aus diesem Spielraum. Eine einzige Karte fasst ein Modell der 70B-Klasse mit 4 Bit und bietet dabei noch Reserven für langen Kontext, sodass kein Tensor-Parallel-Split verwaltet werden muss.

Spezifikationen

Technische Daten

GPU NVIDIA GB202 — Blackwell
Artikelnummer 900-5G144
Speicher 96 GB GDDR7 ECC, 512 Bit
Speicherbandbreite ~1.8 TB/s
CUDA-Kerne 24,064
Tensor-Kerne 752 (5. Gen.) · ~2,000 TOPS INT8
RT-Kerne 188 (4. Gen.)
Schnittstelle PCIe 5.0 ×16
Leistungsaufnahme der Karte 600 W (16-Pin 12V-2×6)
Kühlung Aktiv, Flow-Through, Dual-Slot
Displayausgänge 4× DisplayPort 2.1b
Garantie 3 Jahre Herstellergarantie
Am besten geeignet für

Wo sie passt

  • Lokales Fine-Tuning und Training, bei dem die dauerhaft verfügbare Rechenleistung und nicht allein die VRAM-Kapazität das Tempo vorgibt.
  • 70B-Inferenz auf einer einzigen Karte, mit langem Kontext vollständig in einem Speicherpool.
  • Batch- oder Mehrbenutzer-Inferenz, bei der der Durchsatz je Karte zählt.
  • Professionelle Visualisierung, Rendering und Simulation parallel zur KI-Arbeit.
  • Workstations, in denen eine Karte mit voller Leistung mehreren kleineren GPUs vorzuziehen ist.
Planen Sie Stromversorgung und Kühlung vor dem Kauf: Bei 600 W braucht diese Karte ein hochwertiges Netzteil mit echten Reserven und ein Gehäuse, das die Abwärme auch tatsächlich abführt. Bei jedem Aufbau, den wir liefern, dimensionieren wir Netzteil und Luftstrom mit.
Fragen

FAQ

Diese Karte oder die Max-Q?

Beide bieten dieselben 96 GB und führen damit dieselben Modelle aus. Entscheiden Sie sich für diese Karte, wenn Ihre Arbeit rechenlastig ist und Sie 600 W an Strom und Kühlung bereitstellen können. Wählen Sie die Max-Q, wenn Leistungsaufnahme, Wärme oder Geräusch die bestimmende Randbedingung sind — sie kostet weniger und zieht bei gleicher VRAM-Kapazität die halbe Leistung.

Welches Netzteil brauche ich?

Für eine einzelne Karte sollten Sie ein hochwertiges ATX-3.0-Netzteil mit 1,200 W oder mehr und nativem 16-Pin-Anschluss 12V-2×6 einplanen — mehr, wenn Sie sie mit einer CPU mit hoher Kernzahl kombinieren. Für Maschinen, die wir bauen, legen wir das sauber aus.

Kann ich mehrere betreiben?

Ja, aber 600 W je Karte summieren sich schnell — Konfigurationen mit mehreren Karten erfordern eine bewusst geplante Strom- und Luftführung, und in den meisten Gehäusen ist die Max-Q die bessere Multi-GPU-Wahl. Sprechen Sie mit uns, bevor Sie sich auf einen Aufbau mit mehreren Karten festlegen.

Ist das dasselbe wie die Server Edition?

Nein. Die Server Edition ist passiv gekühlt und auf den Front-to-Back-Luftstrom im Rack ausgelegt; sie hat keine Displayausgänge. Diese Karte ist aktiv gekühlt und besitzt vier DisplayPort-Ausgänge — gedacht für Workstations und Tower-Aufbauten.

Wie lang ist die Lieferzeit?

Typischerweise 10–21 Tage, auftragsbezogene Beschaffung. Die Verfügbarkeit ändert sich bei diesem Artikel schnell — lassen Sie sie sich von uns bestätigen, bevor Sie einen Termin einplanen.

Sie möchten diese Karte in einer fertigen Maschine? Kentino baut, benchmarkt und nimmt komplette RTX PRO 6000 KI-Server und Workstations in Betrieb — fragen Sie uns nach einem konfigurierten Aufbau.

Die Fragen, die uns Käufer vor der Bestellung eines Servers am häufigsten stellen.

Wie lange dauert es?

Maschinen aus Komponenten, die wir vorrätig haben, werden schnell versandt; alles, was eine bestimmte GPU-Generation erfordert, hängt von der Verfügbarkeit ab. Wir nennen Ihnen ein Datum, bevor Sie zahlen, und wenn es sich verschiebt, sagen wir es Ihnen, statt Sie es selbst herausfinden zu lassen.

Kann die Konfiguration vor dem Bau noch geändert werden?

Fast immer. GPUs, Arbeitsspeicher, Storage und Kühlung werden je Bestellung ausgewählt, und die angegebene Konfiguration ist ein Ausgangspunkt und kein festes Paket. Wenn Sie mehr VRAM, schnelleren Storage oder ein anderes Kühlkonzept benötigen, sagen Sie es vor der Bestellung – wir kalkulieren die Änderung.

Kann ich den Server persönlich abholen?

Das können Sie. Unser Lager befindet sich in Prag, und die persönliche Abholung ist willkommen – die meisten, die vorbeikommen, nutzen den Besuch, um die Maschine gemeinsam mit unserem Ingenieur durchzugehen und die Fragen zu stellen, die per E-Mail unangenehm sind. Bei Bestellungen innerhalb Tschechiens versuchen wir außerdem, persönlich zu liefern und Sie vor Ort durch die Einrichtung zu führen.

Kann ich mit jemandem sprechen, der den Workload wirklich versteht?

Ja. Bei uns arbeitet ein Ingenieur speziell an KI-Systemen, kein allgemeines Vertriebsteam. Wenn Ihre Frage Batch-Größen, Quantisierung, Interconnect oder die Frage betrifft, wo Ihr Engpass liegen wird, stellen Sie sie — dieses Gespräch verändert die Konfiguration meist zum Besseren.

Welches Modell kann ich auf dieser Konfiguration betreiben?

Ja. Jede Maschine wird montiert, einem Burn-in-Test unterzogen und mit realen KI-Workloads gebenchmarkt, bevor sie ausgeliefert wird — und sie verlässt uns mit einem bereits installierten und laufenden LLM. Sie schließen sie an, verbinden sie mit Ihrem Netzwerk und legen los — die einzige verbleibende Entscheidung ist, welches Projekt zuerst darauf läuft.

Wie testen Sie einen Server vor dem Versand?

Wir testen ihn mit echten KI-Workloads statt mit synthetischen Benchmarks: Inferenz-Durchsatz, Verhalten unter Dauerlast und Thermik im Dauerbetrieb. Die Benchmark-Ergebnisse erhalten Sie zusammen mit der Maschine, sodass Sie die zugesagte Leistung vom ersten Tag an selbst überprüfen können.

Ist der Server bei Lieferung betriebsbereit?

Ja. Jede Maschine wird montiert, einem Burn-in-Test unterzogen und mit realen KI-Workloads gebenchmarkt, bevor sie ausgeliefert wird — und sie verlässt uns mit einem bereits installierten und laufenden LLM. Sie schließen sie an, verbinden sie mit Ihrem Netzwerk und legen los — die einzige verbleibende Entscheidung ist, welches Projekt zuerst darauf läuft.

Versand aus unserem EU-Lager. Schwere Artikel erfordern unter Umständen eine Speditionslieferung — kontaktieren Sie uns für ein Versandangebot und die Lieferzeit. 2 Jahre eingeschränkte Garantie mit erweitertem RMA-Support; Garantieverlängerung verfügbar.

Nicht ganz das, was Sie brauchen?

Nennen Sie uns Ihren Workload, und wir legen diese Plattform darauf aus – GPUs, Arbeitsspeicher, Storage und Kühlung passend zu Ihrem tatsächlichen Betrieb.