NVIDIA GeForce RTX 4090 24 GB GDDR6X (Generalüberholt)
Plattform in Enterprise-Qualität, in der EU montiert und getestet.
NVIDIA GeForce RTX 4090 — 24 GB für KI im eigenen Rechenzentrum
Eine professionell generalüberholte RTX 4090: 24 GB GDDR6X und Ada-Lovelace-Rechenleistung, unter Dauerlast getestet und auf Stabilität geprüft. Die Arbeitspferd-Karte für Multi-GPU-LLM-Inferenz und Workstation-KI zu einem Bruchteil der Kosten einer Rechenzentrums-GPU.
Das 24-GB-Arbeitspferd für KI-Inferenz
Die RTX 4090 kombiniert 24 GB GDDR6X mit 16,384 Ada-Lovelace-CUDA-Kernen und Tensor-Kernen der 4. Generation — genug VRAM, um quantisierte 7B–13B-Modelle komfortabel bereitzustellen oder ein Modell der 70B-Klasse über zwei bis vier Karten zu betreiben. Sie ist das Preis-Leistungs-Rückgrat der Multi-GPU-KI-Systeme von Kentino. Jedes generalüberholte Exemplar wird vor dem Versand gereinigt, geprüft und einem Stresstest unterzogen.
Technische Daten
| GPU | NVIDIA AD102 — Ada Lovelace |
| Speicher | 24 GB GDDR6X, 384 Bit |
| Speicherbandbreite | ~1,008 GB/s |
| CUDA-Kerne | 16,384 |
| Tensor-Kerne | 512 (4. Generation) · bis zu ~330 TFLOPS FP16 |
| RT-Kerne | 128 (3. Generation) |
| Schnittstelle | PCIe 4.0 ×16 |
| Board-Leistung | 450 W (16-Pin 12VHPWR) |
| Zustand | Generalüberholt — auf dem Prüfstand getestet, Stabilität bestätigt |
Wo sie zum Einsatz kommt
- LLM-Inferenz im eigenen Rechenzentrum — 24 GB nehmen quantisierte 7B–13B-Modelle auf; für 70B lässt sich über mehrere Karten skalieren.
- KI-Workstations und Feintuning kleiner bis mittelgroßer Modelle.
- Rendering, Simulation und Workloads in der Content-Erstellung.
- Kosteneffiziente Multi-GPU-Server dort, wo Rechenzentrums-GPUs überdimensioniert wären.
FAQ
Was bedeutet hier „generalüberholt“?
Die Karte wurde vor dem Versand professionell gereinigt, visuell inspiziert und auf Stabilität sowie volle VRAM-Funktion im Stresstest geprüft. Es handelt sich nicht um Neuware aus dem Handel.
Kann sie ein 70B-Modell ausführen?
Nicht auf einer einzelnen Karte — ein 70B-Modell benötigt bei 4 Bit rund 40 GB VRAM. Zwei bis vier RTX 4090 (48–96 GB insgesamt) bewältigen das über tensor-parallele Inferenz.
Passt sie in einen Standardserver?
Die RTX 4090 ist eine große Triple-Slot-Karte. Sie passt in Tower- und 4U-Rack-Systeme; prüfen Sie im Gehäuse die Slot-Freiräume und die Verfügbarkeit eines 16-Pin-Anschlusses.
Die Fragen, die uns Käufer vor der Bestellung eines Servers am häufigsten stellen.
Wie lange dauert es?
Maschinen aus Komponenten, die wir vorrätig haben, werden schnell versandt; alles, was eine bestimmte GPU-Generation erfordert, hängt von der Verfügbarkeit ab. Wir nennen Ihnen ein Datum, bevor Sie zahlen, und wenn es sich verschiebt, sagen wir es Ihnen, statt Sie es selbst herausfinden zu lassen.
Kann die Konfiguration vor dem Bau noch geändert werden?
Fast immer. GPUs, Arbeitsspeicher, Storage und Kühlung werden je Bestellung ausgewählt, und die angegebene Konfiguration ist ein Ausgangspunkt und kein festes Paket. Wenn Sie mehr VRAM, schnelleren Storage oder ein anderes Kühlkonzept benötigen, sagen Sie es vor der Bestellung – wir kalkulieren die Änderung.
Kann ich den Server persönlich abholen?
Das können Sie. Unser Lager befindet sich in Prag, und die persönliche Abholung ist willkommen – die meisten, die vorbeikommen, nutzen den Besuch, um die Maschine gemeinsam mit unserem Ingenieur durchzugehen und die Fragen zu stellen, die per E-Mail unangenehm sind. Bei Bestellungen innerhalb Tschechiens versuchen wir außerdem, persönlich zu liefern und Sie vor Ort durch die Einrichtung zu führen.
Kann ich mit jemandem sprechen, der den Workload wirklich versteht?
Ja. Bei uns arbeitet ein Ingenieur speziell an KI-Systemen, kein allgemeines Vertriebsteam. Wenn Ihre Frage Batch-Größen, Quantisierung, Interconnect oder die Frage betrifft, wo Ihr Engpass liegen wird, stellen Sie sie — dieses Gespräch verändert die Konfiguration meist zum Besseren.
Welches Modell kann ich auf dieser Konfiguration betreiben?
Ja. Jede Maschine wird montiert, einem Burn-in-Test unterzogen und mit realen KI-Workloads gebenchmarkt, bevor sie ausgeliefert wird — und sie verlässt uns mit einem bereits installierten und laufenden LLM. Sie schließen sie an, verbinden sie mit Ihrem Netzwerk und legen los — die einzige verbleibende Entscheidung ist, welches Projekt zuerst darauf läuft.
Wie testen Sie einen Server vor dem Versand?
Wir testen ihn mit echten KI-Workloads statt mit synthetischen Benchmarks: Inferenz-Durchsatz, Verhalten unter Dauerlast und Thermik im Dauerbetrieb. Die Benchmark-Ergebnisse erhalten Sie zusammen mit der Maschine, sodass Sie die zugesagte Leistung vom ersten Tag an selbst überprüfen können.
Ist der Server bei Lieferung betriebsbereit?
Ja. Jede Maschine wird montiert, einem Burn-in-Test unterzogen und mit realen KI-Workloads gebenchmarkt, bevor sie ausgeliefert wird — und sie verlässt uns mit einem bereits installierten und laufenden LLM. Sie schließen sie an, verbinden sie mit Ihrem Netzwerk und legen los — die einzige verbleibende Entscheidung ist, welches Projekt zuerst darauf läuft.
Versand aus unserem EU-Lager. Schwere Artikel erfordern unter Umständen eine Speditionslieferung — kontaktieren Sie uns für ein Versandangebot und die Lieferzeit. 2 Jahre eingeschränkte Garantie mit erweitertem RMA-Support; Garantieverlängerung verfügbar.
Nicht ganz das, was Sie brauchen?
Nennen Sie uns Ihren Workload, und wir legen diese Plattform darauf aus – GPUs, Arbeitsspeicher, Storage und Kühlung passend zu Ihrem tatsächlichen Betrieb.