Quartals-Ranking · Stand: Juni 2026
Top 5: KI-Hardware für den Arbeitsplatz
Unsere Marktbeobachtungen im Juni 2026
Auf der Computex 2026 Anfang Juni stellte NVIDIA die DGX Station mit GB300-Superchip als Deskside-System vor; Partner wie ASUS, Dell, GIGABYTE, HP, MSI und Supermicro bauen entsprechende Geräte. Für den Mittelstand bleibt sie bewusst außerhalb dieser Kategorie: Als Deskside-Supercomputer für Modelle im Billionen-Parameter-Bereich liegt sie preislich weit oberhalb des Einzelplatz-Budgets und zielt auf rechenzentrumsnahe Einsätze. Sie markiert die Obergrenze, ersetzt aber keinen der gelisteten Arbeitsplatz-Beschleuniger.
Die für 2026 erwartete Mac-Studio-Neuauflage mit M5 Ultra verschiebt sich Berichten zufolge in den Herbst; als Grund gilt die angespannte Lage am Speichermarkt (DRAM-Knappheit infolge der KI-Nachfrage). Für das Berichtsquartal bleibt damit der Mac Studio mit M3 Ultra die aktuelle, im DACH-Fachhandel verfügbare Apple-Option; sein verfügbarer Höchstspeicher fiel allerdings auf 96 GB, seit Apple die größeren 256- und 512-GB-Konfigurationen im Frühjahr 2026 gestrichen hat.
Ökosystem-Reife
Nicht die schnellste Karte gewinnt, sondern die, deren Software-Stack im Alltag trägt, die eigentliche K.-o.-Achse für ein Team ohne KI-Spezialisten.
-
CUDA NVIDIA
-
MLX Apple
-
ROCm AMD
Rangverlauf
März–Juni 2026
- NVIDIAGeForce RTX 5090
- AMDRadeon AI PRO R9700
| Tool | März 2026 | Juni 2026 |
|---|---|---|
| RTX PRO 6000 Blackwell Workstation Edition | 1 | 1 |
| Mac Studio | 2 | 2 |
| DGX Spark | 3 | 3 |
| RTX 6000 Ada Generation | 4 | 4 |
| Ryzen AI Max+ 395 | 5 | 5 |
Direktvergleich der Kandidaten
| Entscheidung | Datenblatt | ||||||
|---|---|---|---|---|---|---|---|
| Gerät | Software | Größtes Modell | Tempo | Speicher | Bandbreite | Leistung | Verbrauch |
| RTX PRO 6000 Blackwell Workstation EditionNVIDIA | CUDATensorRT-LLM | 100B+ (Q4)70B (FP16) | Schnell | 96GB GDDR7 ECC | 1.792GB/s Spitzenwert | 503,8TFLOPS Spitzenwert | 600W |
| Mac StudioApple | MLXllama.cpp (Metal) | bis ~120B (Q4) | Mittel | 96GB unified (LPDDR5x) | 819GB/s | – | 180W |
| DGX SparkNVIDIA | CUDADGX OS, TensorRT-LLM | bis ~200B (Q4)70B (FP16) | Langsam | 128GB unified (LPDDR5x) Spitzenwert | 273GB/s | – | 240W |
| RTX 6000 Ada GenerationNVIDIA | CUDATensorRT-LLM | 70B (Q4) | Schnell | 48GB GDDR6 ECC | 960GB/s | 364TFLOPS | 300W |
| Ryzen AI Max+ 395AMD | ROCmllama.cpp (Vulkan) | 70B (Q4)bis 96 GB als VRAM zuweisbar | Mittel | 128GB unified (LPDDR5x-8000) Spitzenwert | 256GB/s | – | 120W |
Bewertung und Begründung
-
RTX PRO 6000 Blackwell Workstation Edition
Rang 1 unverändert gegenüber der Vorausgabe 2026-03. Die Quartalsrecherche ergab keinen neuen, on-prem beziehbaren Arbeitsplatz-Beschleuniger, der die Karte an den gewichteten Kriterien überholt; sie bleibt das aktuelle Workstation-Spitzenmodell.
- Ausgereiftes CUDA-Ökosystem mit breiter Runtime-Unterstützung; auch ohne eigenes KI-Team im Alltag betreibbar (Kriterium Software-Reife).
- 96 GB GDDR7 tragen Modelle bis über 100 Milliarden Parameter in Q4 oder 70B in voller FP16-Präzision (Kriterium Speicherkapazität).
- 1.792 GB/s Speicherbandbreite und rund 500 TFLOPS dichte FP16-Leistung sichern hohes Antworttempo und Mehrnutzer-Betrieb (Kriterium Bandbreite).
- Betriebsform
- Einbaukarte
- Support DACH
- Business
- Büro-Geräusch
- Moderat
-
Mac Studio
Rang 2 unverändert. Die erwartete M5-Ultra-Neuauflage verschob sich ins zweite Halbjahr, weshalb der Mac Studio mit M3 Ultra im Berichtsquartal die aktuelle Apple-Option bleibt; keine Verschiebung an den gewichteten Kriterien.
- 96 GB vereinheitlichter Speicher tragen Modelle bis rund 120B in Q4 lokal (Kriterium Speicherkapazität).
- 819 GB/s Speicherbandbreite, die höchste unter den Geräten mit vereinheitlichtem Speicher im Feld, stützen das Antworttempo bei der Inferenz (Kriterium Bandbreite).
- MLX ist für Apple-Silizium nutzbar, erreicht im Alltag aber noch nicht die Werkzeugbreite von CUDA (Kriterium Software-Reife).
- Betriebsform
- Komplettgerät
- Support DACH
- Consumer
- Büro-Geräusch
- Leise
-
DGX Spark
Rang 3 unverändert. Die Auslieferung über OEM-Partner lief im Quartal weiter, an Speicher, Bandbreite und Software-Stack änderte sich nichts Wertungsrelevantes; die Appliance bleibt gegenüber der Vorausgabe stabil.
- Voller CUDA-Softwarestack als schlüsselfertige Appliance, ohne Serverraum betreibbar (Kriterium Software-Reife).
- 128 GB vereinheitlichter Speicher tragen Modelle bis rund 200 Milliarden Parameter (Kriterium Speicherkapazität).
- 273 GB/s Speicherbandbreite begrenzen das Antworttempo bei großen Modellen spürbar (Kriterium Bandbreite).
- Betriebsform
- Komplettgerät
- Support DACH
- Enterprise
- Büro-Geräusch
- Leise
-
RTX 6000 Ada Generation
Rang 4 unverändert. Die etablierte CUDA-Karte bleibt breit über DACH-Fachhandel verfügbar; im Berichtsquartal gab es keine kriterienrelevante Neuerung, die ihre relative Position verschiebt.
- Etablierter CUDA-Stack, seit Jahren erprobt und von nahezu allen Runtimes unterstützt (Kriterium Software-Reife).
- Breit über DACH-Workstation-Fachhandel und Integratoren verfügbar (Kriterium On-Prem-Verfügbarkeit).
- 48 GB GDDR6 begrenzen das lokal sinnvoll betreibbare Modell auf rund 70B in Q4 (Kriterium Speicherkapazität).
- Betriebsform
- Einbaukarte
- Support DACH
- Business
- Büro-Geräusch
- Moderat
-
Ryzen AI Max+ 395
Rang 5 unverändert. Das ROCm-Ökosystem reifte im Umfeld weiter (offizielle RDNA-4-Unterstützung), die offizielle Werkzeug-Unterstützung speziell für Strix Halo stand im Quartal aber noch aus; Position gegenüber der Vorausgabe stabil.
- 128 GB vereinheitlichter Speicher, davon bis 96 GB als VRAM zuweisbar, tragen Modelle bis rund 70B (Kriterium Speicherkapazität).
- Die offizielle ROCm-Unterstützung für Strix Halo (gfx1151) stand im Berichtsquartal noch aus und verlangt manuelle Einrichtung samt Umgebungsvariablen (Kriterium Software-Reife).
- Als Mini-PC über Framework und die AMD-Entwicklerplattform im DACH-Raum beschaffbar (Kriterium On-Prem-Verfügbarkeit).
- Betriebsform
- Komplettgerät
- Support DACH
- Consumer
- Büro-Geräusch
- Leise
Methodik & Transparenz
Diese Rankings dienen der Marktorientierung. Sie sind ein redaktioneller, kostenloser Überblick auf Basis öffentlich verfügbarer Herstellerdaten, keine abschließende oder absolute Bewertung. Jede Ausgabe ist eine Momentaufnahme; der Markt verändert sich, und die Auswahl erhebt keinen Anspruch auf Vollständigkeit. Bewertet wird ausschließlich anhand der je Kategorie veröffentlichten Kriterien; ein eigener Labortest findet nicht statt. Die vergleichende Einordnung ist unsere redaktionelle Meinung, keine Tatsachenbehauptung über die Eignung einzelner Produkte, und sie wertet keinen Anbieter pauschal ab. Sie ersetzt keine eigene Prüfung. Stand: 16.07.2026.
Bei Recherche und Zusammenfassung kommen KI-Technologien zum Einsatz. Auswahl, Einordnung und Veröffentlichung werden von einer Person geprüft, freigegeben und redaktionell verantwortet. Genannte Produkt-, Marken- und Unternehmensnamen sind Eigentum der jeweiligen Inhaber; ihre Nennung dient allein der Information und Identifikation und bedeutet weder eine Empfehlung noch eine geschäftliche Verbindung zu diesen Anbietern. FORGEINITY hostet oder vervielfältigt keine fremden Inhalte, sondern verweist auf die Originalquellen.
Preise weisen wir bewusst nicht aus: Sie ändern sich laufend, wären zwischen zwei Ausgaben überholt und fließen ohnehin nicht in Rang oder Sterne ein. Maßgeblich ist das Angebot des jeweiligen Anbieters oder Integrators. Soweit wir auf externe Seiten verlinken, sind für deren Inhalte ausschließlich die jeweiligen Betreiber verantwortlich. Unabhängigkeit: Kein Anbieter hat für Platzierung oder Bewertung bezahlt; es bestehen keine Provisions-, Affiliate- oder Werbevereinbarungen. FORGEINITY arbeitet technologie-offen und bewertet ausschließlich anhand der veröffentlichten Kriterien. Alle Angaben erfolgen ohne Gewähr; eine Haftung für Richtigkeit, Vollständigkeit oder für Entscheidungen, die auf Grundlage dieser Rankings getroffen werden, ist ausgeschlossen.
Rechteinhaber, Betroffene und Dritte können eine Korrektur oder Entfernung einzelner Angaben unter legal@forgeinity.com anfragen oder einen rechtswidrigen verlinkten Inhalt melden. Wir prüfen berechtigte Hinweise und reagieren zeitnah.
Bewertet wird anhand dieser Kriterien (nach Gewicht geordnet):
- Software-Reife und Ökosystem (bewertet, ob ein Betrieb ohne eigenes KI-Team die Hardware im Alltag betreiben kann: Reife des Software-Stacks wie CUDA, ROCm, MLX oder oneAPI und die Unterstützung durch verbreitete lokale Runtimes)
- Speicherkapazität und größtes betreibbares Modell (bewertet, wie groß das lokal sinnvoll betreibbare KI-Modell ist, abgeleitet aus dem verfügbaren Grafik- oder vereinheitlichten Speicher samt Quantisierung)
- Speicherbandbreite (bewertet die für das Antworttempo bei der Inferenz entscheidende Datenrate zwischen Recheneinheit und Speicher; sie ist bei der Texterzeugung der begrenzende Faktor, weil für jedes Token die Modellgewichte einmal vollständig gelesen werden)
- On-Prem-Verfügbarkeit und DACH-Beschaffung (bewertet die reale Kaufbarkeit, Lieferbarkeit und den Support über deutsche Integratoren und Fachhandel)