DGX Spark Quad AI Cluster, dört Grace Blackwell sistemini switch tabanlı yüksek hızlı ağ mimarisiyle bir araya getirir. Her node, NVIDIA ConnectX-7 üzerinden 200GbE compute ağına; sistem yönetimi ve standart ağ trafiği için ise ayrı 10GbE Ethernet ağına bağlanır. Compute ağı, RoCEv2 tabanlı RDMA iletişimini destekleyerek NCCL ve dağıtık AI iş yüklerinde node’lar arasında yüksek bant genişlikli veri aktarımı sağlar. Böylece AI iletişimi, internet ve yönetim trafiğinden ayrılmış olur.
DGX Spark Quad AI Cluster, dört Grace Blackwell sistemini switch tabanlı yüksek hızlı ağ mimarisiyle bir araya getirir. Her node, NVIDIA ConnectX-7 üzerinden 200GbE compute ağına; sistem yönetimi ve standart ağ trafiği için ise ayrı 10GbE Ethernet ağına bağlanır. Compute ağı, RoCEv2 tabanlı RDMA iletişimini destekleyerek NCCL ve dağıtık AI iş yüklerinde node’lar arasında yüksek bant genişlikli veri aktarımı sağlar. Böylece AI iletişimi, internet ve yönetim trafiğinden ayrılmış olur.




Öne çıkan özellikler
-
4 × NVIDIA GB10 Grace Blackwell sistemi
-
Node başına 128 GB unified system memory
-
Toplam 512 GB dağıtık bellek kapasitesi
-
Node başına 200GbE ConnectX-7 compute bağlantısı
-
RoCEv2 tabanlı RDMA compute iletişimi
-
Node başına 10GbE in-band management bağlantısı
-
Standart 4 TB konfigürasyonda toplam 16 TB yerel NVMe
-
Tensor parallel ve pipeline parallel çalışma senaryolarına uygun
-
NCCL, MPI ve RoCEv2/RDMA tabanlı çok node’lu AI iş yükleri
-
Opsiyonel 64 TB RAW NAS depolama
-
OpenZeka tarafından tasarlanmış çift ağ mimarisi
-
Kurulumsuz teslimat veya OpenZeka tarafından ücretsiz ön kurulum seçeneği
-
Compute, management ve temel cluster bağlantılarının sevkiyat öncesi doğrulanabilmesi
Öne çıkan özellikler
-
4 × NVIDIA GB10 Grace Blackwell sistemi
-
Node başına 128 GB unified system memory
-
Toplam 512 GB dağıtık bellek kapasitesi
-
Node başına 200GbE ConnectX-7 compute bağlantısı
-
RoCEv2 tabanlı RDMA compute iletişimi
-
Node başına 10GbE in-band management bağlantısı
-
Standart 4 TB konfigürasyonda toplam 16 TB yerel NVMe
-
Tensor parallel ve pipeline parallel çalışma senaryolarına uygun
-
NCCL, MPI ve RoCEv2/RDMA tabanlı çok node’lu AI iş yükleri
-
Opsiyonel 64 TB RAW NAS depolama
-
OpenZeka tarafından tasarlanmış çift ağ mimarisi
-
Kurulumsuz teslimat veya OpenZeka tarafından ücretsiz ön kurulum seçeneği
-
Compute, management ve temel cluster bağlantılarının sevkiyat öncesi doğrulanabilmesi

Öne çıkan özellikler
-
4 × NVIDIA GB10 Grace Blackwell sistemi
-
Node başına 128 GB unified system memory
-
Toplam 512 GB dağıtık bellek kapasitesi
-
Node başına 200GbE ConnectX-7 compute bağlantısı
-
RoCEv2 tabanlı RDMA compute iletişimi
-
Node başına 10GbE in-band management bağlantısı
-
Standart 4 TB konfigürasyonda toplam 16 TB yerel NVMe
-
Tensor parallel ve pipeline parallel çalışma senaryolarına uygun
-
NCCL, MPI ve RoCEv2/RDMA tabanlı çok node’lu AI iş yükleri
-
Opsiyonel 64 TB RAW NAS depolama
-
OpenZeka tarafından tasarlanmış çift ağ mimarisi
-
Kurulumsuz teslimat veya OpenZeka tarafından ücretsiz ön kurulum seçeneği
-
Compute, management ve temel cluster bağlantılarının sevkiyat öncesi doğrulanabilmesi
Öne çıkan özellikler
-
4 × NVIDIA GB10 Grace Blackwell sistemi
-
Node başına 128 GB unified system memory
-
Toplam 512 GB dağıtık bellek kapasitesi
-
Node başına 200GbE ConnectX-7 compute bağlantısı
-
RoCEv2 tabanlı RDMA compute iletişimi
-
Node başına 10GbE in-band management bağlantısı
-
Standart 4 TB konfigürasyonda toplam 16 TB yerel NVMe
-
Tensor parallel ve pipeline parallel çalışma senaryolarına uygun
-
NCCL, MPI ve RoCEv2/RDMA tabanlı çok node’lu AI iş yükleri
-
Opsiyonel 64 TB RAW NAS depolama
-
OpenZeka tarafından tasarlanmış çift ağ mimarisi
-
Kurulumsuz teslimat veya OpenZeka tarafından ücretsiz ön kurulum seçeneği
-
Compute, management ve temel cluster bağlantılarının sevkiyat öncesi doğrulanabilmesi
4x NVIDIA DGX Spark Switch Paket İçeriği
Paket, talebe göre standart kutulu ve kurulumsuz olarak veya OpenZeka tarafından ücretsiz ön kurulum tamamlanmış şekilde gönderilebilir. Ön kurulumlu teslimatta compute ve management bağlantıları hazırlanır ve temel sistem kontrolleri gerçekleştirilir.
4x NVIDIA DGX Spark Switch Paket İçeriği
Paket, talebe göre standart kutulu ve kurulumsuz olarak veya OpenZeka tarafından ücretsiz ön kurulum tamamlanmış şekilde gönderilebilir. Ön kurulumlu teslimatta compute ve management bağlantıları hazırlanır ve temel sistem kontrolleri gerçekleştirilir.
4x NVIDIA DGX Spark Switch Bağlantı Şeması
4x NVIDIA DGX Spark Switch Bağlantı Şeması

Özellikler
| Özellik | Değer |
|---|---|
| Node Sayısı | 4 |
| Sistem Platformu | NVIDIA DGX Spark veya seçilen uyumlu GB10 sistemi |
| Toplam Sistem Belleği | 512 GB dağıtık unified memory |
| Node Başına Bellek | 128 GB LPDDR5x |
| Toplam Yerel Depolama | 16 TB NVMe, 4 × 4 TB konfigürasyonda |
| Node Başına AI Performansı | 1 PFLOP’a kadar FP4 |
| Compute Bağlantısı | Node başına 200GbE |
| ConnectX-7 Arayüz Yapısı | İşletim sistemi ve sürücü yapılandırmasına bağlı olarak birden fazla mantıksal arayüz olarak görüntülenebilir |
| In-Band Management | Node başına 10GbE |
| Compute Topolojisi | Ethernet switch tabanlı yıldız topoloji |
| Opsiyonel Paylaşımlı Depolama | 64 TB RAW NAS |
| Paralel Çalışma | Tensor parallel, pipeline parallel, distributed inference |
| İşletim Sistemi | NVIDIA DGX OS veya seçilen sistemin desteklenen NVIDIA yazılım ortamı |
| Compute Protokolü | RoCEv2 üzerinden RDMA destekli Ethernet |
| RDMA Adaptörü | NVIDIA ConnectX-7 |
| Compute Kullanımı | NCCL, model paralelleştirme ve dağıtık inference iletişimi |
| Ağ Ayrımı | 200GbE compute ve 10GbE management ağları ayrı |
| Özellik | Node Başına |
|---|---|
| Mimari | NVIDIA Grace Blackwell |
| Superchip | NVIDIA GB10 |
| GPU | NVIDIA Blackwell |
| CPU | 20 çekirdek Arm, 10 × Cortex-X925 + 10 × Cortex-A725 |
| Tensor Çekirdekleri | 5. Nesil |
| RT Çekirdekleri | 4. Nesil |
| AI Performansı | 1 PFLOP’a kadar FP4 |
| Sistem Belleği | 128 GB LPDDR5x coherent unified memory |
| Bellek Bant Genişliği | 273 GB/s’ye kadar |
| Depolama | 4 TB NVMe M.2 |
| Standart Ethernet | 10GbE RJ45 |
| Yüksek Hızlı NIC | ConnectX-7 |
| Kablosuz | Wi-Fi 7 |
| Bluetooth | Bluetooth 5.4 |
| USB | 4 × USB Type-C |
| Görüntü Çıkışı | HDMI 2.1a |
| İşletim Sistemi | NVIDIA DGX OS |
| Boyut | 150 × 150 × 50,5 mm |
| Ağırlık | Yaklaşık 1,2 kg |
| Bileşen | Görev |
|---|---|
| MikroTik CRS812 | RoCEv2 compute trafiğini taşıyan yüksek hızlı Ethernet switch |
| FS QDD-400G-2QPC015 | 400G QSFP-DD → 2 × 200G QSFP56 breakout |
| Kablo Sayısı | 2 |
| Kablo Uzunluğu | 1,5 m (1m Opsiyonlu) |
| MikroTik CRS312 | Management, internet, SSH ve NAS trafiği |
| Spark Management Kabloları | 6 × Cat6 |
| Compute Bağlantısı | Spark başına 200GbE |
| Management Bağlantısı | Spark başına 10GbE |
| RoCEv2/RDMA | Spark node’ları arasında yüksek hızlı compute iletişimi |
| NVIDIA ConnectX-7 | RoCEv2 ve RDMA destekli node ağ adaptörü |
| Özellik | Örnek Konfigürasyon |
|---|---|
| NAS | ASUSTOR Lockerstor AS6808T |
| Disk Yuvası | 8 |
| Standart Disk Konfigürasyonu | 8 × 8 TB |
| Örnek Disk Modeli | Western Digital WD80EFPX-68C4ZN0 |
| RAW Kapasite | 64 TB |
| RAID Seçenekleri | RAID 0, RAID 5, RAID 6 ve cihazın desteklediği diğer seviyeler |
| Ağ Bağlantısı | 2 × Ethernet, IEEE 802.3ad LACP bonding |
| Bağlandığı Ağ | MikroTik CRS312 management/storage ağı |
| Özelleştirme | Disk markası, model numarası ve kapasitesi değiştirilebilir |
Kurulum
DGX Spark Quad AI Cluster kurulumu; fiziksel bağlantıların yapılması, compute switch portlarının hazırlanması, 200 Gbps link hızının doğrulanması, management ve compute ağlarının ayrılması, node IP adreslerinin yapılandırılması, SSH erişiminin hazırlanması ve çoklu node iletişiminin test edilmesi aşamalarından oluşur.
Ücretsiz ön kurulum tercih edildiğinde OpenZeka tarafından:
-
Compute ve management ağları hazırlanır
-
MikroTik CRS812 ve CRS312 temel yapılandırmaları yapılır
-
200GbE compute bağlantıları doğrulanır
-
ConnectX-7 ve RoCEv2/RDMA cihaz görünürlüğü kontrol edilir
-
Node’lar arası temel erişim hazırlanır
-
SSH ve temel cluster iletişimi test edilir
-
NCCL iletişim doğrulaması gerçekleştirilir
Kurulum
DGX Spark Quad AI Cluster kurulumu; fiziksel bağlantıların yapılması, compute switch portlarının hazırlanması, 200 Gbps link hızının doğrulanması, management ve compute ağlarının ayrılması, node IP adreslerinin yapılandırılması, SSH erişiminin hazırlanması ve çoklu node iletişiminin test edilmesi aşamalarından oluşur.
Ücretsiz ön kurulum tercih edildiğinde OpenZeka tarafından:
-
Compute ve management ağları hazırlanır
-
MikroTik CRS812 ve CRS312 temel yapılandırmaları yapılır
-
200GbE compute bağlantıları doğrulanır
-
ConnectX-7 ve RoCEv2/RDMA cihaz görünürlüğü kontrol edilir
-
Node’lar arası temel erişim hazırlanır
-
SSH ve temel cluster iletişimi test edilir
-
NCCL iletişim doğrulaması gerçekleştirilir
Hangi Cluster Boyutu?
Hangi Cluster Boyutu?
Performans Testleri
Aşağıdaki sonuçlar, OpenZeka tarafından farklı NVIDIA DGX Spark topolojilerinde gerçekleştirilen testlerden alınmıştır. Tüm ölçümler Concurrency = 1, Mean istatistiği ile verilmiştir.
1, 2, 3, 4 ve 8 NVIDIA DGX Spark sonuçlarının birlikte sunulmasının amacı, kullanıcıların çalıştıracakları modele, paralelleştirme yöntemine ve performans beklentisine göre uygun cluster boyutunu karşılaştırabilmesini sağlamaktır.
TP, tensor parallelism; PP, pipeline parallelism anlamına gelir. Boş alanlar ilgili model ve topoloji için ölçüm bulunmadığını veya bu konfigürasyonun ilgili modele uygulanamadığını gösterir.
Üretim Hızı, TPS
Yüksek değer daha iyidir.
| Model | 1x DGX Spark | 2x DGX Spark Bundle | 3x DGX Spark Triple | 4x DGX Spark Quad | 8x DGX Spark |
|---|---|---|---|---|---|
| gemma-4-31B-it-NVFP4 | 10,81 | 19,42 | N/T | 30,53 | 36,93 |
| Qwen3.6-27B-NVFP4 | 12,63 | 22,57 | N/T | 33,11 | 33,99 |
| Qwen3.6-35B-A3B-NVFP4 | 64,52 | 91,95 | N/T | 91,16 | N/T |
| MiniMax-M2.7-NVFP4, PP | OOM | 17,20, PP-2 | 18,04, PP-3 | N/T | N/T |
| MiniMax-M2.7-NVFP4, TP | OOM | 26,64 | TP3-N/A | N/T | N/T |
| Qwen3.5-397B-A17B-int4 | OOM | OOM | 17,05 | 38,14 | N/T |
| glm-5.2-int4 | OOM | OOM | OOM | 20,16 | N/T |
| glm-5.2-nvfp4 | OOM | OOM | OOM | OOM | 24,86 |
*OOM = Bellek yetersiz
*N/T = Test edilmedi
*TP3-N/A = TP3 denenemez
İlk Token Süresi, TTFT
Düşük değer daha iyidir.
| Model | 1x DGX Spark | 2x DGX Spark Bundle | 3x DGX Spark Triple | 4x DGX Spark Quad | 8x DGX Spark |
|---|---|---|---|---|---|
| gemma-4-31B-it-NVFP4 | 201,96 ms | 136,35 ms | N/T | 279,77 ms | 326,54 ms |
| Qwen3.6-27B-NVFP4 | 233,30 ms | 148,87 ms | N/T | 163,59 ms | 263,59 ms |
| Qwen3.6-35B-A3B-NVFP4 | 500,24 ms | 165,31 ms | N/T | 230,82 ms | N/T |
| MiniMax-M2.7-NVFP4, PP | OOM | 396,35 ms, PP-2 | 211,39 ms, PP-3 | N/T | N/T |
| MiniMax-M2.7-NVFP4, TP | OOM | 288,98 ms | TP3-N/A | N/T | N/T |
| Qwen3.5-397B-A17B-int4 | OOM | OOM | 499,65 ms | 324,61 ms | N/T |
| glm-5.2-int4 | OOM | OOM | OOM | 571,82 ms | N/T |
| glm-5.2-nvfp4 | OOM | OOM | OOM | OOM | 451,23 ms |
*OOM = Bellek yetersiz
*N/T = Test edilmedi
*TP3-N/A = TP3 denenemez
Sonuçlar, test edilen model, quantization, yazılım sürümü ve çalışma parametrelerine aittir. Context uzunluğu, prompt uzunluğu, üretim token sayısı, batch büyüklüğü, KV cache ihtiyacı, paralelleştirme yöntemi ve ağ iletişim maliyeti sonuçları değiştirebilir.
Daha fazla Spark kullanılması her modelde doğrusal TPS artışı veya daha düşük TTFT sağlamaz. Bazı modeller hesaplama kapasitesinden yararlanırken bazı iş yüklerinde node’lar arası iletişim maliyeti daha belirleyici hâle gelebilir.
Cluster boyutu yalnızca en yüksek token/s değerine göre seçilmemelidir. Modelin belleğe sığması, desteklediği paralelleştirme yöntemi, hedef context uzunluğu ve eşzamanlı kullanıcı sayısı da değerlendirilmelidir.
Bu değerler garanti edilen minimum performans değerleri değil, OpenZeka tarafından test edilen konfigürasyonların referans sonuçlarıdır.













