NVIDIA DGX Spark Quad AI Cluster

Dağıtık inference, büyük dil modelleri ve yüksek hızlı AI iletişimi için tasarlanmış, 200GbE RoCEv2 compute ağına sahip profesyonel dört node AI altyapısı.

NVIDIA DGX Spark Quad AI Cluster

Dağıtık inference, büyük dil modelleri ve yüksek hızlı AI iletişimi için tasarlanmış, 200GbE RoCEv2 compute ağına sahip profesyonel dört node AI altyapısı.

DGX Spark Quad AI Cluster, dört Grace Blackwell sistemini switch tabanlı yüksek hızlı ağ mimarisiyle bir araya getirir. Her node, NVIDIA ConnectX-7 üzerinden 200GbE compute ağına; sistem yönetimi ve standart ağ trafiği için ise ayrı 10GbE Ethernet ağına bağlanır. Compute ağı, RoCEv2 tabanlı RDMA iletişimini destekleyerek NCCL ve dağıtık AI iş yüklerinde node’lar arasında yüksek bant genişlikli veri aktarımı sağlar. Böylece AI iletişimi, internet ve yönetim trafiğinden ayrılmış olur.

DGX Spark Quad AI Cluster, dört Grace Blackwell sistemini switch tabanlı yüksek hızlı ağ mimarisiyle bir araya getirir. Her node, NVIDIA ConnectX-7 üzerinden 200GbE compute ağına; sistem yönetimi ve standart ağ trafiği için ise ayrı 10GbE Ethernet ağına bağlanır. Compute ağı, RoCEv2 tabanlı RDMA iletişimini destekleyerek NCCL ve dağıtık AI iş yüklerinde node’lar arasında yüksek bant genişlikli veri aktarımı sağlar. Böylece AI iletişimi, internet ve yönetim trafiğinden ayrılmış olur.

Öne çıkan özellikler

  • 4 × NVIDIA GB10 Grace Blackwell sistemi

  • Node başına 128 GB unified system memory

  • Toplam 512 GB dağıtık bellek kapasitesi

  • Node başına 200GbE ConnectX-7 compute bağlantısı

  • RoCEv2 tabanlı RDMA compute iletişimi

  • Node başına 10GbE in-band management bağlantısı

  • Standart 4 TB konfigürasyonda toplam 16 TB yerel NVMe

  • Tensor parallel ve pipeline parallel çalışma senaryolarına uygun

  • NCCL, MPI ve RoCEv2/RDMA tabanlı çok node’lu AI iş yükleri

  • Opsiyonel 64 TB RAW NAS depolama

  • OpenZeka tarafından tasarlanmış çift ağ mimarisi

  • Kurulumsuz teslimat veya OpenZeka tarafından ücretsiz ön kurulum seçeneği

  • Compute, management ve temel cluster bağlantılarının sevkiyat öncesi doğrulanabilmesi

Öne çıkan özellikler

  • 4 × NVIDIA GB10 Grace Blackwell sistemi

  • Node başına 128 GB unified system memory

  • Toplam 512 GB dağıtık bellek kapasitesi

  • Node başına 200GbE ConnectX-7 compute bağlantısı

  • RoCEv2 tabanlı RDMA compute iletişimi

  • Node başına 10GbE in-band management bağlantısı

  • Standart 4 TB konfigürasyonda toplam 16 TB yerel NVMe

  • Tensor parallel ve pipeline parallel çalışma senaryolarına uygun

  • NCCL, MPI ve RoCEv2/RDMA tabanlı çok node’lu AI iş yükleri

  • Opsiyonel 64 TB RAW NAS depolama

  • OpenZeka tarafından tasarlanmış çift ağ mimarisi

  • Kurulumsuz teslimat veya OpenZeka tarafından ücretsiz ön kurulum seçeneği

  • Compute, management ve temel cluster bağlantılarının sevkiyat öncesi doğrulanabilmesi

Öne çıkan özellikler

  • 4 × NVIDIA GB10 Grace Blackwell sistemi

  • Node başına 128 GB unified system memory

  • Toplam 512 GB dağıtık bellek kapasitesi

  • Node başına 200GbE ConnectX-7 compute bağlantısı

  • RoCEv2 tabanlı RDMA compute iletişimi

  • Node başına 10GbE in-band management bağlantısı

  • Standart 4 TB konfigürasyonda toplam 16 TB yerel NVMe

  • Tensor parallel ve pipeline parallel çalışma senaryolarına uygun

  • NCCL, MPI ve RoCEv2/RDMA tabanlı çok node’lu AI iş yükleri

  • Opsiyonel 64 TB RAW NAS depolama

  • OpenZeka tarafından tasarlanmış çift ağ mimarisi

  • Kurulumsuz teslimat veya OpenZeka tarafından ücretsiz ön kurulum seçeneği

  • Compute, management ve temel cluster bağlantılarının sevkiyat öncesi doğrulanabilmesi

Öne çıkan özellikler

  • 4 × NVIDIA GB10 Grace Blackwell sistemi

  • Node başına 128 GB unified system memory

  • Toplam 512 GB dağıtık bellek kapasitesi

  • Node başına 200GbE ConnectX-7 compute bağlantısı

  • RoCEv2 tabanlı RDMA compute iletişimi

  • Node başına 10GbE in-band management bağlantısı

  • Standart 4 TB konfigürasyonda toplam 16 TB yerel NVMe

  • Tensor parallel ve pipeline parallel çalışma senaryolarına uygun

  • NCCL, MPI ve RoCEv2/RDMA tabanlı çok node’lu AI iş yükleri

  • Opsiyonel 64 TB RAW NAS depolama

  • OpenZeka tarafından tasarlanmış çift ağ mimarisi

  • Kurulumsuz teslimat veya OpenZeka tarafından ücretsiz ön kurulum seçeneği

  • Compute, management ve temel cluster bağlantılarının sevkiyat öncesi doğrulanabilmesi

4x NVIDIA DGX Spark Switch Paket İçeriği

Paket, talebe göre standart kutulu ve kurulumsuz olarak veya OpenZeka tarafından ücretsiz ön kurulum tamamlanmış şekilde gönderilebilir. Ön kurulumlu teslimatta compute ve management bağlantıları hazırlanır ve temel sistem kontrolleri gerçekleştirilir.

Standart Paket

  • 4 × NVIDIA DGX Spark veya seçilen uyumlu GB10 sistemi

  • 4 × Sistem güç adaptörü

  • 1 × MikroTik CRS812 compute network switch

  • 1 × CRS812 güç bağlantı seti

  • 2 × 1.5m FS 400G QSFP-DD → 2 × 200G QSFP56 pasif bakır breakout kablo (1m Opsiyonlu)

  • 1 × MikroTik CRS312 10GbE in-band management switch

  • 1 × CRS312 güç kablosu

  • 6 × Cat6 10GbE Ethernet kablosu

Opsiyonel NAS Paketi

  • 1 × ASUSTOR Lockerstor AS6808T NAS

  • 8 × 8 TB NAS HDD

  • 2 × Cat6 Ethernet kablosu

  • Seçilen RAID yapılandırması

4x NVIDIA DGX Spark Switch Paket İçeriği

Paket, talebe göre standart kutulu ve kurulumsuz olarak veya OpenZeka tarafından ücretsiz ön kurulum tamamlanmış şekilde gönderilebilir. Ön kurulumlu teslimatta compute ve management bağlantıları hazırlanır ve temel sistem kontrolleri gerçekleştirilir.

Standart Paket

  • 4 × NVIDIA DGX Spark veya seçilen uyumlu GB10 sistemi

  • 4 × Sistem güç adaptörü

  • 1 × MikroTik CRS812 compute network switch

  • 1 × CRS812 güç bağlantı seti

  • 2 × 1.5m FS 400G QSFP-DD → 2 × 200G QSFP56 pasif bakır breakout kablo (1m Opsiyonlu)

  • 1 × MikroTik CRS312 10GbE in-band management switch

  • 1 × CRS312 güç kablosu

  • 6 × Cat6 10GbE Ethernet kablosu

Opsiyonel NAS Paketi

  • 1 × ASUSTOR Lockerstor AS6808T NAS

  • 8 × 8 TB NAS HDD

  • 2 × Cat6 Ethernet kablosu

  • Seçilen RAID yapılandırması

4x NVIDIA DGX Spark Switch Bağlantı Şeması

4x NVIDIA DGX Spark Switch Bağlantı Şeması

Özellikler

Kurulum

DGX Spark Quad AI Cluster kurulumu; fiziksel bağlantıların yapılması, compute switch portlarının hazırlanması, 200 Gbps link hızının doğrulanması, management ve compute ağlarının ayrılması, node IP adreslerinin yapılandırılması, SSH erişiminin hazırlanması ve çoklu node iletişiminin test edilmesi aşamalarından oluşur.

Standart Paket

Kurulumsuz teslimatta DGX Spark sistemleri, switch’ler ve bağlantı kabloları standart paket içeriğiyle gönderilir. Fiziksel kurulum, switch yapılandırması, IP adresleme, RoCEv2/RDMA ayarları, SSH erişimi ve cluster doğrulaması müşteri tarafından gerçekleştirilir.

Ücretsiz Ön Kurulum

Müşteri, cluster kurulumunu kendi gerçekleştirebilir veya OpenZeka’nın ücretsiz ön kurulum hizmetinden yararlanabilir.

Ücretsiz ön kurulum tercih edildiğinde OpenZeka tarafından:

  • Compute ve management ağları hazırlanır

  • MikroTik CRS812 ve CRS312 temel yapılandırmaları yapılır

  • 200GbE compute bağlantıları doğrulanır

  • ConnectX-7 ve RoCEv2/RDMA cihaz görünürlüğü kontrol edilir

  • Node’lar arası temel erişim hazırlanır

  • SSH ve temel cluster iletişimi test edilir

  • NCCL iletişim doğrulaması gerçekleştirilir

Sistem, müşteri ortamındaki nihai IP, VLAN, DNS, NTP, internet ve güvenlik ayarları tamamlanmak üzere hazır şekilde gönderilir.

OpenZeka’nın ücretsiz ön kurulum hizmeti; standart ağ hazırlığı, node erişimi, 200GbE bağlantı kontrolü, RoCEv2/RDMA cihaz doğrulaması, NCCL iletişim testi ve temel cluster sağlık kontrolünü kapsar. Müşteriye özel yazılım, model, güvenlik ve entegrasyon çalışmaları ayrıca kapsamlandırılır.

Kurulum

DGX Spark Quad AI Cluster kurulumu; fiziksel bağlantıların yapılması, compute switch portlarının hazırlanması, 200 Gbps link hızının doğrulanması, management ve compute ağlarının ayrılması, node IP adreslerinin yapılandırılması, SSH erişiminin hazırlanması ve çoklu node iletişiminin test edilmesi aşamalarından oluşur.

Standart Paket

Kurulumsuz teslimatta DGX Spark sistemleri, switch’ler ve bağlantı kabloları standart paket içeriğiyle gönderilir. Fiziksel kurulum, switch yapılandırması, IP adresleme, RoCEv2/RDMA ayarları, SSH erişimi ve cluster doğrulaması müşteri tarafından gerçekleştirilir.

Ücretsiz Ön Kurulum

Müşteri, cluster kurulumunu kendi gerçekleştirebilir veya OpenZeka’nın ücretsiz ön kurulum hizmetinden yararlanabilir.

Ücretsiz ön kurulum tercih edildiğinde OpenZeka tarafından:

  • Compute ve management ağları hazırlanır

  • MikroTik CRS812 ve CRS312 temel yapılandırmaları yapılır

  • 200GbE compute bağlantıları doğrulanır

  • ConnectX-7 ve RoCEv2/RDMA cihaz görünürlüğü kontrol edilir

  • Node’lar arası temel erişim hazırlanır

  • SSH ve temel cluster iletişimi test edilir

  • NCCL iletişim doğrulaması gerçekleştirilir

Sistem, müşteri ortamındaki nihai IP, VLAN, DNS, NTP, internet ve güvenlik ayarları tamamlanmak üzere hazır şekilde gönderilir.

OpenZeka’nın ücretsiz ön kurulum hizmeti; standart ağ hazırlığı, node erişimi, 200GbE bağlantı kontrolü, RoCEv2/RDMA cihaz doğrulaması, NCCL iletişim testi ve temel cluster sağlık kontrolünü kapsar. Müşteriye özel yazılım, model, güvenlik ve entegrasyon çalışmaları ayrıca kapsamlandırılır.

Hangi Cluster Boyutu?

1x NVIDIA DGX Spark

Tek node’a sığan modeller, geliştirme ve düşük eşzamanlı inference

2x NVIDIA DGX Spark Bundle

İki node’lu tensor/pipeline parallel senaryoları ve daha yüksek toplam bellek kapasitesi

3x NVIDIA DGX Spark Triple

Üç node’lu TP/PP senaryoları ve switch gerektirmeyen kompakt yapı

4x NVIDIA DGX Spark Quad

Dört node’lu TP/PP, daha büyük modeller ve merkezi compute fabric

8x NVIDIA DGX Spark 

Daha yüksek toplam bellek ihtiyacı ve sekiz node’u destekleyen dağıtık iş yükleri

Hangi Cluster Boyutu?

1x DGX Spark

Tek node’a sığan modeller, geliştirme ve düşük eşzamanlı inference

2x DGX Spark Bundle

İki node’lu tensor/pipeline parallel senaryoları ve daha yüksek toplam bellek kapasitesi

3x DGX Spark Triple

Üç node’lu TP/PP senaryoları ve switch gerektirmeyen kompakt yapı

4x DGX Spark Quad

Dört node’lu TP/PP, daha büyük modeller ve merkezi compute fabric

8x DGX Spark Quad

Dört node’lu TP/PP, daha büyük modeller ve merkezi compute fabric

Performans Testleri

Aşağıdaki sonuçlar, OpenZeka tarafından farklı NVIDIA DGX Spark topolojilerinde gerçekleştirilen testlerden alınmıştır. Tüm ölçümler Concurrency = 1, Mean istatistiği ile verilmiştir.

1, 2, 3, 4 ve 8 NVIDIA DGX Spark sonuçlarının birlikte sunulmasının amacı, kullanıcıların çalıştıracakları modele, paralelleştirme yöntemine ve performans beklentisine göre uygun cluster boyutunu karşılaştırabilmesini sağlamaktır.

TP, tensor parallelism; PP, pipeline parallelism anlamına gelir. Boş alanlar ilgili model ve topoloji için ölçüm bulunmadığını veya bu konfigürasyonun ilgili modele uygulanamadığını gösterir.

Üretim Hızı, TPS

Yüksek değer daha iyidir.

Model1x DGX Spark2x DGX Spark Bundle3x DGX Spark Triple4x DGX Spark Quad8x DGX Spark
gemma-4-31B-it-NVFP410,8119,42N/T30,5336,93
Qwen3.6-27B-NVFP412,6322,57N/T33,1133,99
Qwen3.6-35B-A3B-NVFP464,5291,95N/T91,16N/T
MiniMax-M2.7-NVFP4, PPOOM17,20, PP-218,04, PP-3N/TN/T
MiniMax-M2.7-NVFP4, TPOOM26,64TP3-N/AN/TN/T
Qwen3.5-397B-A17B-int4OOMOOM17,0538,14N/T
glm-5.2-int4OOMOOMOOM20,16N/T
glm-5.2-nvfp4OOMOOMOOMOOM24,86

*OOM = Bellek yetersiz
*N/T = Test edilmedi
*TP3-N/A = TP3 denenemez

İlk Token Süresi, TTFT

Düşük değer daha iyidir.

Model1x DGX Spark2x DGX Spark Bundle3x DGX Spark Triple4x DGX Spark Quad8x DGX Spark
gemma-4-31B-it-NVFP4201,96 ms136,35 msN/T279,77 ms326,54 ms
Qwen3.6-27B-NVFP4233,30 ms148,87 msN/T163,59 ms263,59 ms
Qwen3.6-35B-A3B-NVFP4500,24 ms165,31 msN/T230,82 msN/T
MiniMax-M2.7-NVFP4, PPOOM396,35 ms, PP-2211,39 ms, PP-3N/TN/T
MiniMax-M2.7-NVFP4, TPOOM288,98 msTP3-N/AN/TN/T
Qwen3.5-397B-A17B-int4OOMOOM499,65 ms324,61 msN/T
glm-5.2-int4OOMOOMOOM571,82 msN/T
glm-5.2-nvfp4OOMOOMOOMOOM451,23 ms

*OOM = Bellek yetersiz
*N/T = Test edilmedi
*TP3-N/A = TP3 denenemez

Sonuçlar, test edilen model, quantization, yazılım sürümü ve çalışma parametrelerine aittir. Context uzunluğu, prompt uzunluğu, üretim token sayısı, batch büyüklüğü, KV cache ihtiyacı, paralelleştirme yöntemi ve ağ iletişim maliyeti sonuçları değiştirebilir.

Daha fazla Spark kullanılması her modelde doğrusal TPS artışı veya daha düşük TTFT sağlamaz. Bazı modeller hesaplama kapasitesinden yararlanırken bazı iş yüklerinde node’lar arası iletişim maliyeti daha belirleyici hâle gelebilir.

Cluster boyutu yalnızca en yüksek token/s değerine göre seçilmemelidir. Modelin belleğe sığması, desteklediği paralelleştirme yöntemi, hedef context uzunluğu ve eşzamanlı kullanıcı sayısı da değerlendirilmelidir.

Bu değerler garanti edilen minimum performans değerleri değil, OpenZeka tarafından test edilen konfigürasyonların referans sonuçlarıdır.

ÜRÜN KILAVUZLARI 

4 Node DGX Spark Cluster Kurulum Rehberi

NVIDIA DGX Spark ürün dokümantasyonu

NVIDIA çoklu DGX Spark switch kurulum rehberi

MikroTik CRS812 ürün dokümantasyonu

MikroTik CRS312 ürün dokümantasyonu

RouterOS dokümantasyonu

ASUSTOR AS6808T kullanım kılavuzu

FS breakout kablo ürün bilgi formu

Western Digital veri sayfası

ÜRÜN KILAVUZLARI 

NVIDIA DGX Spark ürün dokümantasyonu

NVIDIA çoklu DGX Spark switch kurulum rehberi

4 Node DGX Spark Cluster Kurulum Rehberi

MikroTik CRS812 ürün dokümantasyonu

MikroTik CRS312 ürün dokümantasyonu

RouterOS dokümantasyonu

ASUSTOR AS6808T kullanım kılavuzu

FS breakout kablo ürün bilgi formu

Western Digital veri sayfası

Yazılım ve Dokümantasyon

Dokümantasyon ve yazılım indirmeleri gibi ek kaynaklar için iletişime geçebilirsiniz.