NVIDIA, 100 milyar parametreli modelleri çalıştırabilen 64 GB DGX Spark’ı tanıttı
NVIDIA, yerel yapay zekâ çalışmaları için geliştirdiği DGX Spark ailesine 64 GB birleşik belleğe sahip yeni bir seçenek ekledi. GB10 Grace Blackwell Superchip kullanan sistem, tek başına 100 milyara kadar parametreli modelleri çalıştırabiliyor; iki cihaz bağlandığında toplam bellek 128 GB’a, desteklenen model kapasitesi ise 200 milyar parametreye çıkıyor.

NVIDIA, masaüstünde yerel yapay zekâ çalışmaları için geliştirdiği DGX Spark ailesine 64 GB birleşik belleğe sahip yeni bir seçenek ekledi. GB10 Grace Blackwell Superchip kullanan sistem, tek başına 100 milyara kadar parametreye sahip modelleri çalıştırabiliyor. İki DGX Spark ise NVIDIA Sync Cluster Assistant üzerinden doğrudan birbirine bağlanarak tek bir küme halinde kullanılabiliyor.
Yeni DGX Spark 64 GB, Acer, ASUS, Dell, Gigabyte, HP ve MSI tarafından sunulacak. Satışlar 23 Ekim’de başlayacak ve başlangıç fiyatı 4.999 dolar olacak. NVIDIA’nın kendi 128 GB DGX Spark modelinde kullanılan GB10 Grace Blackwell Superchip, DGX OS ve NVIDIA yapay zekâ yazılım yığını 64 GB sürümde de korunuyor.
DGX Spark; Grace Blackwell işlem mimarisini, birleşik belleği, ConnectX-7 ağ donanımını ve CUDA hızlandırmalı yapay zekâ yazılımlarını kompakt bir masaüstü sistemde bir araya getiriyor. Yeni 64 GB yapılandırma; yerel yapay zekâ ajanları, çıkarım, ince ayar, veri bilimi ve uç yapay zekâ geliştirme çalışmalarında kullanılabiliyor.
Sistem üzerindeki 64 GB birleşik bellek, 100 milyara kadar parametre içeren yapay zekâ modellerinin tamamen cihaz üzerinde çalıştırılmasına izin veriyor. Böylece model ve kullanıcı verilerinin işlenmesi için her görevde bulut sunucularına başvurmak gerekmiyor. Yerel olarak çalışan kodlama ve araştırma ajanları sürekli açık bırakılabiliyor, belge analizi veya çok aşamalı görevler doğrudan sistem üzerinde yürütülebiliyor.
NVIDIA, DGX Spark’ın yazılım tarafını da hazır halde sunuyor. NVIDIA Agent Toolkit, CUDA-X AI kütüphaneleri ve Nemotron açık modellerinin yanı sıra Ollama, vLLM ve CUDA destekli PyTorch sistem üzerinde kullanılabiliyor. llama.cpp ve LM Studio da desteklenen çıkarım seçenekleri arasında bulunuyor.
Blender da DGX Spark desteği sunan ilk büyük içerik üretim uygulamalarından biri olacak. Platform için önceden hazırlanmış ve doğrudan indirilebilen Blender kurulum paketinin yakında yayınlanması planlanıyor.
DGX Spark’ın en önemli yeniliklerinden biri ise iki sistemin tek kümede çalıştırılabilmesi. Her cihazda yerleşik NVIDIA ConnectX-7 ağ arabirimi bulunuyor ve iki DGX Spark, QSFP kablosuyla doğrudan birbirine bağlanabiliyor. İki adet 64 GB sistem kullanıldığında toplam birleşik bellek havuzu 128 GB’a yükseliyor.
Çift sistemli yapı, 200 GbE bağlantı üzerinden çalışıyor ve 200 milyara kadar parametreye sahip modellerin kullanılmasına izin veriyor. Bellek bant genişliği de iki sistemin birlikte kullanılmasıyla artıyor. NVIDIA’nın Qwen 3.8 27B ile yaptığı testte iki adet 64 GB DGX Spark, tek sisteme kıyasla 1,7 kata kadar daha yüksek performans verdi.
Küme yapılandırması NVIDIA Sync Cluster Assistant tarafından gerçekleştiriliyor. Yazılım bağlı DGX Spark sistemlerini otomatik olarak algılıyor, cihaz yapılandırmasını doğruluyor ve ConnectX-7 ağını hazırlıyor. Her iki cihazda da aynı NVIDIA yazılım ortamı çalıştığı için tek sistemden iki sisteme geçerken yazılım yığınının yeniden kurulması veya baştan yapılandırılması gerekmiyor.
Bu yapı yalnızca daha büyük modeller için kullanılmıyor. Daha uzun bağlam pencereleri, aynı anda çalışan birden fazla yapay zekâ ajanı veya paralel isteklerin oluşturduğu yük de iki DGX Spark arasında dağıtılabiliyor. Dil veya görüntü üretim modelleri DGX Spark üzerinde çalışırken dizüstü ya da masaüstü bilgisayar yalnızca uygulama arayüzü olarak kullanılabiliyor ve model çıkarım yükü DGX Spark’a bırakılabiliyor.
NVIDIA ayrıca ekim ayının sonunda Sync Model Launcher yazılımını yayınlayacak. Yazılım, desteklenen modellerin birkaç adımla tek bir DGX Spark veya bir DGX Spark kümesi üzerinde çalıştırılmasını sağlayacak. Qwen 3.8 27B doğrudan indirilebilecek ve NVIDIA Sync, modelin bağlı sistemler arasında nasıl dağıtılacağını otomatik olarak yapılandıracak.
Sync Model Launcher aynı zamanda modeli kullanıcının dizüstü bilgisayarından erişilebilir hale getirecek. OpenCode kurulumu da otomatik olarak yapılandırılacak ve geliştiriciler tarayıcı üzerinden kodlama çalışmalarına başlayabilecek.
DGX Spark için hazırlanan yapay zekâ ajanı iş akışları da genişliyor. NemoClaw, OpenClaw, Hermes Agent ve OpenShell için hazırlanan çalışma örneklerine ek olarak vLLM ile büyük dil modeli sunma, OpenClaw’u yerel bir LLM ile kullanma ve birden fazla DGX Spark üzerinde dağıtık iş yükleri çalıştırma senaryoları 64 GB sistemlere gelecek.
NVIDIA’nın yerel yapay zekâ donanımı tarafındaki genişleme yalnızca DGX Spark ile sınırlı kalmayacak. RTX Spark tabanlı yeni Windows bilgisayarlar da ekim ayında Acer, ASUS, Dell, HP, Lenovo, Microsoft ve MSI tarafından piyasaya sunulacak.
1996 yılında Üsküdar’da doğan Mert Can Aka, sinema, bilim, teknoloji ve tarih alanlarına duyduğu ilgiyle şekillenen kariyerinde teknoloji editörlüğüne odaklandı. Öğrenmeyi ve bilgiyi aktarmayı merkeze alan Aka, farklı kurumlarda çeşitli görevler üstlendi. Bu süreçte MediaMarkt’ın MediaTrend Teknolojik Yaşam dergisini son sayısına kadar yöneterek dergicilik tarafında da deneyim kazandı. Bilgisayar Mühendisliği, Bilgisayar Programcılığı, Web Tasarım ve Kodlama ile birlikte Adalet ve İktisat alanlarında akademik geçmişe sahip olan Aka, bugün Technopat’ta Yazı İşleri Müdürü olarak görev yapıyor. Otomotivden yapay zekaya, donanımdan ev teknolojilerine uzanan geniş bir yelpazede ürettiği on bini aşkın içerik yüz milyonlarca okura ulaştı.
Kaynak: Technopat


