LOKAL LLM’LER

Dört DGX Spark Üzerinde DeepSeek-V4.1-Flash (763B) — 29.5 tok/s

DeepSeek-V4.1-Flash, 552 milyar parametrelik bir omurgaya sahip, çok modlu bir Mixture-of-Experts (MoE) modelidir. Hugging Face checkpoint'i 763 milyar parametre içerir: 552B omurga + 196B Engram koşullu bellek + ~15B görsel kodlayıcı, MLP projektörü ve DSpark draft modeli. MXFP8 dense + MXFP4 expert ağırlık nicelemesi ve FP4 (E2M1) KV önbelleği ...(Devamını oku)

Tarafından Oluşturuldu|AI, LOKAL LLM'LER|

DGX Spark Üzerinde Qwen3.8-27B — 48 tok/s

Qwen3.8-27B, Alibaba tarafından Ağustos 2026'da yayımlanan 27 milyar parametreli bir dil modelidir. Artificial Analysis Intelligence Index'te 52 puan alarak, kendi sınıfında (40B altı açık ağırlıklı modeller) 1. sıraya yerleşmiştir. Bu eğitimde, tek bir DGX Spark üzerinde Qwen3.8-27B-NVFP4'ü, SGLang çıkarım motoru ve DFlash2 draft modeli (spekülatif kod çözme) ile çalıştıracak ...(Devamını oku)

Tarafından Oluşturuldu|LOKAL LLM'LER, AI|

NVIDIA DGX Spark Ekosistemi

Kaynaklar, Araçlar ve Topluluk NVIDIA DGX Spark™, yapay zeka modelleriyle çalışmak isteyenler için tasarlanmış kompakt bir masaüstü AI sistemidir. Geliştirme, test, çıkarım, ince ayar ve prototipleme süreçlerini tek bir platformda toplar. Cihaz etrafında oluşan yazılım ve bilgi ekosistemi oldukça güçlüdür: modeller, Docker imajları, NVIDIA playbook'lar ...(Devamını oku)

Tarafından Oluşturuldu|AI, LOKAL LLM'LER|

2x DGX Spark Üzerinde DeepSeek-V4-Flash-0731

Bu eğitimde, iki DGX Spark üzerinde DeepSeek-V4-Flash-0731 büyük dil modelini sparkrun kullanarak çalıştıracaksınız. Bu model, 284 milyar toplam ve 13 milyar aktif parametre ile çalışan bir Mixture-of-Experts modelidir. Ayrıca, çalıştırmadan önce modelin ne kadar zeki olduğunu inceleyeceğiz. Spark, monitör ve klavye bağlayarak doğrudan bilgisayar olarak kullanılabileceği gibi, başka bir ...(Devamını oku)

Tarafından Oluşturuldu|AI CLUSTER, LOKAL LLM'LER|
Go to Top