Model compatibility matrix · 37 строк

Открытые модели на DGX Spark

Оценка по размеру весов, без обещаний скорости. «Помещается» не означает «быстро работает» или «поддерживается каждым рантаймом».

118ГБ — рабочий
бюджет узла
37 моделейБюджет узла 118 ГБ
Qwen 3.5 9Bdensetext+vision · 262K · стек: зрелый
Параметры9B9B активно
Память5 ГБ4 бит
Конфигурация1 × Sparkминимум
Qwen 3.5 27Bdensetext+vision · 262K · стек: зрелый
Параметры27B27B активно
Память15,1 ГБ4 бит
Конфигурация1 × Sparkминимум
Qwen 3.6 27Bdensetext+vision · 262K · стек: ранний
Параметры27B27B активно
Память15,1 ГБ4 бит
Конфигурация1 × Sparkминимум
Qwen3 30B-A3BMoEtext · 131K · стек: зрелый
Параметры30B3B активно
Память16,8 ГБ4 бит
Конфигурация1 × Sparkминимум
Qwen3 32Bdensetext · 131K · стек: зрелый
Параметры32B32B активно
Память17,9 ГБ4 бит
Конфигурация1 × Sparkминимум
Qwen3 235B-A22BMoEtext · 131K · стек: зрелый
Параметры235B22B активно
Память131,6 ГБ4 бит
Конфигурация2 × Sparkминимум
DeepSeek V4 FlashMoEtext · 1M · стек: ранний
Параметры284B13B активно
Память159 ГБ4 бит
Конфигурация2 × Sparkминимум
DeepSeek V4 ProMoEtext · 1M · стек: ранний
Параметры1 600B49B активно
Память896 ГБ4 бит
Конфигурация8 × Sparkминимум
DeepSeek V3.2MoEtext · 164K · стек: зрелый
Параметры671B37B активно
Память375,8 ГБ4 бит
Конфигурация4 × Sparkминимум
DeepSeek R1MoEreasoning · 164K · стек: зрелый
Параметры671B37B активно
Память375,8 ГБ4 бит
Конфигурация4 × Sparkминимум
DeepSeek R1 Distill Qwen 32Bdensereasoning · 131K · стек: зрелый
Параметры32B32B активно
Память17,9 ГБ4 бит
Конфигурация1 × Sparkминимум
Llama 4 ScoutMoEtext+vision · 10M · стек: зрелый
Параметры109B17B активно
Память61 ГБ4 бит
Конфигурация1 × Sparkминимум
Llama 4 MaverickMoEtext+vision · 1M · стек: зрелый
Параметры402B17B активно
Память225,1 ГБ4 бит
Конфигурация2 × Sparkминимум
Llama 3.3 70Bdensetext · 131K · стек: зрелый
Параметры70B70B активно
Память39,2 ГБ4 бит
Конфигурация1 × Sparkминимум
Llama 3.1 405Bdensetext · 131K · стек: зрелый
Параметры405B405B активно
Память226,8 ГБ4 бит
Конфигурация2 × Sparkминимум
GLM-4.7 FlashMoEtext · 203K · стек: зрелый
Параметры31B3B активно
Память17,4 ГБ4 бит
Конфигурация1 × Sparkминимум
GLM-4.7MoEtext · 203K · стек: зрелый
Параметры358B32B активно
Память200,5 ГБ4 бит
Конфигурация2 × Sparkминимум
GLM-5MoEreasoning · 203K · стек: ранний
Параметры744B40B активно
Память416,6 ГБ4 бит
Конфигурация4 × Sparkминимум
GLM-5.2MoEreasoning · 203K · стек: ранний
Параметры753B40B активно
Память421,7 ГБ4 бит
Конфигурация4 × Sparkминимум
Kimi Linear 48B-A3BMoEtext · 1M · стек: зрелый
Параметры49B3B активно
Память27,4 ГБ4 бит
Конфигурация1 × Sparkминимум
Kimi K2.5MoEtext+vision · 262K · стек: ранний
Параметры1 100B32B активно
Память616 ГБ4 бит
Конфигурация6 × Sparkминимум
Kimi K2.7 CodeMoEcode+vision · 262K · стек: ранний
Параметры1 100B32B активно
Память616 ГБ4 бит
Конфигурация6 × Sparkминимум
Kimi K3MoEtext+vision · 262K · стек: эксперим.
Параметры2 800B64B активно
Память1 568 ГБ4 бит
Конфигурация14 × Sparkминимум
MiniMax M2.5MoEagents/code · 205K · стек: ранний
Параметры229B10B активно
Память128,2 ГБ4 бит
Конфигурация2 × Sparkминимум
MiniMax M2MoEagents/code · 205K · стек: зрелый
Параметры229B10B активно
Память128,2 ГБ4 бит
Конфигурация2 × Sparkминимум
Mistral Small 3.2densetext+vision · 131K · стек: зрелый
Параметры24B24B активно
Память13,4 ГБ4 бит
Конфигурация1 × Sparkминимум
Devstral Small 2densecode · 131K · стек: зрелый
Параметры24B24B активно
Память13,4 ГБ4 бит
Конфигурация1 × Sparkминимум
Mixtral 8×22BMoEtext · 66K · стек: зрелый
Параметры141B39B активно
Память79 ГБ4 бит
Конфигурация1 × Sparkминимум
Gemma 3 27Bdensetext+vision · 131K · стек: зрелый
Параметры27B27B активно
Память15,1 ГБ4 бит
Конфигурация1 × Sparkминимум
Gemma 3 12Bdensetext+vision · 131K · стек: зрелый
Параметры12B12B активно
Память6,7 ГБ4 бит
Конфигурация1 × Sparkминимум
Phi-4densetext · 16K · стек: зрелый
Параметры14B14B активно
Память7,8 ГБ4 бит
Конфигурация1 × Sparkминимум
Phi-4 Multimodaldensetext+vision+audio · 131K · стек: зрелый
Параметры5,6B5,6B активно
Память3,1 ГБ4 бит
Конфигурация1 × Sparkминимум
Apertus 70Bdensetext · 66K · стек: зрелый
Параметры70B70B активно
Память39,2 ГБ4 бит
Конфигурация1 × Sparkминимум
Command Adensetext · 262K · стек: зрелый
Параметры111B111B активно
Память62,2 ГБ4 бит
Конфигурация1 × Sparkминимум
Nemotron Ultra 253Bdensereasoning · 131K · стек: зрелый
Параметры253B253B активно
Память141,7 ГБ4 бит
Конфигурация2 × Sparkминимум
gpt-oss 120BMoEreasoning · 131K · стек: зрелый
Параметры117B5,1B активно
Память65,5 ГБ4 бит
Конфигурация1 × Sparkминимум
gpt-oss 20BMoEreasoning · 131K · стек: зрелый
Параметры21B3,6B активно
Память11,8 ГБ4 бит
Конфигурация1 × Sparkминимум

Большие контексты из model card не равны практическому контексту на 128 ГБ: KV-cache растёт вместе с длиной контекста и количеством параллельных запросов.

Практическая граница

Что хорошо подходит одному Spark

Оптимальная зона: dense 7–70B и MoE до ~200B total в 4 битах. Здесь остаётся запас под KV-cache, системные процессы и длинный контекст.

Пограничная зона: 200B в FP4/INT4. Теоретически помещается, но служебные тензоры, формат квантов и контекст могут вытеснить модель за предел 128 ГБ.

Кластер: 235–405B обычно требует 2–3 узла. Модели 671B+ — от четырёх, а реальный минимум может быть выше из-за формата весов и поддержки tensor/expert parallel.