LightningLM-0.1V-120B-MoE
LightningLM 0.1V — pretrained 118.67B total / 5.93B active (MoE) language model. This repository is a weights-only staged...
LightningLM 0.1V — pretrained 118.67B total / 5.93B active (MoE) language model. This repository is a weights-only staged...
kai-os/Carnice-9b quantized for hipfire, a Rust-native inference engine for AMD RDNA GPUs. Carnice is a Hermes tool-use finetune...
Цель. Гибридная языковая модель Mixture of Experts с ~10 миллиардами параметров и ~2 миллиардами активных параметров на токен....
13,67 ГБ | 204/256 экспертов | Q3KM | MMLU -1pp, GSM8K равно | Полная резидентность графического процессора на...
Многопоточный вариант Qwen3.5-27B (гибрид DeltaNet), который генерирует десять параллельных потоков (1 входной, 1 видимый выходной, 8 мыслительных каналов)...
Унифицированная квантованная версия FP8 Jackrong/Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled — модель Qwen3.5-27B, очищенная от рассуждений Claude 4.6 Opus. ~29 ГБ на диске...