> Q8_0 ГГУФ Дарвин-35Б-А3Б-Опус | ~37 ГБ (3 осколка) | GPQA Бриллиант 90,0% | Качество почти без потерь | МО 35Б (активен 3Б) | 201 язык | 262K Контекст | Apache 2.0 > Загрузите все 3 файла осколков. llama.cpp и Ollama автоматически загрузят их вместе. > В модели MoE для каждого токена активны только параметры 3B. Вывод выполняется быстро, несмотря на размер модели 37 ГБ.
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат Мультиязычность
Задача: Генерация текста
Автор: FINAL-Bench
Теги: gguf, qwen3_5_moe, llama-cpp, quantized, Q8_0, merge, evolutionary-merge, darwin
Лайков: 18 | Загрузок: 3,156
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.