ZAYA1-8B-BNB
> Примечание. ZAYA1-8B использует собственную разреженную архитектуру MoE (ZayaForCausalLM), которая еще не поддерживается llama.cpp. Файлы GGUF будут добавлены...
> Примечание. ZAYA1-8B использует собственную разреженную архитектуру MoE (ZayaForCausalLM), которая еще не поддерживается llama.cpp. Файлы GGUF будут добавлены...
Эта модель была преобразована в формат MLX и квантована из Qwen3.6-35B-A3B с использованием oMLX. «VL» — это язык...
8-битное базовое квантование смешанной точности Qwen/Qwen3.6-35B-A3B для Apple Silicon с использованием стратегии квантования Unsloth Dynamic через mlx-node. Проведено...
Qwen3 — это последнее поколение больших языковых моделей в серии Qwen, предлагающее полный набор моделей с плотным доступом...
Эта модель mlx-community/Qwen3-0.6B-8bit была преобразована в формат MLX из Qwen/Qwen3-0.6B с использованием mlx-lm версии 0.24.0. Модальности:Генерация текста Области...
Модель QwQ-LCoT-3B-Instruct — это легкая, настроенная на инструкции языковая модель, предназначенная для сложных задач рассуждения и объяснения. Он...
MaziyarPanahi/RYS-XLarge-GGUF содержит файлы моделей формата GGUF для dnhkng/RYS-XLarge. GGUF — это новый формат, представленный командой llama.cpp 21 августа...
Это квантованная версия mistralai/Mistral-Nemo-Instruct-2407 с разрешением 8,0 бит в секунду, созданная с помощью exllamav2. Хотите купить мне чашку...
NuminaMath — это серия языковых моделей, которые обучены решать математические задачи с использованием интегрированного мышления (TIR). NuminaMath 7B...
omost-phi-3-mini-128k-8bits — это модель phi-3-mini от Omost с длиной контекста 128 тыс. в fp8. Модальности:Генерация текста Области применения:Диалог...