Метка: mla - Каталог нейросетей

Метка: mla

Генерация текста

mlx-community/Youtu-LLM-2B-4bit

MLX-оптимизированная 4-разрядная квантованная версия Tencent/Youtu-LLM-2B для Apple Silicon. — Базовая модель: tencent/Youtu-LLM-2B — Параметры: 1.96B — Квантование: 4-бит...

Генерация текста

prometheusAIR/Ling-3.0-flash-GGUF

Кванты включения AI/Ling-3.0-flash, 127,5В-общая/5,1В-активная гибридная МО (bailinghybrid/BailingMoeV3`). Каждый файл здесь содержит только типы тензоров, безопасные для sm120 —...

Генерация текста

ubergarm/DeepSeek-TNG-R1T2-Chimera-GGUF

Для этой коллекции квантов ТРЕБУЕТСЯ форк ikllama.cpp для поддержки последних квантов и оптимизаций SOTA ik! Не** загружайте эти...

Генерация текста

InquiringMinds-AI/LongCat-Flash-Lite-GGUF

Квантование GGUF meituan-longcat/LongCat-Flash-Lite для использования со специальной вилкой llama.cpp. > Требуется специальная вилка. В этой модели используется новая...

Генерация текста

ubergarm/DeepSeek-V3.1-Terminus-GGUF

Для этой коллекции квантов ТРЕБУЕТСЯ форк ikllama.cpp для поддержки последних квантов и оптимизаций SOTA ik! Не** загружайте эти...

Генерация текста

anikifoss/DeepSeek-R1-0528-DQ4_K_R4

Динамическое квантование DeepSeek-R1-0528 с использованием оптимизированного формата, доступного только на вилке ikllama**, размер которого изменен для работы с...

Генерация текста

ubergarm/Kimi-K2.5-GGUF

Кванты в этой коллекции ТРЕБУЮТ вилку ikllama.cpp для поддержки последних квантов и оптимизаций SOTA ik! Не загружайте эти...