Метка: 8bit - Страница 3 - Каталог нейросетей

Метка: 8bit

Генерация текста

ethzanalytics/gpt-j-6B-8bit-sharded

Это версия hivemind/gpt-j-6B-8bit для загрузки с низким объемом оперативной памяти, т. е. бесплатная среда выполнения Colab 🙂 Для...

Генерация текста

mlx-community/gemma-4-12B-it-OptiQ-4bit

4-битный квант MLX смешанной точности, созданный mlx-optiq, набором инструментов квантования с учетом чувствительности для Apple Silicon. Оценка +6,40...

Генерация текста

mlx-community/Qwen3.5-2B-OptiQ-4bit

4-битный квант MLX смешанной точности, созданный mlx-optiq — набором инструментов квантования с учетом чувствительности для Apple Silicon. Превосходит...

Генерация текста

mlx-community/Qwen3.6-35B-A3B-OptiQ-4bit

4-битный квант MLX смешанной точности, созданный mlx-optiq — набором инструментов квантования с учетом чувствительности для Apple Silicon. Превосходит...

Генерация текста

legraphista/Llama-3.1-Minitron-4B-Width-Base-GGUF

Статическое квантование Llama.cpp nvidia/Llama-3.1-Minitron-4B-Width-Base Исходная модель: nvidia/Llama-3.1-Minitron-4B-Width-Base Исходный тип dtype: BF16 (bfloat16) Квантование: llama.cpp b3600 Набор данных IMatrix:...

Генерация текста

mlx-community/Qwen3.5-4B-OptiQ-4bit

> Оптимизирован для Apple Silicon с помощью mlx-optiq — квантование смешанной точности с учетом чувствительности, возможность повторного использования...

Генерация текста

mlx-community/Qwen3.5-0.8B-OptiQ-4bit

> Оптимизирован для Apple Silicon с помощью mlx-optiq — квантование смешанной точности с учетом чувствительности, возможность повторного использования...