Llama3-8B-1.58-100B-tokens-GGUF
The Llama3-8B-1.58 models are large language models fine-tuned on the BitNet 1.58b architecture, starting from the base model...
The Llama3-8B-1.58 models are large language models fine-tuned on the BitNet 1.58b architecture, starting from the base model...
Inventor: Konstantin Vladimirovich Grabko Email: grabko@cmsmanhattan.com Date: December 21, 2025 Needed: A sponsor for Llama 405b Distilation to...
BitMamba-2-255M is the ultra-efficient baseline model of the BitMamba-2 family. It integrates 1.58-bit ternary quantization (BitNet) into the...
Изобретатель: Грабко Константин Владимирович Контакты: grabko@cmsmanhattan.com Телефон: +1 (516) 777-0945 Статус: [ПАТЕНТ ЗАЯВЛЕН] — Заявка подана 21 декабря...
Архитектура: 14,7 миллиардов параметров | 1,58-битное троичное квантование BitNet. Это экспериментальное 1,58-битное квантование BitNet модели Qwen2.5-Coder-14B-Instruct с использованием...
Высокопроизводительный троичный преобразователь на процессоре | [ПАТЕНТ ЗАЯВЛЕН] Изобретатель: Константин Владимирович Грабко Организация: Официальный сайт CMS Manhattan: www.cmsmanhattan.com...
Это карточка модели трансформера 🤗, которая была размещена на Хабе. Эта карточка модели была создана автоматически. — Разработано:...
Эта модель mlx-community/bitnet-b1.58-2B-4T была преобразована в формат MLX из microsoft/bitnet-b1.58-2B-4T с использованием mlx-lm версии 0.25.1. Модальности:Генерация текста Области...
Это карточка модели трансформера 🤗, которая была размещена на Хабе. Эта карточка модели была создана автоматически. — Разработано:...
Версия microsoft/bitnet-b1.58-2B-4T-gguf для IQ2BN и IQ2BNR4 для использования с ikllama.cpp. Я рекомендую версию IQ2BNR4, но вы используете -rtr...