granite-3.3-8b-instruct-GGUF
Наш новейший метод квантования представляет собой высокоточное адаптивное квантование для моделей со сверхмалой разрядностью (1–2 бита) с проверенными...
Наш новейший метод квантования представляет собой высокоточное адаптивное квантование для моделей со сверхмалой разрядностью (1–2 бита) с проверенными...
Исходная модель: https://huggingface.co/ibm-granite/granite-3.3-2b-instruct. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
Краткое описание модели: Granite-3.3-8B-Instruct — это языковая модель с 8 миллиардами параметров и длиной контекста 128 КБ, настроенная...
> [!NOTE] > Этот репозиторий содержит модели, преобразованные в формат GGUF с использованием различных квантований из базовой модели...
Granite-3.3-2B-Base — это языковая модель, предназначенная только для декодера, с контекстным окном токена размером 128 КБ. Он совершенствует...
Granite-3.3-8B-Base — это языковая модель, предназначенная только для декодера, с контекстным окном токена размером 128 КБ. Он совершенствует...
> [!NOTE] > Этот репозиторий содержит модели, преобразованные в формат GGUF с использованием различных квантований из базовой модели...
Краткое описание модели: Granite-3.3-2B-Instruct — это языковая модель с 2 миллиардами параметров и длиной контекста 128 КБ, настроенная...
Краткое описание модели: Granite-3.3-8B-Instruct — это языковая модель с 8 миллиардами параметров и длиной контекста 128 КБ, настроенная...