Квантованные версии GGUF hauser458b/lfm2.5-230m-code-math, тонкая настройка LiquidAI/LFM2.5-230M (instruct), ориентированная на код/математику. Полную информацию об обучении, примечаниях к оценке и известных ограничениях см. в карточке модели базовой тонкой настройки. Для использования с llama.cpp, Ollama, LM Studio или любой другой средой выполнения, совместимой с GGUF. (Размеры приблизительные — проверьте фактические размеры файлов в репозитории.) Найдите hauser458b/lfm2.5-230m-code-math-GGUF в браузере модели LM Studio или загрузите файл .gguf напрямую и загрузите его вручную. — Q4KM: наименьший размер, лучше всего подходит для устройств с очень ограниченными возможностями (старые телефоны, периферийное оборудование с низким объемом оперативной памяти). Некоторая потеря качества по сравнению с более высокими показателями. — Q5KS / Q5KM: хорошая золотая середина — рекомендуется по умолчанию для большинства выводов о процессоре ноутбука/настольного компьютера. — Q80: почти без потерь, используйте, если у вас есть запас ОЗУ/хранилища и вы хотите, чтобы результат был как можно ближе к исходной модели защитных тензоров. — F16**: GGUF полной точности, необходим только в том случае, если вы планируете повторно квантовать себя или хотите максимально возможную точность в llama.cpp.
Модальности:
Генерация текста
Области применения:
Генерация кода Математика Диалог / чат
Задача: Генерация текста
Автор: hauser458b
Теги: gguf, lfm2, lfm2.5, liquid, code, math, llama.cpp, en
Лайков: 5 | Загрузок: 855
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.