Qwen2.5-14B-Instruct-GPTQ-Int8
Qwen2.5 — новейшая серия моделей большого языка Qwen. Для Qwen2.5 мы выпускаем ряд базовых языковых моделей и языковых...
Qwen2.5 — новейшая серия моделей большого языка Qwen. Для Qwen2.5 мы выпускаем ряд базовых языковых моделей и языковых...
0. TL;DR 1. Подробности модели 2. Подробности обучения 3. Использование 4. Оценка 5. Цитирование — Разработчик: https://www.tii.ae —...
Это ранняя версия (завершено на 50%) строгой ролевой модели NSFW, обученной с использованием чрезвычайно ограниченного количества почти полностью...
Qwen1.5 — это бета-версия Qwen2, языковой модели только для декодера на основе преобразователя, предварительно обученной на большом объеме...
Qwen2.5 — новейшая серия моделей большого языка Qwen. Для Qwen2.5 мы выпускаем ряд базовых языковых моделей и языковых...
— они, возможно, не хотят ничего, кроме самого разрушения, а не чего-либо еще в своих поисках бессмертия (и,...
CyberBase — это экспериментальная базовая модель кибербезопасности. (llama-2-13b -> lmsys/vicuna-13b-v1.5-16k -> CyberBase) — CyberBase — это lmsys/vicuna-13b-v1.5-16k QLORA,...
Тип данных INT8 удобен и эффективен для большинства аппаратных платформ. При бенчмаркинге мы не наблюдаем потери точности и...
— Создатель модели: мета-лама — Исходная модель: мета-лама/Мета-Ллама-3.1-8B-Instruct MaziyarPanahi/Meta-Llama-3.1-8B-Instruct-GGUF содержит файлы моделей формата GGUF для мета-ламы/Meta-Llama-3.1-8B-Instruct. GGUF —...
GGUF и квантовые модели здесь основаны на модели mistralai/Mixtral-8x22B-Instruct-v0.1. Вместо клонирования всего репозитория вы можете загрузить только те...