mradermacher/Athena-70B-L3-i1-GGUF - Каталог нейросетей
Генерация текста

mradermacher/Athena-70B-L3-i1-GGUF

Добавлено:
mradermacher/Athena-70B-L3-i1-GGUF

взвешенные/иматричные кванты https://huggingface.co/AiMavenAi/Athena-70B-L3 статические кванты доступны по адресу https://huggingface.co/mradermacher/Athena-70B-L3-GGUF. Если вы не уверены, как использовать файлы GGUF, обратитесь к одному из файлов README TheBloke для получения более подробной информации, в том числе о том, как объединить файлы, состоящие из нескольких частей. (отсортировано по размеру, не обязательно по качеству. IQ-квант часто предпочтительнее, чем аналогичный по размеру не-IQ-квант) Вот удобный график от ikawrakow, сравнивающий некоторые типы квантов более низкого качества (чем ниже, тем лучше): А вот мысли Artefact2 по этому поводу: https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 См. https://huggingface.co/mradermacher/model_requests, чтобы найти ответы на вопросы, которые могут у вас возникнуть, и/или если вы хотите квантовать какую-то другую модель. Я благодарю мою компанию nethype GmbH за то, что она позволила мне использовать ее серверы и предоставила обновления моей рабочей станции, чтобы я мог работать в свободное время. Дополнительное спасибо @nicoboss за предоставленный мне доступ к его личному суперкомпьютеру, который позволил мне предоставить гораздо больше иматричных квантов в гораздо более высоком качестве, чем я мог бы сделать в противном случае.

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: mradermacher
Теги: gguf, autotrain, text-generation-inference, peft, en, endpoints_compatible, imatrix, conversational
Лайков: 4  |  Загрузок: 200

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.