Mistral-7B-v0.1-sharded
Это всего лишь версия https://huggingface.co/mistralai/Mistral-7B-v0.1, которая разбита на части размером не более 2 ГБ, чтобы уменьшить объем оперативной...
Это всего лишь версия https://huggingface.co/mistralai/Mistral-7B-v0.1, которая разбита на части размером не более 2 ГБ, чтобы уменьшить объем оперативной...
Minerva — первое семейство LLM, прошедших предварительное обучение итальянскому языку с нуля, разработанное Sapienza NLP в сотрудничестве с...
Я взял слои оригинального Мистраля-7Б и продублировал несколько слоев. Это первый метод Франкенштейна, который я нашел «приемлемым» для...
Minueza-32M-Base — базовая модель с 32 миллионами параметров, обученная с нуля на большом корпусе текста на английском языке....
Эта модель щедро создана и сделана с открытым исходным кодом компанией Astronomer. Astronomer является де-факто компанией Apache Airflow,...
Пример кода на Python Загрузка модели Завершение предложения Загрузка контрольной точки Подробности обучения Процедура обучения данных обучения Обучение...
Эта модель щедро создана и сделана с открытым исходным кодом компанией Astronomer. Astronomer является де-факто компанией Apache Airflow,...
Модель большого языка DictaLM-2.0 (LLM) — это предварительно обученная генеративная текстовая модель с 7 миллиардами параметров, специально обученная...
Minerva — первое семейство LLM, прошедших предварительное обучение итальянскому языку с нуля, разработанное Sapienza NLP в сотрудничестве с...
Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области...