Kimiko-Mistral-7B
(Я собираюсь переобучить это, эта модель — провал) Эта модель представляет собой доработанную версию mistralai/Mistral-7B-v0.1 на наборе данных...
(Я собираюсь переобучить это, эта модель — провал) Эта модель представляет собой доработанную версию mistralai/Mistral-7B-v0.1 на наборе данных...
Рады объявить о выпуске Llama3-8b-Naijav1, доработанной версии Meta-Llama-3-8B, обученной на наборе данных «вопрос-ответ» из Найраланда. Модель была создана...
Komodo — это модель Qwen 2.5-7B-Instruct-FineTuned на наборе данных TIGER-Lab/MathInstruct для повышения математической производительности базовой модели. Модальности:Генерация текста...
У нас есть бесплатный ноутбук Google Colab Tesla T4 для Llama 3.1 (8B) здесь: https://colab.research.google.com/drive/1Ys44kVvmeZtnICzWz0xgpRnrIOjZAuxp?usp=sharing Все ноутбуки удобны...
Эта модель представляет собой 8-битную квантованную версию модели большого языка Meta Llama 3–8B Instruct (LLM). Квантование уменьшает размер...
Эта модель представляет собой доработанную версию mistralai/Mistral-7B-v0.1 в наборе данных mhenrichsen/context-aware-splits-english. В наборе оценок достигаются следующие результаты: —...
Это квантованная версия GGUF доработанной модели Llama 3.1 8B Instruct, предназначенная для динамичных постобучающих Llama-3.1-8B, в основном для...
Unsloth Dynamic 2.0 обеспечивает превосходную точность и превосходит другие ведущие методы количественного анализа. Модель DeepSeek R1 претерпела незначительное...
FINGU-AI/Chocolatine-Fusion-14B — это объединенная модель, объединяющая jpacifico/Chocolatine-2-14B-Instruct-v2.0b3 и jpacifico/Chocolatine-2-14B-Instruct-v2.0b2. Эта модель сохраняет сильные стороны Chocolatine, но при этом...
Эта модель представляет собой неофициальную тренировку Yi-34B-Llama на наборе данных LimaRP v3 от лимонилии. Здесь не предусмотрен этап...