molmo-7B-D-bnb-4bit
показатели производительности и контрольные показатели для сравнения с базовыми будут опубликованы на следующей неделе. Модальности:Генерация текста Области применения:Диалог...
показатели производительности и контрольные показатели для сравнения с базовыми будут опубликованы на следующей неделе. Модальности:Генерация текста Области применения:Диалог...
У нас есть ноутбук Google Colab Tesla T4 для Mistral v3 7b здесь: https://colab.research.google.com/drive/1yNCks4BTD5zOnjozppphh5GzMFaMKq?usp=sharing Для диалогового стиля ShareGPT...
omost-llama-3-8b-4bits — это модель lama-3 от Omost с длиной контекста 8 тыс. в nf4. Модальности:Генерация текста Области применения:Диалог...
Это ранняя версия (завершено на 50%) строгой ролевой модели NSFW, обученной с использованием чрезвычайно ограниченного количества почти полностью...
Unsloth Dynamic 2.0 обеспечивает превосходную точность и превосходит другие ведущие методы количественного анализа. За последние несколько месяцев мы...
CyberBase — это экспериментальная базовая модель кибербезопасности. (llama-2-13b -> lmsys/vicuna-13b-v1.5-16k -> CyberBase) — CyberBase — это lmsys/vicuna-13b-v1.5-16k QLORA,...
У нас есть бесплатный ноутбук Google Colab Tesla T4 для Mistral Nemo 12b здесь: https://colab.research.google.com/drive/17d3U-CAIwzmbDRqbZ9NnpHxCkmXB6LZ0?usp=sharing Все ноутбуки удобны...
👋 Wechat · 💡Онлайн-демо · 🎈Страница Github 📍Испытайте крупномасштабную модель CogVLM на открытой платформе ZhipuAI. Мы запускаем новое...
TraceBack — это то, что я придумал, когда подумал: «Как мы можем эффективно масштабировать генерацию данных трассировки рассуждений?»...
LIMA-подобная (менее 1000 обучающих выборок) модель ролевого чата, основанная на данных: — двух тематических РП-форумов; — Синтетически созданные...