qwen1.5-1.8b-sft
Эта модель представляет собой доработанную версию Qwen/Qwen1.5-1.8B в наборе данных HuggingFaceH4/deita-6k-v0-sft. В наборе оценок он достигает следующих результатов:...
Эта модель представляет собой доработанную версию Qwen/Qwen1.5-1.8B в наборе данных HuggingFaceH4/deita-6k-v0-sft. В наборе оценок он достигает следующих результатов:...
Эта модель представляет собой доработанную версию google/gemma-7b для набора данных None. В наборе оценок он достигает следующих результатов:...
Эта модель представляет собой доработанную версию NousResearch/Nous-Hermes-2-Mixtral-8x7B-SFT в наборе данных None. В наборе оценок он достигает следующих результатов:...
Эта модель представляет собой доработанную версию microsoft/phi-2 для набора данных None. Он достигает следующих результатов в оценочном наборе:...
Эта модель представляет собой доработанную версию mistralai/Mistral-7B-v0.1 в наборе данных UltraChat. В оценочном наборе достигаются следующие результаты: —...
Новая модель Pigeon-7B представляет собой доработанную Llama 2, обученную на более чем 70 тысячах разговорных польских образцов. Это...
Модель лама-2-7б-хф, настроенная для медицинской консультации. Работает на графическом процессоре T4 (16 ГБ видеопамяти), а также на процессоре...
Эта модель основана на модели llama-2-13b-chat-hf, настроенной с помощью QLoRA. Он прошел обучение на Colab Pro+. Он прошел...
Vigogne-instruct-bloom-7b1 — это модель bigscience/bloom-7b1, настроенная в соответствии с 🇫🇷 французскими инструкциями. Уведомления об использовании и лицензии: Как...
Эта модель представляет собой доработанную версию distilgpt2. В наборе оценок он достигает следующих результатов: — Потеря: 2,9268. Эта...