Mistral-Small-24B-Instruct-2501
Mistral Small 3 ( 2501 ) устанавливает новый эталон в категории «малых» широкоязычных моделей ниже 70B, обладая параметрами...
Mistral Small 3 ( 2501 ) устанавливает новый эталон в категории «малых» широкоязычных моделей ниже 70B, обладая параметрами...
educa-ai-nemo-dpo is the preference-aligned version of our SFT model DigitalLearningGmbH/educa-ai-nemo-sft, using our internal dataset which contains a unique...
educa-ai-nemo-sft — это наша точная настройка SFT мощного mistralai/Mistral-Nemo-Instruct-2407 с использованием нашего внутреннего набора данных, который содержит уникальное...
The Model mlx-community/c4ai-command-r7b-12-2024-bf16 was converted to MLX format from CohereForAI/c4ai-command-r7b-12-2024 using mlx-lm version 0.20.4. Модальности:Генерация текста Области применения:Диалог...
Chocolatine-Admin-3B version specialized in French administrative language, supervised fine-tuning of jpacifico/Chocolatine-3B-Instruct-DPO-v1.2 based on microsoft/Phi-3.5-mini-instruct Developed in collaboration with...
«Основная» ветвь содержит только measurement.json, скачайте одну из других ветвей для модели (см. ниже) Каждая ветвь содержит отдельные...
GitHub и руководство по использованию: https://github.com/OpenBuddy/OpenBuddy Лицензия: https://github.com/meta-llama/llama-models/blob/main/models/llama3_1/LICENSE Политика допустимого использования: https://llama.meta.com/llama3/use-policy Мы рекомендуем использовать быстрый токенизатор из...
This model is a quantized variant of the meta-llama/Llama-3.2-1B-Instruct model, optimized for use with Jlama, a Java-based inference...
GitHub and Usage Guide: https://github.com/OpenBuddy/OpenBuddy License: https://github.com/meta-llama/llama-models/blob/main/models/llama3_2/LICENSE Acceptable Use Policy: https://llama.meta.com/llama3/use-policy We recommend using the fast tokenizer from...
— Архитектура модели: Llama-3 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование активации:...