Sakura-24B-Spice
Sakura-24B-Spice — это высокоинтеллектуальная 24-миллиардная модель параметров, основанная на архитектуре Mistral-Small-2501. Эта модель представляет собой значительную эволюцию в...
Sakura-24B-Spice — это высокоинтеллектуальная 24-миллиардная модель параметров, основанная на архитектуре Mistral-Small-2501. Эта модель представляет собой значительную эволюцию в...
Original model: https://huggingface.co/alamios/Mistral-Small-3.1-DRAFT-0.5B Run them directly with llama.cpp, or any other llama.cpp based project Some of these quants...
This model is meant to be used as draft model for speculative decoding with mistralai/Mistral-Small-3.1-24B-Instruct-2503 or mistralai/Mistral-Small-24B-Instruct-2501 The...
Qwen/Qwen2.5-0.5B, но со словарем mistralai/Mistral-Small-3.1-24B-Instruct-2503/mistralai/Mistral-Small-24B-Instruct-2501, пересаженным с помощью трансплантата-вокаба. Его можно использовать непосредственно в качестве черновой модели для...
Исходная модель: https://huggingface.co/NousResearch/DeepHermes-3-Mistral-24B-Preview Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
Mistral-Grand-R1-Dolphin-3.0-Deep-Reasoning-Brainstorm-45B-GGUF Это экспериментальная сборка, сочетающая https://huggingface.co/cognitivecomputations/Dolphin3.0-R1-Mistral-24B с технологией Brainstorm 40x от DavidAU (подробно описанной в самом низу этой...
— Архитектура модели: Mistral-Small-24B-Instruct-2501 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
Эта модель предназначена для использования в качестве черновой модели для спекулятивного декодирования с помощью mistralai/Mistral-Small-3.1-24B-Instruct-2503 или mistralai/Mistral-Small-24B-Instruct-2501. Данные...
Это объединение предварительно обученных языковых моделей, созданных с помощью mergekit. Эта модель была объединена с использованием следующих методов...
DeepHermes 3 Preview — это последняя версия нашей флагманской серии LLM Hermes от Nous Research и одна из...