Qwen3-Next-80B-A3B-Instruct-NVFP4
— Архитектура модели: Qwen3NextForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
— Архитектура модели: Qwen3NextForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
Это квантованная версия EssentialAI/RnJ-1-Instruct FP8, созданная с использованием llmcompressor (Neural Magic). Ключевые преимущества: — Размер модели меньше на...
Это квантованная версия NousResearch/Hermes-4.3-36B FP8, созданная с использованием llmcompressor (Neural Magic). Основные преимущества: — Размер модели меньше примерно...
— Архитектура модели: ApertusForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
DeepSeek-V3.1 — это гибридная модель, поддерживающая как режим мышления, так и режим без мышления. По сравнению с предыдущей...
> [!NOTE] > Включает исправления шаблонов чата! Для llama.cpp используйте —jinja > Unsloth Dynamic 2.0 обеспечивает превосходную точность...
Модель NVIDIA Qwen3-235B-A22B FP8 представляет собой квантованную версию модели Qwen3-235B-A22B от Alibaba, которая представляет собой авторегрессионную языковую модель,...
— Архитектура модели: LlamaForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
— Архитектура модели: Gemma 2 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое...
— Архитектура модели: Phi-3 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...