Метка: fp8 - Страница 2 - Каталог нейросетей

Метка: fp8

Генерация текста

RedHatAI/Qwen3-Next-80B-A3B-Instruct-NVFP4

— Архитектура модели: Qwen3NextForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...

Генерация текста

Doradus-AI/RnJ-1-Instruct-FP8

Это квантованная версия EssentialAI/RnJ-1-Instruct FP8, созданная с использованием llmcompressor (Neural Magic). Ключевые преимущества: — Размер модели меньше на...

Генерация текста

Doradus-AI/Hermes-4.3-36B-FP8

Это квантованная версия NousResearch/Hermes-4.3-36B FP8, созданная с использованием llmcompressor (Neural Magic). Основные преимущества: — Размер модели меньше примерно...

Генерация текста

unsloth/DeepSeek-V3.1-Base

DeepSeek-V3.1 — это гибридная модель, поддерживающая как режим мышления, так и режим без мышления. По сравнению с предыдущей...

Генерация текста

unsloth/Kimi-K2-Base

> [!NOTE] > Включает исправления шаблонов чата! Для llama.cpp используйте —jinja > Unsloth Dynamic 2.0 обеспечивает превосходную точность...

Генерация текста

nvidia/Qwen3-235B-A22B-FP8

Модель NVIDIA Qwen3-235B-A22B FP8 представляет собой квантованную версию модели Qwen3-235B-A22B от Alibaba, которая представляет собой авторегрессионную языковую модель,...

Генерация текста

RedHatAI/gemma-2-9b-it-FP8

— Архитектура модели: Gemma 2 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое...

Генерация текста

RedHatAI/Phi-3-medium-128k-instruct-FP8

— Архитектура модели: Phi-3 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...