QwQ-32B-Preview-8bit
Модель mlx-community/QwQ-32B-Preview-8bit была преобразована в формат MLX из Qwen/QwQ-32B-Preview с использованием mlx-lm версии 0.20.1. Модальности:Генерация текста Области применения:Диалог...
Модель mlx-community/QwQ-32B-Preview-8bit была преобразована в формат MLX из Qwen/QwQ-32B-Preview с использованием mlx-lm версии 0.20.1. Модальности:Генерация текста Области применения:Диалог...
Модель Marco-o1 предназначена для достижения успеха не только в структурированных дисциплинах, таких как математика, физика и программирование, которые...
Qwen2.5 — новейшая серия моделей большого языка Qwen. Для Qwen2.5 мы выпускаем ряд базовых языковых моделей и языковых...
— Архитектура модели: Meta-Llama-3 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...
Qwen1.5 — это бета-версия Qwen2, языковой модели только для декодера на основе преобразователя, предварительно обученной на большом объеме...
Querypls-Prompt2SQL — это модель генерации текста в SQL, разработанная samadpls. Он предназначен для генерации SQL-запросов на основе подсказок...
Ларт-Мистраль — первая LLM, основанная на этрусском языке, доработанная на основе 1087 оригинальных надписей. Ларт-Мистраль поддерживает межъязыковые инструкции...
ИНФОРМАЦИЯ: Эта модель представляет собой модель Falcon-40B-Instruct, квантованную с использованием битов и байтов. Это сэкономит вам около 40...
Это контрольная точка DeepSeek-V4-Flash-DSpark — модель MoE 284B с модулем спекулятивного декодирования (DSpark), настроенная и оцененная с помощью...
В этом репозитории размещена квантованная версия модели Qwen3.6-27B NVFP4. Процесс квантования выполнялся с использованием llm-compressor с использованием стратегии...