internlm2-chat-7b-4bits
LMDeploy использует алгоритм AWQ для 4-битного квантования только по весу. Благодаря разработке высокопроизводительного ядра cuda вывод 4-битной квантовой...
LMDeploy использует алгоритм AWQ для 4-битного квантования только по весу. Благодаря разработке высокопроизводительного ядра cuda вывод 4-битной квантовой...
Модель генерации текста Модальности:Генерация текста Задача: Генерация текста Автор: waldie Теги: Yi, feature-extraction, roleplay, custom_code, en, not-for-all-audiencesЛайков: 4...
Эта модель представляет собой доработанную версию EleutherAI/polyglot-ko-12.8b на KULLM v2 — скорость обучения: 5e-05 — размер пакета поездов:...
Целью этой модели является проверка преобразования между Мегатроном-ЛМ и трансформаторами. Это небольшая модель, которая использовалась для отладки сценария....
Эта модель mlx-community/Kimi-K2.7-Code-mlx-DQ3KM-q8 была преобразована в формат MLX из Moonshotai/Kimi-K2.7-Code с использованием mlx-lm версии 0.31.3. После успеха первой...
Это совместный выпуск Z-Lab, Modal и SGLang. Черновая модель зеркально отображается в следующих репозиториях Hugging Face: — z-lab/Qwen3.5-397B-A17B-DFlash...
Этот репозиторий содержит черновую модель Domino/DFlash для спекулятивного декодирования с помощью Qwen/Qwen3-4B. Проект модели не предназначен для использования...
👾 Программа лучших моделей LM Studio Community. Выделение новых и заслуживающих внимания моделей сообществом. Присоединяйтесь к обсуждению в...
Исходная модель: https://huggingface.co/nomic-ai/nomic-embed-code. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
xVerify — это инструмент оценки, созданный на основе предварительно обученной модели большого языка и разработанный специально для объективных...