mpt-30b-instruct-q8
Эти файлы представляют собой файлы моделей формата .safetensors для MosaicML MPT-30B-Instruct. MPT-30B-Instruct — это модель для выполнения кратких...
Эти файлы представляют собой файлы моделей формата .safetensors для MosaicML MPT-30B-Instruct. MPT-30B-Instruct — это модель для выполнения кратких...
Эта версия hivemind/gpt-j-6B-8bit точно настроена на проанализированную версию набора данных ежедневных диалогов для эпохи. Его можно использовать как...
Это nex-agi/Nex-N2-mini, преобразованный в формат MLX, квантованный с помощью схемы смешанной точности oMLX oQ8 и дополненный головкой прогнозирования...
8-битное базовое квантование смешанной точности Qwen/Qwen3.6-27B для Apple Silicon с использованием стратегии квантования Unsloth Dynamic через mlx-node. Проведено...
Эта модель mlx-community/IQuest-Coder-V1-40B-Instruct-8bit была преобразована в формат MLX из IQuestLab/IQuest-Coder-V1-40B-Instruct с использованием mlx-lm версии 0.30.0. Модальности:Генерация текста Области...
我们在做什么: — 推理加速:实现了 Eagle3 для обучения на Qwen3-8B (более 20 000 загрузок),显著提升LLM推理速度 — Производительность графического процессора: AIGC, поддержка...
— Архитектура модели: Qwen3VLForConditionalGeneration — Входные данные: текст, изображение — Выходные данные: текст — Оптимизация модели: — Квантование...
Добро пожаловать в серию gpt-oss, модели OpenAI с открытым весом, предназначенные для эффективных рассуждений, агентских задач и универсальных...
Эта модель mlx-community/Qwen3-Coder-30B-A3B-Instruct-8bit была преобразована в формат MLX из Qwen/Qwen3-Coder-30B-A3B-Instruct с использованием mlx-lm версии 0.26.1. Модальности:Генерация текста Области...
Эта модель mlx-community/GLM-4-32B-0414-8bit была преобразована в формат MLX из THUDM/GLM-4-32B-0414 с использованием mlx-lm версии 0.23.1. Модальности:Генерация текста Области...