NVIDIA-Nemotron-3-Super-120B-A12B-MLX-Q9
См. NVIDIA-Nemotron-3-Super-120B-A12B MLX в действии – демонстрационное видео – Одиночный вывод ~33,7 токенов/с при 1000 токенов – Пакетный...
См. NVIDIA-Nemotron-3-Super-120B-A12B MLX в действии – демонстрационное видео – Одиночный вывод ~33,7 токенов/с при 1000 токенов – Пакетный...
Qx85 использует 5-битные хранилища данных и 8-битные пути внимания, внедрения и заголовок. Он был спроектирован так, чтобы соответствовать...
Эта модель mlx-community/GLM-4.7-Flash-8bit-gs32 была преобразована в формат MLX из zai-org/GLM-4.7-Flash с использованием mlx-lm версии 0.30.5. Модальности:Генерация текста Области...
Эта модель mlx-community/translategemma-27b-it-8bit была конвертирована в формат MLX из google/translategemma-27b-it с использованием mlx-lm версии 0.29.1. Модальности:Генерация текста Области...
Эта модель mlx-community/translategemma-4b-it-8bit была конвертирована в формат MLX из google/translategemma-4b-it с использованием mlx-lm версии 0.29.1. Модальности:Генерация текста Области...
Эта модель mlx-community/Orchestrator-8B-8bit была конвертирована в формат MLX из nvidia/Orchestrator-8B с использованием mlx-lm версии 0.28.4. Модальности:Генерация текста Области...
Квантованная версия GLM-4.6 с использованием LLM Compressor и формата NVFP4 (E2M1 + E4M3). Это должно стать началом новой...
Эта модель mlx-community/XBai-o4-8bit была конвертирована в формат MLX из MetaStoneTec/XBai-o4 с использованием mlx-lm версии 0.26.2. Модальности:Генерация текста Области...
Модель генерации текста Модальности:Генерация текста Области применения:Диалог / чат Генерация кода Следование инструкциям Задача: Генерация текста Автор: btbtyler09...
Эта модель mlx-community/Jan-nano-8bit была конвертирована в формат MLX из Menlo/Jan-nano с использованием mlx-lm версии 0.25.2. Модальности:Генерация текста Области...