Bielik-4.5B-v3.0-Instruct-FP8-Dynamic
Эта модель была получена путем квантования весов и активаций Bielik-4.5B-v3.0-Instruct для типа данных FP8, готового к выводу с...
Эта модель была получена путем квантования весов и активаций Bielik-4.5B-v3.0-Instruct для типа данных FP8, готового к выводу с...
Эта версия hivemind/gpt-j-6B-8bit точно настроена на проанализированную версию набора данных ежедневных диалогов для эпохи. Его можно использовать как...
> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на...
> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на...
Этот репозиторий содержит текстовую 8-битную MLX-конверсию FINAL-Bench/Darwin-36B-Opus. Модель была преобразована с помощью mlx-lm и предназначена для эффективного вывода...
Эта модель была получена путем квантования весов и активаций Bielik-11B-v3.0-Instruct для типа данных FP8, готового к выводу с...
Иматричное квантование Llama.cpp deepseek-ai/DeepSeek-Coder-V2-Instruct Исходная модель: deepseek-ai/DeepSeek-Coder-V2-Instruct Исходный тип dtype: BF16 (bfloat16) Квантование: llama.cpp b3166 Набор данных IMatrix:...
> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на...
> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на...
Эта модель представляет собой преобразованную версию TheDrummer/Gemmasutra-Mini-2B-v1, оптимизированную для вывода на устройстве с использованием LiteRT (ранее TensorFlow Lite)....