Kimi-Linear-48B-A3B-Instruct-AWQ-8bit
Kimi Linear: An Expressive, Efficient Attention Architecture (a) On MMLU-Pro (4k context length), Kimi Linear achieves 51.0 performance...
Kimi Linear: An Expressive, Efficient Attention Architecture (a) On MMLU-Pro (4k context length), Kimi Linear achieves 51.0 performance...
Эта модель mlx-community/Kimi-Linear-48B-A3B-Instruct-4bit была конвертирована в формат MLX из Moonshotai/Kimi-Linear-48B-A3B-Instruct с использованием mlx-lm версии 0.28.4. Модальности:Генерация текста Области...
𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем Kimi-Linear-REAP-35B-A3B-Instruct, сжатый вариант Kimi-Linear-48B-A3B-Instruct с эффективным использованием...
Kimi Linear: выразительная и эффективная архитектура внимания (a) На MMLU-Pro (длина контекста 4 КБ) Kimi Linear достигает производительности...
Kimi Linear: выразительная и эффективная архитектура внимания (a) На MMLU-Pro (длина контекста 4 КБ) Kimi Linear достигает производительности...