MLX-оптимизированная 4-разрядная квантованная версия Tencent/Youtu-LLM-2B для Apple Silicon. — Базовая модель: tencent/Youtu-LLM-2B — Параметры: 1.96B — Квантование: 4-бит (4.5 бит/вес) — Контекст: 128K токенов — Архитектура: Dense MLA (Multi-head Latent Attention) — Фреймворк: MLX (Apple Silicon optimized) — Режим рассуждений: использует теги для Chain of Thought — 128K Контекст: Понимание длинного документа — Agentic: Strong on SWE-Bench, GAIA benchmarks — Edge-friendly: Работает на любом Apple Silicon Mac Конвертируется с использованием deepseek_v2 architecture mapping (совместимая реализация MLA).
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат
Задача: Генерация текста
Автор: mlx-community
Теги: mlx-lm, deepseek_v2, mlx, apple-silicon, tencent, youtu, reasoning, mla
Лайков: 4 | Загрузок: 40
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.