Youtu-LLM-2B-4bit
MLX-оптимизированная 4-разрядная квантованная версия Tencent/Youtu-LLM-2B для Apple Silicon. — Базовая модель: tencent/Youtu-LLM-2B — Параметры: 1.96B — Квантование: 4-бит...
MLX-оптимизированная 4-разрядная квантованная версия Tencent/Youtu-LLM-2B для Apple Silicon. — Базовая модель: tencent/Youtu-LLM-2B — Параметры: 1.96B — Квантование: 4-бит...
> Это модель 3B-A400M-Base. Ознакомьтесь с моделью 1B-A90M-Base и посттренированной версией вашей модели. Модели neo-3-1B-A90M и 3B-A400M являются...
INTELLECT-3: A 100B+ MoE trained with large-scale RL Trained with prime-rl and verifiers Environments released on Environments Hub...
This model mlx-community/Ouro-2.6B-Thinking-4bit was converted to MLX format from ByteDance/Ouro-2.6B-Thinking using mlx-lm version 0.28.4. Модальности:Генерация текста Области применения:Логика...
Helion-OSC (Optimized Semantic Compiler) is a specialized language model designed for code generation and mathematical reasoning. Unlike traditional...
All quants made using imatrix option with dataset from here combined with a subset of combinedallsmall.parquet from Ed...
Это точно настроенная версия Qwen/Qwen3-14B, специально оптимизированная для медицинских инструкций,рассуждений и принятия клинических решений. Модель была обучена на...
Генератор UML: Qwen3-4B-Thinking-2507, Qwen3-14B, gpt-oss-20b, gpt-oss-120b Генератор UML — одна из наших моделей экспериментального рассуждения с пользовательским форматом...
Генератор UML: Qwen3-4B-Thinking-2507, Qwen3-14B, gpt-oss-20b, gpt-oss-120b Генератор UML — одна из наших моделей экспериментального рассуждения с пользовательским форматом...
JET-1.5B is designed to improve the efficient reasoning of LLMs by training the base DeepSeek-Distill-Qwen-1.5B model with a...