Athena-3-14B
Athena-3 🚀 Faster, Sharper, Smarter than Athena 1 and Athena 2🌟 Athena-3-14B is a 14.0-billion-parameter causal language model...
Athena-3 🚀 Faster, Sharper, Smarter than Athena 1 and Athena 2🌟 Athena-3-14B is a 14.0-billion-parameter causal language model...
Model description: STEMerald-2b is a fine-tuned version of the Gemma-2b model, designed specifically for answering university-level STEM multiple-choice...
> Capella-Qwen3-DS-V3.1-4B is a reasoning-focused model fine-tuned on Qwen-4B using DeepSeek v3.1 synthetic traces (10K). > It specializes...
В этом документе представлены технические характеристики, методологии обучения и архитектура вывода для модели MAXWELL. Представленные данные являются эмпирическими...
Обучение с помощью Golden Goose: простой трюк для синтеза неограниченного количества задач RLVR из непроверяемого интернет-текста GooseReason‑4B‑Instruct —...
> Bootes-Qwen3Coder-Reasoning — это доработанный вариант архитектуры Qwen3-4B, оптимизированный для высокоточного анализа кода и структурированного логического выполнения задач....