Qwen3-1.7B-SFT
Qwen3-1.7B-SFT is a supervised fine-tuned model based on Qwen3-1.7B-Base, trained on the OpenThought3-Qwen3-4B dataset for mathematical reasoning and...
Qwen3-1.7B-SFT is a supervised fine-tuned model based on Qwen3-1.7B-Base, trained on the OpenThought3-Qwen3-4B dataset for mathematical reasoning and...
Точная настройка полнопараметрического рассуждения HuggingFaceTB/SmolLM2-135M-Instruct с использованием 5000 примеров, выбранных из SupraLabs/reasoning-corpus-4K-5M-v1. Модель была обучена размещать след рассуждений...
FabGemma-12B — это усовершенствованная оптимизация Google Gemma 4 12B Instruct, основанная на рассуждениях. Он был специально настроен для...
Мы рады представить AceReason-Nemotron-1.1-7B (дата выпуска: 16 июня 2025 г.), модель математического и кодового рассуждения, построенную на базе...