LLAMA-3.2-1B-OpenHermes2.5
This model is a fine-tuned version of meta-llama/Llama-3.2-1B on the OpenHermes-2.5 dataset. It is based on the Llama...
This model is a fine-tuned version of meta-llama/Llama-3.2-1B on the OpenHermes-2.5 dataset. It is based on the Llama...
NeuralPizza-7B-V0.1 is a fine-tuned version of the SanjiWatsuki/Kunoichi-7B model, specialized through Direct Preference Optimization (DPO). It was fine-tuned...
Компактная, быстро настраиваемая языковая модель, построенная на Qwen3-0.6B, настроенная для четкого пошагового рассуждения, согласованной идентичности и облегченной помощи...
INVALID LANGUAGE PAIR SPECIFIED. EXAMPLE: LANGPAIR=EN|IT USING 2 LETTER ISO OR RFC3066 LIKE ZH-CN. ALMOST ALL LANGUAGES SUPPORTED...
Text generation model Модальности:Генерация текста Области применения:Диалог / чат Вызов функций (Tool use) Задача: Генерация текста Автор: roshangrewal...
Qwen3.5-2B базовая модель üzerine Türkçe, следующая инструкциям verisiyle, тонкая настройка edilmiş bir dil modelidir. AlicanKiraz0/Turkish-SFT-Dataset-v1.0 — genel amaçlı...
Fine-tuned from DeepScaleR-1.5B. Surpasses it on every benchmark. 1.5B parameters. RTX 4080. Three-phase curriculum training. —|:———:|:———:|:———:|:————:|:————-:|:—:| Yumo Nano...
Первая тонкая настройка рассуждений Клода Опуса Qwen3.5-122B в полном масштабе. Улучшенное многоэтапное рассуждение, аналитическая глубина и выход без...
This model is a fine-tuned version of Qwen/Qwen3-1.7B optimized for mathematical reasoning on the GSM8K benchmark. For deployment...
Expected output: Something about roundhouse kicks and bug-free code. Results may vary. Confidence will not. Preliminary Observations: Document...