Llama-3.3-8B-Thinking-Gemini-Flash-11000x-128k
Кто-то нашел исходный код «Llama3.3-8B» (никогда не публиковавшийся публично) в «дикой» среде, затем он был скорректирован обратно до...
Кто-то нашел исходный код «Llama3.3-8B» (никогда не публиковавшийся публично) в «дикой» среде, затем он был скорректирован обратно до...
Модель генерации текста Модальности:Генерация текста Области применения:Логика и рассуждение Диалог / чат Вызов функций (Tool use) Мультиязычность Задача:...
Генератор UML: Qwen3-4B-Thinking-2507, Qwen3-14B, gpt-oss-20b, gpt-oss-120b Генератор UML — это одна из наших моделей экспериментального рассуждения с настраиваемым...
Генератор UML: Qwen3-4B-Thinking-2507, Qwen3-14B, gpt-oss-20b, gpt-oss-120b Генератор UML — это одна из наших моделей экспериментального рассуждения с настраиваемым...
TRIDENT — это языковая модель с 4B параметрами, ориентированная на рассуждения, которая улучшает свои собственные возможности рассуждения за...
Модель была обучена на объединенном наборе данных задач программирования на Python (из MBPP и opc-sft-stage2) и задач по...
JET-7B предназначен для повышения эффективности рассуждений LLM путем обучения базовой модели DeepSeek-Distill-Qwen-7B с помощью структуры обучения с подкреплением....
Это квантованная GGUF версия языковой модели Qwen/Qwen3-4B — мощного LLM с 4 миллиардами параметров из серии Qwen от...
Эта модель mlx-community/Hermes-4-14B-4bit была конвертирована в формат MLX из NousResearch/Hermes-4-14B с использованием mlx-lm версии 0.27.0. Модальности:Генерация текста Области...
Этот репозиторий содержит квантованные версии модели GetSoloTech/Gemma3-Code-Reasoning-4B GGUF (GGML Universal Format), оптимизированные для локального вывода с различными уровнями...