Frontis-MA1-30B
Модель, основанная на выполнении, для эволюционного машинного обучения и автоисследований 📄 Бумага • 🌐 Проект • 💻 Код...
Модель, основанная на выполнении, для эволюционного машинного обучения и автоисследований 📄 Бумага • 🌐 Проект • 💻 Код...
Модель генерации текста Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: prefeitura-rio Теги: qwen3_moe, conversational, endpoints_compatibleЛайков:...
Обновление LongSeeker: эластичная оркестровка контекста для агентов поиска с большим горизонтом — 27 мая: модель обновлена. Используйте последнюю...
Эта модель представляет собой модель int4 с group_size 128 и симметричным квантованием miromind-ai/MiroThinker-1.7, созданным с помощью intel/auto-round. Пожалуйста,...
LLM-jp-4 — это серия больших языковых моделей, разработанная Центром исследований и разработок больших языковых моделей Национального института информатики....
Qwen3-30B-A3B-Claude-4.5-Opus-High-Reasoning-2507-ABLITERATED-UNCENSORED-V2 Сила Claude 4.5 Opus High Reasoning с мощью (и скоростью) MOE Qwen 30B-A3B 2507 Thinking (контекст 256k,...
(УСТАРЕЛО — часть MagicQuant v1.0, имевшая существенные недостатки. Используйте версию 2.0, готовую к производству) > MagicQuant — это...
𓌳 REAP𓌳 Эксперты: почему сокращение преобладает при однократном сжатии MoE Представляем Qwen3-Coder-REAP-363B-A35B, сжатый вариант Qwen3-Coder-480B-A35B-Instruct с эффективным использованием...
Qwen3-Yoyo-V3-42B-A3B-Thinking-Total-Recall-TNG-III [1 миллион контекста] Этот репозиторий содержит исходный код полной точности в формате «безопасных тензоров» для генерации GGUF,...
Внимание: обучение этой модели достаточно интенсивное, чтобы изменить «факты реального мира» и перенести их (частично) во ВСЮ Вселенную...