Apollo-1-2B — это модель с 2 миллиардами параметров, настроенная с помощью инструкций, разработанная Noema Research. Он основан на Qwen3-1.7B и оптимизирован для общих рассуждений, понимания языка и легкого развертывания. Эта модель является первой версией серии Apollo, задуманной как основа для масштабируемых экспериментов и реальных приложений в ограниченных средах. — Настроенные инструкции: более надежные ответы в диалоговых и ориентированных на задачи настройках — Легкое развертывание: оптимизировано для сред с ограниченными вычислительными ресурсами или ресурсами памяти — Расширенный контекст: наследует возможности долгого контекста от базы Qwen3 — Сбалансированные выходные данные: улучшенное поведение при отказе и уменьшение количества галлюцинаций по сравнению с базовой моделью — Многоязычные возможности: сохраняются многоязычные знания из семейства Qwen3 Apollo-1-2B прошел внутреннюю оценку по ряду логических и языковых задач. Основные выводы: Улучшенное выполнение инструкций по сравнению с Qwen3-1.7B. Более лаконичные и точные ответы на структурированные задачи. Сохранение многоязычной производительности базовой модели. Эффективен для облегченных приложений-помощников. Будущая работа будет включать публикацию подробных сравнений производительности с другими…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: Loom-Labs
Теги: qwen3, text-generation-inference, unsloth, conversational, en, fr, pt, de
Лайков: 5 | Загрузок: 27
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.