PokeeResearch-7B — это агент глубоких исследований с 7 миллиардами параметров, разработанный Pokee AI для продвижения надежных, согласованных и масштабируемых рассуждений исследовательского уровня в LLM, дополненных инструментами. Модель объединяет обучение с подкреплением на основе обратной связи ИИ (RLAIF) с надежной основой для рассуждений, что позволяет ей проводить сложные многоэтапные исследовательские рабочие процессы, включающие самокоррекцию, проверку и синтез в нескольких независимых исследовательских потоках. — Разработано: Pokee AI — Тип модели: Исследовательский агент большой языковой модели (LLM), дополненной инструментами — Язык(и): английский, китайский и многие другие — Лицензия: Apache 2.0 — Точная настройка на основе модели: Qwen2.5-7B-Instruct — Репозиторий: https://github.com/Pokee-AI/PokeeResearchOSS — Документ: PokeeResearch: Эффективное глубокое исследование через подкрепление обучения на основе обратной связи ИИ и Robust Reasoning Scaffold, Pokee AI, октябрь 2025 г. — Страница проекта: https://pokee.ai/deepresearch-preview PokeeResearch-7B оптимизирован для обоснования фактов и надежности, но ограничения включают в себя: — Зависимость от качества внешних данных и точности извлечения — Потенциальное семантическое смещение, вызванное сигналами обратной связи на основе искусственного интеллекта — Ограниченное покрытие для неанглоязычных или мультимодальных задач рассуждения —…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: PokeeAI
Теги: qwen2, agent, deepresearch, llm, rl, reinforcementlearning, conversational, en
Лайков: 99 | Загрузок: 1,308
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.