Небольшая локальная модель, которая читает английский текст и выдает строгий, машиночитаемый JSON: резюме, ключевые слова, дату публикации (если таковая имеется), список атомных претензий (каждая типизирована, категоризирована, помечена позицией/настроением, привязана к дословным доказательствам, с вопросами проверки фактов расследования) и противоречия между претензиями. Построен как структурированный интерфейс конвейера обнаружения слухов /дезинформации. Этот репозиторий полностью автономен — здесь есть модель, токенизатор, GGUF, грамматика, подсказка, схема, корпус, тесты и скрипты; больше ничего не требуется. — Студент: unsloth/Qwen2.5-3B-Instruct-bnb-4bit (QLoRA fine-tune) Q4KM → GGUF (~2 ГБ), который работает на 4 ГБ GPU или CPU, в автономном режиме. — Преподаватель (дистилляция): Qwen/Qwen2.5-14B-Instruct. — Всегда действительный JSON: грамматика GBNF (claim.gbnf) ограничивает декодирование, доступное для синтаксического анализа → на 100% входных данных. — Только на английском языке. Никаких вердиктов об истине — это касается того, что проверять, а не того, является ли утверждение истинным. — Извлечение формулы (явное неявное), разложение составного предложения, краткие перефразированные формулы. — Типизация (факт/статистика/мнение/прогноз/спекуляция/риторика/другое), позиция (утверждается/отрицается/хеджируется/приписывается/ирония), настроение…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: Luimas
Теги: gguf, qwen2, claim-extraction, fact-checking, misinformation, contradiction-detection, sarcasm-detection, json
Лайков: 4 | Загрузок: 414
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.