KRLabsOrg/squeez-2b - Каталог нейросетей
Генерация текста

KRLabsOrg/squeez-2b

Добавлено:
KRLabsOrg/squeez-2b

Squeez-2B — это модель с параметрами 2B, доработанная на основе Qwen 3.5 2B для сокращения выходных данных инструмента в соответствии с задачами в агентах кодирования. Учитывая сфокусированный запрос и одно необработанное наблюдение инструмента, он извлекает наименьший блок дословных доказательств, который агент должен проверить следующим — удаляя 92% входных токенов, сохраняя при этом 0,86 отзыва. — Превосходит Qwen 3.5 35B A3B с нулевым выстрелом на +11 баллов отзыва — Возвращает только дословные строки (без переписывания или обобщения) — Работает как канал CLI, библиотеку Python или сервер vLLM — Обучение на 27 типах инструментов из реальных рабочих процессов SWE-bench и синтетических результатов мультиэкосистемы Оценивается на 618 тщательно отобранных вручную примерах, охватывающих 27 типов инструментов. Точно настроенная модель 2B также является наиболее точной системой в сравнении, что указывает на то, что она изучила политику извлечения для конкретного инструмента, а не полагается на следование общим инструкциям. На 59 отрицательных примерах в тестовом наборе Squeez-2B правильно возвращает пустой вывод в 80% случаев. Qwen 35B возвращается пустым только в 7% случаев. Ввод — сообщения чата с системной подсказкой: — Система: инструкции по извлечению (см. выше) — Пользователь: {task}n{rawoutput}`, производная от SWE-bench (14): readfile | греп | gitlog | гитблейм | гидифф | тестовый вывод |…

Модальности:
Генерация текста

Области применения:
Генерация кода Диалог / чат


Задача: Генерация текста
Автор: KRLabsOrg
Теги: qwen3_5, image-text-to-text, code, tool-output, pruning, coding-agents, extraction, conversational
Лайков: 5  |  Загрузок: 112

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.