> II-Search-4B — это языковая модель с 4 миллиардами параметров, доработанная на основе Qwen3-4B специально для расширенного поиска информации и веб-интегрированных задач рассуждения, демонстрирующая сильные возможности многоскачкового поиска информации, проверки фактов и создания комплексных отчетов; он превосходит конкурентов по фактическим тестам качества, имеет сложные инструменты для поиска и посещения веб-сайтов, поддерживает распределенный вывод с помощью vLLM или SGLang (включая контекстное окно на 131 072 токена с настраиваемым масштабированием RoPE) и подходит для ответов на фактические вопросы, помощи в исследованиях и образовательных приложений благодаря поддержке Apple Silicon через MLX, примерам открытой интеграции и полным ресурсам, доступным в репозитории Hugging Face. (отсортировано по размеру, не обязательно по качеству. IQ-квант часто предпочтительнее, чем аналогичный по размеру не-IQ-квант) Вот удобный график, составленный ikawrakow и сравнивающий некоторые типы квантов более низкого качества (чем меньше, тем лучше):
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: prithivMLmods
Теги: gguf, qwen3, text-generation-inference, en, endpoints_compatible, conversational
Лайков: 5 | Загрузок: 529
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.