Новейшая модель рассуждения/мышления RekaAI «Reka-Flash 3» с «Neo Imatrix» и квантованием «Maxed out» для улучшения общей производительности. Эта модель также необычайно сильна даже на самых маленьких квантовых уровнях, а с расширением теперь еще сильнее и может решать проблемы до 50% быстрее, чем нерасширенные кванты. Эта модель рассуждения, по-видимому, способна решать проблемы быстрее и точнее, чем другие проверенные модели рассуждения. Это также «температура/рассуждение» СТАБИЛЬНО. Это означает, что вы можете использовать разные температуры (в отличие от узкого диапазона от 0,4 до 0,8), чтобы получить убедительные аргументы и надежную генерацию результатов. В этой модели используются теги «» (удалить пробелы) и «» (удалить пробелы), созданные самостоятельно. Вы также можете добавить «» (удалить пробелы) в качестве дополнительного «стоп-токена». Более подробную информацию, тесты и методы работы см. в репозитории исходной модели: это означает, что выходной тензор установлен на «BF16» (полная точность) для всех квантов. Это повышает качество, глубину и общую производительность за счет немного большего количества. Мощный, собственный набор данных imatrix, созданный David_AU, который обеспечивает лучшее общее функционирование, следование инструкциям, качество вывода и более прочные связи…
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Следование инструкциям Диалог / чат
Задача: Генерация текста
Автор: DavidAU
Теги: gguf, NEO Imatrix, MAX Quants, GGUF, uncensored, reasoning, thinking, r1
Лайков: 57 | Загрузок: 1,205
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.