ВНИМАНИЕ: НФВ. Яркая проза. ИНТЕНСИВНЫЙ. Интуитивные детали. УЖАС. Ругаясь. БЕЗ ЦЕНЗУРЫ… юмор, романтика, веселье. Это модель LLama 3.2, максимальный контекст 128 КБ (131 000), с использованием группы экспертов для объединения ЧЕТЫРЕХ лучших моделей L3.2 3B в одну огромную электростанцию с параметрами 10B (что соответствует 12B — 4 X 3B). Следование инструкциям этой модели и создание результатов для творческого письма, прозы, художественной литературы и ролевых игр являются исключительными. И это быстро: 58+ т/с (2 эксперта) на младшей карте объемом 16 ГБ IQ4XS. Модель можно использовать также для всех жанров (примеры ниже это показывают). Эту модель также можно использовать для общего использования, однако ее выходные данные могут не подвергаться цензуре. Эта модель была разработана как относительно пуленепробиваемая и работает со всеми параметрами, включая настройки температуры от 0 до 5. Это необычная сжатая модель с очень низким уровнем сложности (ниже, чем Meta Llama3 Instruct). Последний пример показывает, как сделать модель немного более… хм, грубой и использовать 1,2,3 и 4 эксперта. — Способности писать детали, прозу и художественную литературу ЗАШИВАЮТ по сравнению со всеми моделями Llama 3.2 и многими моделями L 3.1, L3 8B+. — Для более разнообразной прозы (предложение/абзац/диалог) увеличьте температуру и/или…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: DavidAU
Теги: gguf, mixture of experts, moe, 4x3B, Llama 3.2 MOE, uncensored, creative, creative writing
Лайков: 74 | Загрузок: 3,055
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.