Первая точная настройка Qwen3.5-122B на основе Клода Опуса в полном масштабе. Улучшенное многоэтапное мышление, аналитическая глубина и результаты без цензуры — обучение там, где конкуренты не могут достичь. Всего 122B параметров, 10B активных на каждый токен (смесь экспертов). LoRA доработал 12 840 следов рассуждений Клода Опуса 4.6. 7 уровней квантования от Q2_K до BF16. Никто больше не настраивал Qwen3.5-122B на основе данных рассуждений Opus. Джекронг остановился на 27Б, потому что у них нет оборудования. Мы делаем. Направьте свой сервер на сервер llama.cpp, на котором работает любой квант. Полный API-интерфейс, совместимый с OpenAI, в /v1/chat/completions. Все шаги выполняются в BF16 изначально — без квантового обучения, без хаков по оптимизации. Если у вас есть 1,1 ТБ видеопамяти, вы используете ее. Использование графических процессоров 8×H200 не бесплатно. Каждое пожертвование напрямую финансирует выпуск большего количества моделей с открытым весом, улучшение методов удаления и расширение границ возможностей открытых моделей. Часть TIMTEH Cognitive Preservation Foundry — сохранение хирургических возможностей в больших масштабах. ⚡ Выковано на 8×NVIDIA H200 SXM5 | 1,1 ТБ видеопамяти
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат
Задача: Генерация текста
Автор: timteh673
Теги: gguf, qwen3.5, moe, uncensored, reasoning, fine-tuned, opus, claude
Лайков: 9 | Загрузок: 1,363
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.