Метка: granitemoe - Каталог нейросетей

Метка: granitemoe

Генерация текста

lianghsun/Marble-3B

Мрамор-3B или IBM-гранит/гранит-3.1-3b-a800m-основание (IBM Granite 3.1 3B-A800M) МООС)為基底,針對繁體中文與中華民國台灣語境完成持續預訓練(CPT)之 МООС 基底模型,作為Marble-3B-Instruct 等下游模型的繁中底座。 > ⚠️ 規格重點: > 本模型為 3B Сочетание...

Генерация текста

ibm-granite/granite-3.0-3b-a800m-base

Краткое описание модели: Granite-3.0-3B-A800M-Base — это языковая модель, предназначенная только для декодера и поддерживающая различные задачи преобразования текста...

Генерация текста

allura-org/MoE-Girl-800MA-3BT

!сделано с помощью hassakuXL в sd-webui-forge Тонкая настройка IBM Granite 3.0 3B-A800M, ориентированная на ролевые игры. Тонкую настройку...

Генерация текста

ibm-granite/granite-3.0-1b-a400m-base

Краткое описание модели: Granite-3.0-1B-A400M-Base — это языковая модель, предназначенная только для декодера и поддерживающая различные задачи преобразования текста...

Генерация текста

ibm-granite/granite-guardian-3.2-3b-a800m

Granite Guardian 3.2 3B-A800M — это усовершенствованная модель инструкций Granite 3.2 3B-A800M, предназначенная для обнаружения рисков в подсказках...

Генерация текста

ibm-granite/granite-3.1-1b-a400m-base

Краткое описание модели: Granite-3.1-1B-A400M-Base увеличивает длину контекста Granite-3.0-1B-A400M-Base с 4 КБ до 128 КБ, используя стратегию прогрессивного обучения,...

Генерация текста

ibm-granite/granite-3.1-3b-a800m-base

Краткое описание модели: Granite-3.1-3B-A800M-Base увеличивает длину контекста Granite-3.0-3B-A800M-Base с 4 КБ до 128 КБ, используя стратегию прогрессивного обучения,...

Генерация текста

allura-org/MoE-Girl_400MA_1BT

!R8sd3.5L00001_.webp — тонкая настройка Granite 3.0 от IBM, предназначенная для ролевых игр (и, возможно, для общих случаев использования,...

Генерация текста

ibm-granite/granite-3.1-1b-a400m-instruct

Краткое описание модели: Granite-3.1-1B-A400M-Instruct — это модель инструкций с длинным контекстом с 8 параметрами, точно настроенная на основе...

Генерация текста

ibm-research/PowerMoE-3b

PowerMoE-3B — это 3B языковая модель с разреженной смесью экспертов (sMoE), обученная с помощью планировщика скорости обучения Power....