Метка: mamba - Страница 5 - Каталог нейросетей

Метка: mamba

Генерация текста

state-spaces/mamba-1.4b-hf

Этот репозиторий содержит трансформеры, совместимые с mamba-2.8b. Контрольные точки не тронуты, но полный файл config.json и токенизатор перенесены...

Генерация текста

state-spaces/mamba-370m-hf

Этот репозиторий содержит трансформеры, совместимые с mamba-2.8b. Контрольные точки не тронуты, но полный файл config.json и токенизатор перенесены...

Генерация текста

Q-bert/Mamba-3B

> Привет, я ищу новую работу. Работаю в компании уже около года. Вы должны использовать этот класс для...

Генерация текста

kuotient/mamba-ko-2.8b

!Mamba-ko-2.8B Mamba-ko-2.8B — это модель пространства состояний, дополнительно предварительно обученная (или непрерывно обучаемая) с использованием синтетически сгенерированного набора...

Генерация текста

nvidia/mamba2-8b-3t-4k

Мы выпускаем 8B-параметрическую модель Mamba-2 и Mamba-2-Hybrid (состоящую из слоев Mamba-2, внимания и MLP), обученную для статьи «Эмпирическое...

Генерация текста

TechxGenus/Mini-Jamba-v2

[Экспериментальная версия] Мы инициализировали модель по Джамбе, но с гораздо меньшими параметрами. Затем он был обучен с использованием...

Генерация текста

Q-bert/Mamba-1B

> Привет, я ищу новую работу. Работаю в компании уже около года. Вы должны использовать этот класс для...

Генерация текста

TechxGenus/Mini-Jamba

[Экспериментальная версия] Мы инициализировали модель по Джамбе, но с гораздо меньшими параметрами. Затем он был обучен с использованием...

Генерация текста

nvidia/mamba2-hybrid-8b-3t-128k

Мы выпускаем 8B-параметрическую модель Mamba-2 и Mamba-2-Hybrid (состоящую из слоев Mamba-2, внимания и MLP), обученную для статьи «Эмпирическое...

Генерация текста

TRI-ML/mamba-7b-rw

Это модель с параметрами 7B с архитектурой Mamba, обученная на нескольких эпохах (токены 1,2T) набора данных RefinedWeb. Мамба...