Poet-7B-TR
Bu model bulabildiğim en fazla Türkçe token ile eğitilmiş olan facebook/xglm-7.5B modelinin QLora kullanılarak fine-tune edilmiş hali. Buradaki...
Bu model bulabildiğim en fazla Türkçe token ile eğitilmiş olan facebook/xglm-7.5B modelinin QLora kullanılarak fine-tune edilmiş hali. Buradaki...
This is a Hugging Face transformers-compatible conversion of the original dense 6.7B-parameter model from the paper «Efficient Large...
This is a Hugging Face transformers-compatible conversion of the original dense 2.7B-parameter model from the paper «Efficient Large...
Fairseq-dense 2.7B-Janeway is a finetune created using Fairseq’s MoE dense model. The training data contains around 2210 ebooks,...
Fairseq-dense 13B-Nerys — это тонкая настройка, созданная с использованием плотной модели Fairseq MoE. Данные обучения содержат около 2500...
Fairseq-dense 6.7B-Janeway — это тонкая настройка, созданная с использованием плотной модели Fairseq MoE. Данные обучения содержат около 2210...
Эта модель представляет собой модель xglm-7.5b, настроенную на наборе данных инструкций crosslingual.jsonl из laion/Anh`. Межъязыковую модель anh-xglm-7.5b можно...
Это совместимое с преобразователями Hugging Face преобразование исходной плотной модели со 125M параметрами из статьи «Эффективное крупномасштабное языковое...
Это совместимое с преобразователями Hugging Face преобразование исходной плотной модели с параметрами 1,3B из статьи «Эффективное крупномасштабное языковое...
Это совместимое с преобразователями Hugging Face преобразование исходной плотной модели с 355M параметрами из статьи «Эффективное крупномасштабное языковое...