A 60M parameter language model trained on 22 60M` tokens from FineWeb-Edu dataset. aixsim-60M is a transformer-based language model with approximately 60 million parameters (embedding layer params excluded). It uses RMSNorm for normalization and is trained on the FineWeb-Edu dataset. — Developed by: AICrossSim — Funded by: ARIA — Model type: Transformer Language Model — Language(s) (NLP): English — Tokenizer: HuggingFaceTB/cosmo2-tokenizer — Repository: AICrossSim/NewComputeBench Experiment setup and training logs can be found at wandb run.
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: AICrossSim
Теги: llama, language-model, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 618
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.