— TinyLlama-1.1B доработан для решения простых задач и имеет приемлемое качество разговора. — Использован высококачественный набор данных с открытым исходным кодом. — Может работать на TensorRT-LLM на потребительских устройствах. — Может вписываться в dGPU ноутбуков с >=6 ГБ видеопамяти. Эту модель можно запустить с помощью Jan Desktop на Mac, Windows или Linux. — 💻 100% оффлайн на вашем компьютере: ваши разговоры остаются конфиденциальными и видны только вам. — 🗂️ Открытый формат файла: разговоры и настройки модели остаются на вашем компьютере и могут быть экспортированы или удалены в любое время. — 🌐 Совместимость с OpenAI: локальный сервер на порту 1337 с конечными точками, совместимыми с OpenAI. — 🌍 Открытый исходный код и бесплатно: мы создаем общедоступно; посетите наш Github Ян верит в необходимость экосистемы ИИ с открытым исходным кодом и создает инфраструктуру и инструменты, позволяющие ИИ с открытым исходным кодом конкурировать на равных с проприетарными. Долгосрочная цель Яна — создать когнитивную основу для будущих роботов, которые станут практичными и полезными помощниками для людей и бизнеса в повседневной жизни. Во время обучения использовались следующие гиперпараметры: — скорость обучения: 5e-07 — trainbatchsize: 2 — evalbatchsize: 4 — начальное число: 42 — распределенный тип: multi-GPU -…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: jan-hq
Теги: tensorboard, llama, alignment-handbook, generated_from_trainer, trl, sft, conversational, text-generation-inference
Лайков: 5 | Загрузок: 9
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.