Infinigence/Megrez-3B-Instruct - Каталог нейросетей
Генерация текста

Infinigence/Megrez-3B-Instruct

Добавлено:
Infinigence/Megrez-3B-Instruct

🔗 GitHub&nbsp&nbsp | &nbsp&nbsp🏠 Infini-AI MaaS&nbsp&nbsp | &nbsp&nbsp📖 Официальный WeChat&nbsp&nbsp | &nbsp&nbsp💬 Группы WeChat&nbsp&nbsp 中文 | Английский Megrez-3B-Instruct是由无问芯穹(Infinigence AI)完全自主训练的大语言模型。Megrez-3B может использоваться в качестве источника питания, 打造一款Megrez-3B может быть заменен на Megrez-3B. 1. Производитель: Megrez-3B, заводская версия 3B, китайская версия 3B, китайская версия, китайская версия, китайская версия, китайская версия.差,将上一代14B 型的能力成功压缩进3B大小的模型, 在主流榜单上取得了优秀的性能表现。 2.高速度:模型小≠速度快。Megrez-3B通过软硬协同优化,确保了Гарантия на 300% 3.简单易用:模型设计之初我们进行了激烈的讨论: 应该在结构设计上留出更多软硬协同的空间(如ReLU、稀疏化、更精简的结构等),还是使用经典结构便于开发者直接用起来?我们选择了后者,即采用最原始的LLaMA结构,开发者无需任何修改便可将模型部署于各种平台,最小化二次开发复杂度。 4. Например, веб-поиск и веб-поиск.决策搜索调用时机,在搜索和对话中自动切换,并提供更好的总结效果。我们提供了完整的部署工程代码github, 用户可以基于该功能构建属于自己的Кими或Пер plexity, 克服小模型常见的幻觉问题和知识储备不足的局限。 Архитектура: Llama-2 с GQA Длина контекста: 32 000 токенов Параметры (всего): 2,92 Б Параметров (только магистральная сеть, без Emb или Softmax): 2,29 Б Размер словаря: 122 880 Обучающие данные: 3 Т токенов * Поддерживаемые языки: китайский и английский 我们使用开源评测工具 OpenCompass对 Megrez-3B-Instruct 进行了评测。部分评测结果如下表所示。 — Qwen2-1.5B может использоваться в качестве источника питания, Qwen2.5 может использоваться в качестве источника питания, а также в случае необходимости использования Qwen2.5. Загрузите файл READMSPEED.md, чтобы загрузить файл READMEPEED.md, который можно использовать для чтения файлов, а также для загрузки InfiniWebSearch.具有以下优势: 1.自动决定调用时机:自动决策搜索调用时机,在搜索和对话中自动切换,避免一直调用或一直不调用2.…

Модальности:
Генерация текста

Области применения:
Диалог / чат Следование инструкциям


Задача: Генерация текста
Автор: Infinigence
Теги: llama, conversational, en, zh
Лайков: 32  |  Загрузок: 27

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.