Llama-3.1-Nemotron-Nano-4B-v1.1
Unsloth Dynamic 2.0 обеспечивает превосходную точность и превосходит другие ведущие методы количественного анализа. Llama-3.1-Nemotron-Nano-4B-v1.1 — это модель большого...
Unsloth Dynamic 2.0 обеспечивает превосходную точность и превосходит другие ведущие методы количественного анализа. Llama-3.1-Nemotron-Nano-4B-v1.1 — это модель большого...
Коллекция многоязычных моделей больших языков (LLM) Meta Llama 3.1 представляет собой коллекцию предварительно обученных и настроенных на инструкции...
Исходная модель: https://huggingface.co/nvidia/Llama-3_1-Nemotron-Ultra-253B-v1. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
Наш новейший метод квантования представляет собой высокоточное адаптивное квантование для моделей со сверхмалой разрядностью (1–2 бита) с проверенными...
Модель mlx-community/Llama-3.2-1B-Instruct-MLXTuned была преобразована в формат MLX из мета-llama/Llama-3.2-1B-Instruct с использованием mlx-lm версии 0.20.5. Модальности:Генерация текста Области применения:Диалог...
Модель mlx-community/Llama-3.3-70B-Instruct-6bit была преобразована в формат MLX из мета-llama/Llama-3.3-70B-Instruct с использованием mlx-lm версии 0.20.1. Модальности:Генерация текста Области применения:Диалог...
Эта модель представляет собой квантованную GGUF версию языковой модели, специфичной для страхового домена, на основе Nvidia Llama 3-ChatQA,...
Модель mlx-community/Llama-3.1-8B-Instruct была преобразована в формат MLX из мета-llama/Llama-3.1-8B-Instruct с использованием mlx-lm версии 0.18.2. Модальности:Генерация текста Области применения:Диалог...
Модель mlx-community/Llama-3.2-1B-Instruct-bf16 была преобразована в формат MLX из мета-llama/Llama-3.2-1B-Instruct с использованием mlx-lm версии 0.17.1. Модальности:Генерация текста Области применения:Диалог...
Чистые квантования .gguf Q40 и Q80 моделей Llama 3.2, готовые к использованию с помощью llama3.java. В реальных условиях...