Astra-v1-12B-GGUF
Astra-v1-12B is a fine-tuned version of the base model Mistral-Nemo-Base-2407, developed for general-purpose natural language processing tasks. It...
Astra-v1-12B is a fine-tuned version of the base model Mistral-Nemo-Base-2407, developed for general-purpose natural language processing tasks. It...
Nemotron-Cascade-2-30B-A3B ships with custom model code (modelingnemotronh.py) that has two bugs exposed by causalconv1d 1.6.x. These are bugs...
AWQ quantization: done by stelterlab in INT4 with llm-compressor (https://github.com/vllm-project/llm-compressor — v0.10.0.1) from the vllm-project. See recipe.yaml for...
We’re excited to introduce Nemotron-Cascade-2-30B-A3B, an open 30B MoE model with 3B activated parameters that delivers strong reasoning...
Pegasus-Opus-14B-Exp is based on the Qwen 2.5 14B modality architecture, designed to enhance the reasoning capabilities of 14B-parameter...
Универсальная модель с некоторыми возможностями рассуждения и поддержкой нескольких языков. Поддерживаемые языки: — английский — французский — немецкий...
Модель генерации текста Модальности:Генерация текста Области применения:Логика и рассуждение Диалог / чат Вызов функций (Tool use) Мультиязычность Задача:...
Эта модель mlx-community/Nemotron-Cascade-2-30B-A3B-6bit была конвертирована в формат MLX из nvidia/Nemotron-Cascade-2-30B-A3B с использованием mlx-lm версии 0.31.2. Модальности:Генерация текста Области...
Это черновой вариант модели EAGLE3, обученный с нуля (случайная инициализация) с использованием структуры обучения времени вывода Aurora для...
> Sombrero-QwQ-32B-Elite9 — это экспериментальная модель рассуждения общего назначения, основанная на архитектуре QwQ 32B от Qwen. Он оптимизирован...