C3-Context-Cascade-Compression
Не стесняйтесь обращаться ко мне по электронной почте liufanfan19@mails.ucas.ac.cn, если у вас есть какие-либо вопросы. — DeepSeek-OCR: идея...
Не стесняйтесь обращаться ко мне по электронной почте liufanfan19@mails.ucas.ac.cn, если у вас есть какие-либо вопросы. — DeepSeek-OCR: идея...
1. Доступ к точке входа vllm в формате vllm. 2. Доступ к точке входа в vllm. GLM-4-9B-Chat-GPTQ-Int8-量化修复,这个模型更鲁棒。 GLM-4-9B...
— Название: BiMediX — Версия: 1.0 — Тип: Двуязычная медицинская смесь экспертов, большая языковая модель (LLM) — Языки:...
Генеративный предварительно обученный трансформатор с параметрами 1,5B для финского языка. Финские модели GPT-3 TurkuNLP представляют собой модельное семейство...
Модель генерации текста Модальности:Генерация текста Области применения:Генерация кода Задача: Генерация текста Автор: refactai Теги: codify, feature-extraction, code, generation,...
Nemotron-Labs-Diffusion — это трехрежимная языковая модель, которая поддерживает как AR-декодирование, так и параллельное декодирование на основе диффузии путем...
Это базовая модель Dream Coder 7B, которая представляет собой программу LLM с открытым распространением для кода с высочайшей...
Эта модель mlx-community/Qwen3-Embedding-0.6B-4bit-DWQ была преобразована в формат MLX из Qwen/Qwen3-Embedding-0.6B с использованием mlx-lm версии 0.24.1. Модальности:Генерация текста Области...
BELLE основан на Bloomz-7b1-mt и настроен с использованием 0,2 млн данных на китайском языке в сочетании с 50...
Генеративный предварительно обученный трансформатор с параметрами 881M для финского языка. Финские модели GPT-3 TurkuNLP представляют собой модельное семейство...