Qwen3-VL-235B-A22B-Instruct-FP8-dynamic
— Model Architecture: Qwen3VLMoeForConditionalGeneration — Input: Text/Image/Video — Output: Text — Model Optimizations: — Weight quantization: FP8 —...
— Model Architecture: Qwen3VLMoeForConditionalGeneration — Input: Text/Image/Video — Output: Text — Model Optimizations: — Weight quantization: FP8 —...
— Архитектура модели: Qwen3NextForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
— Архитектура модели: NemotronHForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...
— Архитектура модели: ApertusForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
— Архитектура модели: Qwen3VLForConditionalGeneration — Входные данные: текст, изображение — Выходные данные: текст — Оптимизация модели: — Квантование...
Это квант высочайшего качества, который может работать на 192 ГБ видеопамяти > [!TIP] > 💡Это родственная модель mratsim/MiniMax-M2.1-FP8-INT4-AWQ...
Это квант высочайшего качества, который может работать на 192 ГБ видеопамяти > [!TIP] > 💡 Версия без FP8...
— Архитектура модели: Qwen3NextForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
— 15 февраля 2026 г.: требуется обеспечить качество — пакетный размер = 1 (поток) и добавлен греческий язык...
Это квант высочайшего качества, который может работать на 192 ГБ видеопамяти > [!TIP] > 💡 Версия без FP8...