DLM-2.0-14B-FP8
This is an FP8-quantized version of dnotitia/DNA-2.0-14B, optimized for efficient inference by DLM (Data Science Lab., Ltd.). FP8...
This is an FP8-quantized version of dnotitia/DNA-2.0-14B, optimized for efficient inference by DLM (Data Science Lab., Ltd.). FP8...
— Model Architecture: Qwen3NextForCausalLM — Input: Text — Output: Text — Model Optimizations: — Weight quantization: INT4 —...
Этот репозиторий содержит Seed-OSS-36B-Instruct, квантованный с помощью NVFP4, подходящий для максимальной производительности на оборудовании Nvidia Blackwell (5070, 5080,...
— Model Architecture: MistralForCausalLM — Input: Text — Output: Text — Model Optimizations: — Activation quantization: FP8 —...
— Model Architecture: Qwen3ForCausalLM — Input: Text — Output: Text — Model Optimizations: — Activation quantization: FP8 —...
— Архитектура модели: Qwen3ForCausalLM — Вход: Текст — Выход: Текст — Оптимизация модели: — Квантование веса: INT4 —...
— Model Architecture: Qwen2 — Input: Text — Output: Text — Model Optimizations: — Activation quantization: INT8 —...
— Архитектура модели: Llama-3 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование активации:...
— Архитектура модели: Qwen3ForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...
— Архитектура модели: Qwen2ForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...