Метка: int8 - Страница 2 - Каталог нейросетей

Метка: int8

Генерация текста

ENOT-AutoDL/gpt2-tensorrt

Этот репозиторий содержит модели GPT2 onnx, совместимые с TensorRT: gpt2-xl.onnx — GPT2-XL onnx для движков fp32 или fp16...

Генерация текста

ospatch/QwQ-32B-INT8-W8A8

— Архитектура модели: трансформаторы с RoPE, SwiGLU, RMSNorm и вниманием QKV смещением — Входные данные: текст — Выходные...

Генерация текста

RedHatAI/Meta-Llama-3.1-8B-quantized.w8a8

— Архитектура модели: Meta-Llama-3 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование активации:...

Генерация текста

QuantTrio/Qwen3-Coder-30B-A3B-Instruct-GPTQ-Int8

Qwen3-Coder доступен в нескольких размерах. Сегодня мы рады представить Qwen3-Coder-30B-A3B-Instruct. Эта оптимизированная модель обеспечивает впечатляющую производительность и эффективность,...

Генерация текста

QuantTrio/Qwen3-30B-A3B-Instruct-2507-GPTQ-Int8

Мы представляем обновленную версию режима без мышления Qwen3-30B-A3B под названием Qwen3-30B-A3B-Instruct-2507, включающую следующие ключевые улучшения: — Значительные улучшения...

Генерация текста

Intel/gpt-j-6B-int8-static-inc

GPT-J 6B — это модель трансформера, обученная с помощью Mesh Transformer JAX Бена Ванга. «GPT-J» относится к классу...