eva-dolphin-llama3-8b-spanish
Модель на базе Llama3 8b, доработанная на испанском языке для создания высококачественного испанского текста. Базовая модель Llama3-8b Генерирует...
Модель на базе Llama3 8b, доработанная на испанском языке для создания высококачественного испанского текста. Базовая модель Llama3-8b Генерирует...
Ускорьте вывод, одновременно уменьшив объем памяти в 2–4 раза, используя вывод int8 в C++ на ЦП или графическом...
Ускорьте вывод, одновременно уменьшив объем памяти в 2–4 раза, используя вывод int8 в C++ на ЦП или графическом...
Ускорьте вывод, одновременно уменьшив объем памяти в 2–4 раза, используя вывод int8 в C++ на ЦП или графическом...
Ускорьте вывод, одновременно уменьшив объем памяти в 2–4 раза, используя вывод int8 в C++ на ЦП или графическом...
Этот репозиторий содержит модели GPT2 onnx, совместимые с TensorRT: gpt2-xl.onnx — GPT2-XL onnx для движков fp32 или fp16...
— Архитектура модели: трансформаторы с RoPE, SwiGLU, RMSNorm и вниманием QKV смещением — Входные данные: текст — Выходные...
— Архитектура модели: Qwen2ForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование веса:...
— Архитектура модели: Meta-Llama-3 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование активации:...
GPT-J 6B — это модель трансформера, обученная с помощью Mesh Transformer JAX Бена Ванга. «GPT-J» относится к классу...