mistral-7b-instruct-v0.3-int4-onnx-directml
This repository hosts the optimized versions of Mistral-7B-Instruct-v0.3 to accelerate inference with ONNX Runtime for DirectML. DirectML is...
This repository hosts the optimized versions of Mistral-7B-Instruct-v0.3 to accelerate inference with ONNX Runtime for DirectML. DirectML is...
deepseek-ai/DeepSeek-R1-Distill-Llama-8B, квантованный в ONNX GenAI INT4 с оптимизацией Microsoft DirectML. Вывод переформатируется, чтобы каждое предложение начиналось с новой...
Компания Meta разработала и выпустила семейство больших языковых моделей (LLM) Meta Llama 3 — коллекцию предварительно обученных и...
google/gemma-2-9b квантовано до ONNX GenAI INT4 с оптимизацией Microsoft DirectML. Вывод переформатируется так, что каждое предложение начинается с...