Nanbeige4-3B-Thinking-2511-heretic
INVALID LANGUAGE PAIR SPECIFIED. EXAMPLE: LANGPAIR=EN|IT USING 2 LETTER ISO OR RFC3066 LIKE ZH-CN. ALMOST ALL LANGUAGES SUPPORTED...
INVALID LANGUAGE PAIR SPECIFIED. EXAMPLE: LANGPAIR=EN|IT USING 2 LETTER ISO OR RFC3066 LIKE ZH-CN. ALMOST ALL LANGUAGES SUPPORTED...
My quant for Rock5B (RK3588 board) Author: @flylcw * 建议运行环境:RKLLM-Toolkit在1.2.x应该都可运行,NPU驱动版本需>v0.9.8 RKLLM-Toolkit version: v1.2.2 NPU driver: v0.9.8 Python: 3.11...
Kona2-12B-Instruct is a 12-billion parameter instruction-tuned language model for Georgian and English. Built on Kona2-12B-Base through supervised fine-tuning...
Kona2-12B-Base is a 12-billion parameter base language model optimized for Georgian language understanding and generation. It is built...
This model is a fine-tuned version of mistralai/Ministral-8B-Instruct-2410 optimized for uncertainty calibration using the ConfTuner method, as presented...
Etherll/Mellum-4b-sft-rust is a large language model (LLM) fine-tuned specifically for Rust code Fill-in-the-Middle (FIM) tasks. It is built...
Smoothie Qwen — это легкий инструмент настройки, который сглаживает вероятности токена в Qwen и аналогичных моделях, улучшая сбалансированные...
Smoothie Qwen — это легкий инструмент настройки, который сглаживает вероятности токена в Qwen и аналогичных моделях, улучшая сбалансированные...
Эта модель реализует принципы Манифеста проектирования трения посредством намеренно сатирических и чрезмерных ответов, вводя полезное сопротивление во взаимодействиях...
Original model: https://huggingface.co/byroneverson/LongWriter-glm4-9b-abliterated Some of these quants (Q3KXL, Q4KL etc) are the standard quantization method with the embeddings...