Qwen3.5-2B
LiteRT is Google’s on-device runtime, the new name for TensorFlow Lite (Android: com.google.ai.edge.litert:litert), and litert-torch, the renamed ai-edge-torch,...
LiteRT is Google’s on-device runtime, the new name for TensorFlow Lite (Android: com.google.ai.edge.litert:litert), and litert-torch, the renamed ai-edge-torch,...
> | repeat-penalty 1.05 ✅ | correct (sweet spot) | > | repeat-penalty 1.0 | severe thinking loops...
Официальная сборка OsaurusAI MXFP8 Qwen/Qwen-AgentWorld-35B-A3B (Apache-2.0) — гибридный MoE ~35B / ~3B (qwen35moe). 8-битный микромасштабируемый FP практически без...
Квантование GGUF для wangzhang/Qwen3.6-27B-удалено, Qwen3.6-27B с подавлением отказа на втором проходе (10/100 отказов, 15/15 жесткого соответствия, совокупный KL...
🧬 Genesis-152M-Instruct Исследовательская модель малого языка с гибридным линейным вниманием Genesis-152M-Instruct — это экспериментальная модель малого языка, которая...