LLaDA2.0-mini-CAP
LLaDA2.0-mini-CAP — это расширенная версия LLaDA2.0-mini, которая включает в себя параллельное обучение с учетом уверенности (CAP) для значительного...
LLaDA2.0-mini-CAP — это расширенная версия LLaDA2.0-mini, которая включает в себя параллельное обучение с учетом уверенности (CAP) для значительного...
LLaDA2.0-flash-CAP — это расширенная версия LLaDA2.0-flash, которая включает в себя параллельное обучение с учетом уверенности (CAP) для значительного...
Эта модель была представлена в статье dLLM: Simple Diffusion Language Modeling. Qwen3-0.6B-diffusion-bd3lm-v0.1 — это языковая модель на основе...
ReFusion — это модель маскированной диффузии, которая обеспечивает превосходную производительность и эффективность, обеспечивая полное повторное использование кэша KV...
ModernBERT-large-chat-v0.1 — это языковая модель на основе диффузии, адаптированная из ModernBERT-large с использованием MDLM (маскированная диффузия), обученная с...
LLaDA2.0-mini — это модель диффузного языка с архитектурой 16BA1B Mixture-of-Experts (MoE). Являясь расширенной, настроенной на инструкции версией серии...
LLaDA2.0-flash — это модель диффузного языка с архитектурой 100BA6B Mixture-of-Experts (MoE). Являясь усовершенствованной, настроенной на инструкции версией серии...
LLaDA2.0-flash-preview — это модель диффузного языка с архитектурой 100BA6B Mixture-of-Experts (MoE). Являясь усовершенствованной, настроенной на инструкции версией серии...
🚀 LLaDA2.1-flash теперь доступна на ZenmuxAI! Попробуйте через API 🛠️ или в чате 💬: https://zenmux.ai/inclusionai/llada2.1-flash LLaDA2.1-flash — это...
LLaDA2.0-mini-preview — это модель диффузного языка с архитектурой 16BA1B Mixture-of-Experts (MoE). Являясь расширенной, настроенной на инструкции версией серии...