Qwen3-Next-80B-A3B-Instruct
За последние несколько месяцев мы наблюдали все более четкие тенденции к масштабированию как общих параметров, так и длины...
За последние несколько месяцев мы наблюдали все более четкие тенденции к масштабированию как общих параметров, так и длины...
Nanbeige4.1-3B построен на базе Nanbeige4-3B-Base и представляет собой расширенную версию нашей предыдущей модели рассуждения Nanbeige4-3B-Thinking-2511, достигнутую за счет...
🎉Фи-4: [мультимодальная инструкция | оннкс]; [мини-инструкция | onnx] Phi-3.5-mini — это легкая, современная открытая модель, созданная на основе...
Qwen3 — это последнее поколение больших языковых моделей в серии Qwen, предлагающее полный набор моделей с плотным доступом...
Обладая обширной подготовкой с помощью обучения с подкреплением в сотнях тысяч сложных реальных сред, M2.5 является SOTA в...
👋 Присоединяйтесь к нашему сообществу Discord. 📖 Ознакомьтесь с техническим блогом GLM-4.6, техническим отчетом (GLM-4.5) и технической документацией...
Сегодня мы передаем MiniMax-M2.1 сообществу открытого исходного кода. Этот выпуск представляет собой нечто большее, чем просто обновление параметров;...
Мы представляем DeepSeek-V3.2, модель, которая сочетает в себе высокую вычислительную эффективность с превосходными рассуждениями и производительностью агентов. Наш...
Сегодня мы анонсируем Qwen3-Coder, нашу самую агентную модель кода на сегодняшний день. Qwen3-Coder доступен в нескольких размерах, но...
Сегодня мы выпускаем MiniMax-M2 с открытым исходным кодом, модель Mini, созданную для кодирования Max и агентных рабочих процессов....