phi-4-25b
Это объединение предварительно обученных языковых моделей, созданных с помощью mergekit. В объединение были включены следующие модели: * microsoft/phi-4...
Это объединение предварительно обученных языковых моделей, созданных с помощью mergekit. В объединение были включены следующие модели: * microsoft/phi-4...
Эта модель основана на phi-3.5-mini-Instruct и представляет собой модель общего назначения с улучшенной производительностью по сравнению с базовой...
Модель mlx-community/Phi-3.5-mini-instruct-4bit была преобразована в формат MLX из microsoft/Phi-3.5-mini-instruct с использованием mlx-lm версии 0.17.0. Модальности:Генерация текста Области применения:Генерация...
Hyper-Pretrained Transformers (HPT) — это новая мультимодальная платформа LLM от HyperGAI, которая была обучена для моделей языка видения,...
Эта модель представляет собой усовершенствованную версию (DPO) модели microsoft/Phi-3-mini-4k-instruct. Все модели GGUF доступны здесь: MaziyarPanahi/calme-2.3-phi3-4b-GGUF MaziyarPanahi/calme-2.3-phi3-4b — самая...
MixtureOfPhi3 — это смесь экспертов (MoE), созданная со следующими моделями с использованием mergekit: Phi-3-mini-128k-instruct Phi-3-mini-128k-instruct Этот запуск предназначен...
Это версия microsoft/Phi-4-mini-instruct без цензуры, созданная с помощью аблитерации (более подробную информацию об этом см. в разделе «Удалить-отказы-с-трансформерами»)....
— Исходная модель: Flow-Judge-v0.1 — Коллекция моделей: модели Flow-Judge-v0.1 — Технический отчет: Flow Judge: открытая модель на малом...
Лучшая версия Chocolatine-3B для французского языка. Модель поддерживает длину контекста 128 КБ. DPO выполнил точную настройку microsoft/Phi-3.5-mini-instruct (параметры...
Модель является результатом дальнейшего постобучения microsoft/Phi-3-mini-128k-instruct. Эта модель разработана для обеспечения высокой производительности при выполнении различных задач по...