jamesburton/Phi-4-reasoning-vision-15B-GGUF - Каталог нейросетей
Генерация текста

jamesburton/Phi-4-reasoning-vision-15B-GGUF

Добавлено:
jamesburton/Phi-4-reasoning-vision-15B-GGUF

Преобразования формата GGUF microsoft/Phi-4-reasoning-vision-15B для использования с llama.cpp и Ollama. > Примечание. Это преобразование включает только текстовую основу (веса языковой модели). Веса кодировщика Vision и мультимодального проектора исключены, поскольку llama.cpp еще не поддерживает архитектуру Vision phi4-siglip. Текстовая модель архитектурно идентична Phi-4-reasoning-plus (Phi3ForCausalLM). — Исходная модель: microsoft/Phi-4-reasoning-vision-15B — Архитектура: Phi3ForCausalLM (текстовая основа Phi-4-reasoning-vision) — Параметры: ~15B (текстовая модель) — Скрытый размер: 5120 — Слои: 40 — Заголовки внимания: 40 (10 головок KV, GQA) — Размер словарного запаса: 100,352 — Токенизатор: GPT-2 (BPE) — Длина контекста: до 131 072 токенов (с масштабированием RoPE). — Лицензия: MIT — Преобразовано с использованием llama.cpp Converthftogguf.py. — Веса Vision Tower (model.visiontower.) и мультимодального проектора (model.mmprojector.) были пропущены во время преобразования. — Конфигурация модели была переназначена с Phi4ForCausalLMV (phi4-siglip) на Phi3ForCausalLM (phi3), поскольку текстовая основа архитектурно идентична — квантование выполняется с помощью llamamodelquantize()` с ускорением CUDA — преобразовано 243 текстовых тензора, 452 визуальных тензора…

Модальности:
Генерация текста

Области применения:
Логика и рассуждение


Задача: Генерация текста
Автор: jamesburton
Теги: gguf, phi4, phi-4, quantized, llama-cpp, ollama, reasoning, en
Лайков: 5  |  Загрузок: 236

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.