taresco/KarantaOCR - Каталог нейросетей
Генерация текста

taresco/KarantaOCR

Добавлено:
taresco/KarantaOCR

— Описание модели — Данные обучения — Этап 1: Общее обучение OCR — Этап 2: Точная настройка африканского языка — Графики обучения — Возможности — Оценка — Результаты — KarantaOCR-Bench — Результаты — OlmoOCR-Bench — Как использовать — Загрузка модели и процессора — Подготовка страницы PDF для вывода — Запуск вывода OCR — Сквозной пример — Информация для цитирования Высокоточное извлечение текста из PDF-файлов Извлечение таблиц и понимание структурированных документов * Надежная обработка: Макетов с несколькими столбцами Верхних и нижних колонтитулов * Смешанных отсканированных и цифровых PDF-файлов. Хотя повышение производительности на африканских языках было нашим приоритетом, KarantaOCR сохраняет высокую производительность на английском и других языках с большим количеством ресурсов, что делает его подходящим для коллекций документов на разных языках. KarantaOCR оценивается с помощью теста OLMOocr с использованием точности прохождения. Оценки представлены как средние значения по файлам JSONL с доверительным интервалом 95%. В дополнение к тесту OLMOocr мы также создаем KarantaOCR-Bench, который специально предназначен для тестирования извлечения OCR специальных символов и диакритических знаков. KarantaOCR обрабатывает PDF-документы, преобразуя страницы в изображения и комбинируя их со структурированными подсказками для вывода.

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: taresco
Теги: qwen2_5_vl, image-text-to-text, OCR, Text-Generation, Optical-Character-Recognition, Low-Resource-Languages, conversational, yo
Лайков: 7  |  Загрузок: 10

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.