PD-01 / Распознавание строк

PP-OCRv5 · кириллица

Обновлено 15.09.2026

Коротко

Изображение отдельной строки → текст; для страницы нужны детекция текста и дополнительные компоненты.

Паспорт

Репозиторий
PaddlePaddle/cyrillic_PP-OCRv5_mobile_rec[1]
Ревизия
712d2d65556c[1]
Метка лицензии
apache-2.0[1]
Текст лицензии прочитан
нет
Прогон Modelium
не проводился
Минимальная видеопамять
нет данных

Где рассматривать

Рассматривать как кириллический компонент модульного подхода.

Что известно о русском языке

Заявлена кириллица, есть русский пример. Метка language: en противоречит узкому прочтению описания; сама метка не определяет поддержку.

Опубликованная оценка

80,27% правильных целых строк по данным автора: один неверный символ делает строку ошибочной. Состав, версия и язык тестового набора не раскрыты в карточке.

Публичный путь запуска

Есть CPU/GPU-примеры PaddleOCR.

Что ещё требуется проверить

Нужны разбор страницы, извлечение полей и связи товарных строк.

Лицензия: объём проверки

Проверена метка в точной ревизии README; отдельный LICENSE в списке файлов HF не найден. Полная проверка происхождения весов и условий цепочки не закрыта.

Качество на русской первичке не установлено. Скорость, стоимость обработки и минимальная видеопамять для вашей задачи также не измерены. Оценка автора не является независимым результатом Modelium.

Следующий шаг для этой модели

Сначала выберите реквизиты или товарные строки. Уточните вход, выходную схему и недостающие компоненты. Проверьте полный процесс на одинаковых отложенных примерах, сохранив версии среды и все ошибки. Условия такого сравнения описаны в методологии.

Проверяемый источник

PaddlePaddle/cyrillic_PP-OCRv5_mobile_rec · карточка закреплённой версии

Ревизия: 712d2d65556ccc1ea7b5d2bb232b018838b6a3ab
Сверено: . Содержание источника может измениться в новых ревизиях.

Источники