Превращаем полосы, выпуски и разрозненные материалы в структурированную базу, по которой можно искать, считать и строить новые продукты.
Архив лежит в PDF
Выпуски хранятся как сканы полос: по ним нельзя искать и невозможно использовать в аналитике или новых продуктах.
Ручной перенос не успевает
Оператор переносит статьи в базу вручную, и архив наполняется медленнее, чем выходят новые номера.
Интерфейс тормозит работу
Редакционные инструменты собраны «как получилось»: лишние клики на каждой статье превращаются в часы за неделю.
Распознавание полос
OCR с выделением областей на странице: заголовок, автор, текст, изображения, сноски.
Структурированная база материалов
Статьи с метаданными вместо сканов — с поиском, фильтрами и выгрузкой.
Интерфейс под оператора
Редактор рядом с исходной полосой, горячие клавиши, поиск и замена, словари.
Очередь и статусы обработки
Видно, какие номера обработаны, какие в работе и где застряло.
Ответим в течение рабочего дня и предложим формат первой встречи.
проект →


