OCR и работа с документами

Обновлено · 3 проекта · часть каталога из 164 опенсорс-решений

Распознавание текста со сканов и фото, конвертация и сборка PDF. Закрывает то, за что обычно платят подписку онлайн-сервисам.

OCR и документы

3 проекта в категории

  • OCR и документы

    Stirling PDF

    Stirling-Tools/Stirling-PDF

    Целый комбайн инструментов для PDF. Чем ценно: режешь, сшиваешь и конвертируешь документы на своём сервере — приватно.

    Открыть на GitHub
  • OCR и документы

    Chandra

    datalab-to/chandra

    OCR-модель с выводом в Markdown/HTML/JSON. Чем ценно: вытаскиваешь текст и структуру из сканов автоматически.

    Открыть на GitHub
  • OCR и документы

    Unlimited OCR

    baidu/Unlimited-OCR

    OCR-модель на базе DeepSeek-OCR. Чем ценно: распознаёт текст из фото и документов — конец ручному перенабору.

    Открыть на GitHub

Подборка отражает находки на момент обновления страницы. Опенсорс-проекты быстро развиваются и иногда переезжают — если ссылка изменилась, найдите репозиторий по названию на GitHub. Проверяйте лицензию и актуальность перед использованием в продакшене.

Хочешь забирать такие находки первым?

Я постоянно в полях — нахожу инструменты, которые ускоряют работу в разы, и сразу делюсь ими в каналах. Подписывайся: пока другие пишут с нуля, ты будешь собирать из готового.