Quantcast
Channel: Форум системных администраторов
Viewing all articles
Browse latest Browse all 1165

Релиз системы распознавания текста Tesseract 5.4.0

$
0
0
Опубликован релиз системы оптического распознавания текста Tesseract 5.4.0, поддерживающей распознавание символов UTF-8 и текстов на более чем 100 языках, включая русский, казахский, белорусский и украинский. Результат может сохраняться как открытым текстом, так и в форматах HTML (hOCR), ALTO (XML), PDF и TSV. Изначально система была создана в 1985-1995 годах в лаборатории компании Hewlett Packard, в 2005 году код был открыт под лицензией Apache и в дальнейшем развивался при участии работников компании Google. Исходные тексты проекта распространяются под лицензией Apache 2.0.

Подробнее...

Статистика: Добавлено [Ботя] — Сегодня, 01:30 — Ответы 0 — Просмотры 71



Viewing all articles
Browse latest Browse all 1165

Trending Articles