Відкрити головне меню

Tesseract — вільна програма для розпізнавання текстів, розроблялася Hewlett-Packard з 1985 до 1994 року, а в наступне десятиріччя залишалася практично без змін. Не так давно Google купив[джерело?] її та відкрив початковий код під ліцензією Apache 2.0 у 2006 році.[2] для продовження розробки. У цей час програма вже працює з UTF-8, розпізнає багато мов, серед яких і українська.

Tesseract
TesseractLogo.png
Tesseract-3.03.png
Тип OCR
Розробники Hewlett-Packard, Google
Стабільний випуск 3.02 (28 жовтня 2012)
Версії 4.1.0 (7 липня 2019)[1]
Репозиторій github.com/tesseract-ocr/tesseract
Операційна система Windows, Linux, Mac OS X
Написано на C C++
Ліцензія Apache 2.0
tesseract-ocr.googlecode.com

Tesseract у Вікісховищі?

ЗастосуванняРедагувати

Tesseract був використаний, зокрема, Міжнародним консорціумом журналістів-розслідувачів для дослідження інформації у так званих «панамських документах»[3].

ПриміткиРедагувати

  1. Release 4.1.0 — 2019.
  2. Vincent, Luc (August 2006). Announcing Tesseract OCR. Архів оригіналу за 2012-03-18. Процитовано 2008-06-26. 
  3. Mar Cabra, Erin Kissane (11 квітня 2016). The People and Tech Behind the Panama Papers. opennews.org. An OpenNews project. Процитовано 18 квітня 2016. 

Див. такожРедагувати

ПосиланняРедагувати