OCRopus

OCRopus


OCRopus
Тип

Оптическое распознавание символов

Разработчик

Thomas Breuel, DFKI

Написана на

C++ и Lua

Операционная система

GNU/Linux, Debian GNU/Hurd, Debian GNU/kFreeBSD

Первый выпуск

9 апреля 2007

Тестовая версия

0.4.4 (alpha) / 1 мая 2010

Лицензия

Apache License v2.0

Сайт

http://code.google.com/p/ocropus/

OCRopus — OCR-система на базе не так давно открытого распознающего ядра — tesseract Программный пакет для распознавания текста, развивающийся по принципам Open Source и распространяющееся под Apache License 2.0. По задумке разработчиков, с помощью OCRopus станет возможным определять текстовое содержимое на цифровых изображениях и переводить его в обычный текстовый формат для дальнейшего редактирования. Помимо печатного текста, программа сможет распознавать и рукописные материалы. По состоянию на альфа-релиз, OCRopus использует язык моделирования код из другого проекта поддерживаемого Google OpenFST. OCRopus в настоящее время доступна только для Linux, но существуют сборки и для Debian GNU/Hurd и Debian GNU/kFreeBSD.

Содержание

Использование

В настоящее время OCRopus использует только интерфейс командной строки, принимая указания на входные изображения с текстом, и выводя данные в формате hOCR (открытый формат на основе HTML). Если необходим более точный контроль, можно указать в командной строке команды для выполнения конкретных операций (например, распознание одной строки).

История развития

  • 0.1.0 — Alpha — 22 Oct 2007
  • 0.1.1 — 14 Dec 2007 — Улучшение системы сборки пакета
  • 0.2 — Alpha 2 — 31 May 2008
  • Beta — Scheduled for August 2008
  • 1.0 — Scheduled for Q3 2008 — Пакеты для других операционных систем, +GUI

См. также

Ссылки


Wikimedia Foundation. 2010.

Игры ⚽ Поможем написать курсовую

Полезное


Смотреть что такое "OCRopus" в других словарях:

  • OCRopus — Developer(s) Thomas Breuel, DFKI Initial release 9 April 2007[1] Preview release 0.4.4 (alpha) / May 1, 2010; 18 months ago (2010 05 01 …   Wikipedia

  • OCROpus — Entwickler: Thomas Breuel, DFKI Aktuelle Version: 0.3.1 (16. Oktober 2008) Betriebssystem: Linux Kateg …   Deutsch Wikipedia

  • Ocropus — Entwickler: Thomas Breuel, DFKI Aktuelle Version: 0.3.1 (16. Oktober 2008) Betriebssystem: Linux Kateg …   Deutsch Wikipedia

  • OCRopus — Entwickler Thomas Breuel, DFKI Aktuelle Version 0.4.4 (März 2010) Betriebssystem Linux Programmier­sprache C++, Python …   Deutsch Wikipedia

  • OCRopus — est un logiciel libre de reconnaissance optique de caractères avec analyse de mise en page développé avec l aide de Google pour leur projet Google Books. Pour le moment le seul module de reconnaissance est Tesseract, une des ROC les plus exactes… …   Wikipédia en Français

  • Tesseract (software) — Infobox Software name = Tesseract caption = author = Ray Smith, Hewlett Packard cite web|url = http://code.google.com/p/tesseract ocr/|title = tesseract ocr|accessdate = 2008 07 12|last = Google|authorlink = |year = 2008] developer = Google… …   Wikipedia

  • Tesseract (Software) — Tesseract Maintainer Ray Smith u.a. Aktuelle Version 3.00.1 (5. Nov. 2010) Betriebssystem Windows, Linux, Mac OS X Programmier­sprache …   Deutsch Wikipedia

  • Document Layout Analysis — is a part of Computer Vision indicating the process of identifying and categorizing the regions of interest in a document image, e.g. a scanned page. A reading system requires the segmentation of text zones from non textual ones and the… …   Wikipedia

  • Handschrifterkennung — Texterkennung oder auch Optische Zeichenerkennung (Abkürzung OCR von englisch Optical Character Recognition, selten auch: OZE) ist ein Begriff aus dem IT Bereich und beschreibt die automatische Texterkennung von einer gedruckten Vorlage.… …   Deutsch Wikipedia

  • OCR-Schriften — Texterkennung oder auch Optische Zeichenerkennung (Abkürzung OCR von englisch Optical Character Recognition, selten auch: OZE) ist ein Begriff aus dem IT Bereich und beschreibt die automatische Texterkennung von einer gedruckten Vorlage.… …   Deutsch Wikipedia


Поделиться ссылкой на выделенное

Прямая ссылка:
Нажмите правой клавишей мыши и выберите «Копировать ссылку»