Логотип Soware

Описание системы Tesseract OCR

Информация о Tesseract OCR

Подходит для
Специалист
Развёртывание
Сервер предприятия, Персональный компьютер
Графический интерфейс
macOS, Windows, Linux
Тарификация
Бесплатно
Поддержка языков
Иврит, Эстонский, Португальский, Монгольский, Болгарский, Сербский, Русский, Казахский, Китайский, Латвийский, Норвежский, Турецкий, Татарский, Кхмерский, Азербайджанский, Белорусский, Венгерский, Хинди, Польский, Финский, Немецкий, Нидерландский, Японский, Фарси, Французский, Арабский, Вьетнамский, Литовский, Индонезийский, Английский, Греческий, Бенгальский, Шведский, Испанский, Чешский, Украинский, Корейский, Хорватский, Персидский, Итальянский, Датский, Каталонский
Реестр российского ПО
Не включен
Демо версия
ДаДа
Пробная версия (триал)
Нет
Свободное ПО
Да

Краткий обзор Tesseract OCR

Tesseract — это программный движок с открытым исходным кодом, позволяющий распознавать символы с поддержкой кодировки Unicode и возможностью распознавания более 130 языков, а также с возможностью дополнения для распознавания других языков.

Программное решение Tesseract (рус. Тессеракт) с открытым исходным кодом от компании Google предназначено для распознавания текста (англ. OCR). Программа распространяется бесплатно и доступна для использования по лицензии Apache 2.0.

Программное обеспечение Tesseract может быть использовано непосредственно или при помощи API, позволяя извлекать печатный текст из изображений.

Программный движок Tesseract не имеет встроенного графического интерфейса (GUI), но есть несколько доступных вариантов графического интерфейса от третьих сторон. Система поддерживает широкий спектр языков для распознавания — более 130.

Подробнее: https://opensource.google/projects/tesseract

Функции

НетМногопользовательский доступNO
ДаНаличие API
НетОтчётность и аналитикаNO
ДаИмпорт/экспорт данных
НетАдминистрированиеNO
НетИнтеллектуальный анализ данныхNO
ДаМашинное обучение
НетДообучениеNO
НетОбработка структурированных данныхNO
ДаОбработка текстовых данных
НетОбработка звуковых данныхNO
НетОбработка голосовых данныхNO
ДаОбработка визуально-графических данных
НетОбработка видео-данныхNO
НетКлассификация данныхNO
НетПрогнозированиеNO
НетКластеризацияNO
НетИнтеграция данныхNO
НетМониторинг данныхNO
НетОптимизация процессовNO
НетВизуализацияNO

Разработчик системы Tesseract OCR

Компания-разработчик:

Google

Веб-сайт (продукт):

https://opensource.google/projects/tesseract

Страна:

США

Веб-сайт:

https://about.google/intl/ru_ru/

Головной офис:

Маунтин-Вью, Калифорния

Вопросы и ответы Tesseract OCR

?

Поддерживает ли Tesseract OCR работу с защищёнными (зашифрованными) документами и как это реализовано?

Tesseract OCR не имеет встроенных механизмов для работы с защищёнными (зашифрованными) документами, требуется дополнительное ПО для расшифровки данных перед распознаванием.

?

Какие языки поддерживает Tesseract OCR?

Tesseract OCR поддерживает в своём интерфейсе следующие языки: Русский, Английский, Азербайджанский, Арабский, Белорусский, Бенгальский, Болгарский, Венгерский, Вьетнамский, Греческий, Датский, Иврит, Индонезийский, Испанский, Итальянский, Казахский, Китайский, Корейский, Кхмерский, Литовский, Монгольский, Немецкий, Нидерландский, Норвежский, Персидский, Польский, Португальский, Сербский, Татарский, Турецкий, Украинский, Фарси, Финский, Французский, Хинди, Хорватский, Чешский, Шведский, Эстонский, Японский.

?

Можно ли использовать Tesseract OCR без установки на собственные (частные) сервера, арендовать из публичного облака?

Нет, Tesseract OCR не может использоваться из публичного облака (SaaS).

?

Существует ли дистрибутив Tesseract OCR под операционные системы семейства Linux?

Да, Tesseract OCR может быть развёрнута и использоваться на ОС Linux.

?

Предполагает ли Tesseract OCR серверный вариант установки (или на частное облако)?

Да, Вы можете инсталлировать Tesseract OCR на сервер предприятия или в частном облаке.

?

Поддерживает ли Tesseract OCR многоязычное распознавание, и какие языки доступны?

Tesseract OCR поддерживает многоязычное распознавание, доступно более 130 языков.

?

Каковы возможности кастомизации и настройки алгоритмов распознавания в Tesseract OCR?

Возможности кастомизации Tesseract OCR включают настройку параметров распознавания и добавление языковых пакетов, что позволяет адаптировать систему под специфические задачи.

?

Располагает ли Tesseract OCR программным интерфейсом приложения (API)?

Да, у Tesseract OCR есть программный интерфейс (API).

Популярные аналоги Tesseract OCR

Логотип

Медиалогия SM

Медиалогия

«Медиалогия SM» — это система аналитики и мониторинга социальных медиа, которая собирает и анализирует данные из 2,5 млрд источников соцмедиа (соцсети, видео-платформы, маркетплейсы, отзовики, блоги-форумы, карты, мессенджеры и СМИ), обрабатывает тексты, картинки, локации, логотипы, видео и истории, и по итогам анализа формирует подробный отчёт.

Логотип

Медиалогия PR

Медиалогия

Медиалогия PR — это цифровой инструмент оперативного мониторинга и анализа СМИ. Более 105000 источников: Пресса, ТВ, Радио, Информагентства, Интернет-СМИ.

Логотип

PolyAnalyst

Мегапьютер Интеллидженс

Megaputer PolyAnalyst — это российская low-code платформа визуальной разработки сценариев анализа данных и текстовых документов, а также построения интерактивных отчётов, не требующая навыков программирования.

Инлексис Голосовой бот — это интеллектуальный сервис для эффективного обзвона клиентов, позволяющий крупному бизнесу экономить миллионы рублей на сокращении операционных расходов.

МТС Облачное видеонаблюдение — это онлайн-сервис, включающий 11 модулей видеоаналитики, для организации интеллектуального наблюдения за автомобилями, пассажирами, сотрудниками и иными рабочими объектами.

Логотип

Linkage ABI

Westlink Group

Linkage ABI — это централизованная BI-система самообслуживания со встроенной интеллектуальной поддержкой принятия управленческих решений с использованием ИИ.