← 戻る

カテゴリ

OCR

Recognise text in scanned documents and images.

比較表

OCR
ツールスターライセンス利用条件セルフホスト言語最新リリース最終プッシュ
PaddleOCR91kApache-2.0オープンソース不可Pythonv3.7.02026-09-16
Tesseract77kApache-2.0オープンソース不可C++5.5.32026-09-28
OCRmyPDF35kMPL-2.0オープンソース不可Pythonv17.13.02026-10-06
Surya21kApache-2.0オープンソース不可Pythonv0.22.12026-09-11
docTR6.4kApache-2.0オープンソース不可Pythonv1.1.02026-10-05

5件のツール

PaddleOCR

Turn any PDF or image document into structured data for your AI. A powerful, lightweight OCR toolkit that bridges the gap between images/PDFs and LLMs. Supports 100+ languages.

言語
Python
ライセンス
Apache-2.0
スター
91k
最新リリース
v3.7.0
最終プッシュ
2026-09-16
Tesseract

Tesseract Open Source OCR Engine (main repository)

言語
C++
ライセンス
Apache-2.0
スター
77k
最新リリース
5.5.3
最終プッシュ
2026-09-28
OCRmyPDF

OCRmyPDF adds an OCR text layer to scanned PDF files, allowing them to be searched

言語
Python
ライセンス
MPL-2.0
スター
35k
最新リリース
v17.13.0
最終プッシュ
2026-10-06
Surya

OCR, layout analysis, reading order, table recognition in 90+ languages

言語
Python
ライセンス
Apache-2.0
スター
21k
最新リリース
v0.22.1
最終プッシュ
2026-09-11
docTR

docTR (Document Text Recognition) - a seamless, high-performing & accessible library for OCR-related tasks powered by Deep Learning. Ongoing development and maintenance by t2k.

言語
Python
ライセンス
Apache-2.0
スター
6.4k
最新リリース
v1.1.0
最終プッシュ
2026-10-05

これらのツールが置き換えるもの