タグ: OCR

3 本の記事

プログラミング

「検索可能PDF」とは何か|画像PDF・テキストPDFとの違いと「テキストレイヤー」の仕組み

自炊やスキャンの話で出てくる「検索可能PDF」の仕組みを整理した記事です。画像PDF・テキストPDF・検索可能PDFの3タイプの違い、透明なテキストレイヤーを重ねた二層構造、OCRが何をしているか、ファイルサイズが軽くならない理由、用途別の使い分けまでをまとめました。

プログラミング

自炊代行のOCRと国会図書館のOCR、どちらが正確か|同じ本で再OCRして比較した

自炊代行で納品された検索可能PDFのテキスト層と、国立国会図書館のOCRエンジン「NDLOCR-Lite」でかけ直した再OCRを、同じ本の同じ9ページで比較しました。文字一致率は納品97.2%・再OCR97.6%でほぼ互角ですが、納品は文字が化け、NDLは文字が消えるという違いがあります。検証の手順、誤りの実例、所要時間、用途別の使い分けまでまとめました。

プログラミング

自炊代行の納品PDFは検索に使えるか|OCR精度を実際に確かめた

自炊代行サービスから納品された検索可能PDFのOCR精度を、手元の2冊(横書きの技術書と縦書きの読み物)で実測した記録です。テキスト層がどのページに入っているか、本文にある20語が検索でヒットするか、どんな誤認識が起きるかを調べ、読む・探す・コピペ・AI利用・コードの再利用という用途別に整理しました。