FubakoFubako

Fubako › スキャンPDFを検索可能にする

スキャンPDFを検索可能にする(Mac・無料・アップロード不要)

スキャナやコピー機で作ったPDFは「文字の見た目の画像」でしかなく、⌘Fで検索してもヒットしません。このページでは、Macでスキャン PDFを無料・ローカル完結で検索可能にする方法を説明します。

「検索できないPDF」の正体

PDFには2種類あります。WordやExcelから書き出したPDFは文字データを内包しているため検索・コピーができます。一方、スキャンして作ったPDFはページ全体が1枚の画像で、文字データがありません。これを検索可能にするには、OCR(光学文字認識)で読み取った文字を、画像の上に透明なテキスト層として埋め込む必要があります。これが「検索可能PDF(サーチャブルPDF)」です。

Macの標準機能ではできない

意外に思われますが、Macのプレビュー.appはこれができません。画面上で文字をなぞってコピーする機能(Live Text)はあるものの、認識結果をPDFに保存する手段がないため、ファイル自体は検索できないままです。Spotlight検索にも載りません。

従来の選択肢はこうでした。

方法費用ローカル完結難易度
Adobe Acrobat Pro月額制ローカル処理だが常時ログイン前提易しい
Web型OCRサービス無料〜×(サーバーへアップロード)易しい
Tesseract(ターミナル)無料コマンドライン操作が必要
Fubako無料○(通信権限なし)ドラッグ&ドロップのみ

つまり「無料で・ローカルで・GUIで」の3つを同時に満たす手段が、Macには事実上ありませんでした。Fubakoはこの空白を埋めるために作られています。

Fubakoでの手順

認識エンジンはmacOS標準のApple Vision(Live Textと同じ技術)で、日本語・英語の混在文書にも対応します。透明テキストは画像の下に重なるだけなので、見た目は1ピクセルも変わりません。処理後は⌘Fでの文書内検索、テキストのコピー、Spotlightからの全文検索が効くようになります。

機密書類こそローカルで。Fubakoはサンドボックス化されており、ネットワークへアクセスする権限そのものを持ちません。「アップロードしていない」ことは、署名済みバイナリのentitlementsから誰でも検証できます。

よくある質問

元のPDFは上書きされますか?

検索可能化は開いている書類に適用され、macOSの自動保存とバージョン機能の対象になります。「ファイル > バージョンを戻す」でいつでも処理前に戻せます。

手書き文字は認識できますか?

Apple Visionは活字を主対象としています。整った手書きはある程度認識しますが、崩し字は精度が下がります。

何ページまで処理できますか?

ページ数の制限はありません。数百ページの文書でも、メモリを使いすぎないよう並列度を自動調整しながら処理します。

Fubako — 完全ローカルの無料PDF道具箱

macOS 14以降 · 無料 · 公証済み

ダウンロード · macOS