スクリーンショットを検索可能なPDFに変換
スクリーンショットを無料で検索可能なPDFに変換したり、画像内の文字をコピーしたりできます。OCRはブラウザ内で動くため、ファイルはアップロードされません。
スクリーンショットを検索可能なPDFにする方法
- スクリーンショットを追加します。カードをドラッグしてページの順番を決め、横向きの画像は回転させます。
- 「画像内の言語」で、スクリーンショットに写っている言語を選びます。複数の言語が混ざっている場合は、3つまで選べます。
- 「検索可能なPDFをダウンロード」を選びます。各ページにはスクリーンショットがそのまま表示され、認識したテキストが見えないテキストレイヤーとして重なります。
- テキストだけ必要な場合は「テキストだけ抽出」を選び、コピーするか.txtファイルとして保存します。
PDFが検索可能になる仕組み
スクリーンショットをそのままPDFにしても、中身は文字を写した画像のままです。そのため検索もコピーもできません。これが画像のみのPDFです。検索可能なPDFには、画像に加えて文字がテキストデータとしても入っています。
OCRが各画像の文字を読み取ります。続いて、認識した単語を見えないテキストレイヤーに配置し、画像上の文字にぴったり重ねます。見た目は変わりませんが、一般的なPDFビューアーでCmd/Ctrl+Fによる検索、テキストの選択、コピーができるようになります。
先に大量のページを撮影する必要がある場合は、MacでスクリーンショットをPDFとして保存する方法をご覧ください。
よくある質問
スクリーンショットを検索可能なPDFに変換するのは無料ですか?
はい。アカウント登録は不要で、透かしも入りません。一度に最大80枚まで変換できます。
スクリーンショットはサーバーにアップロードされますか?
いいえ。文字認識はTesseract OCRエンジンを使ってブラウザ内で行います。初回のみ、エンジンと言語データ(数MB)を公開CDNからダウンロードします。画像が端末の外に出ることはありません。
スクリーンショットの文字をコピーするには?
スクリーンショットを追加して「テキストだけ抽出」を選びます。認識したテキストがツールの下に表示されるので、そのままコピーするか.txtファイルとして保存できます。画像も残したい場合は、検索可能なPDFをダウンロードし、PDFビューアーでテキストを選択してください。
どの言語を認識できますか?
英語、ドイツ語、フランス語、スペイン語、イタリア語、ポルトガル語、オランダ語、ポーランド語、ロシア語、日本語、韓国語、中国語(簡体字・繁体字)に対応しています。複数の言語が混ざったスクリーンショットでは、3つまで選べます。選ぶ言語が少ないほど速く読み取れます。
文字認識の精度はどのくらいですか?
活字がはっきり写ったスクリーンショットなら、たいていきれいに読み取れます。小さなスクリーンショットは読み取り前に拡大します。それでも、ごく小さな文字やコントラストの低い文字、手書き、数式、複雑な表では誤認識が起こることがあります。名前、数字、引用は元の画像と照らし合わせて確認してください。
PDFの見た目はスクリーンショットと変わりますか?
変わりません。各ページにはスクリーンショットがそのまま表示され、認識したテキストは見えません。「画像と同じサイズに合わせる」を選ぶと、ページが画像ごとのサイズになります。印刷する予定があれば、A4かUS Letterを選んでください。
スマートフォンでも使えますか?
はい。最新のモバイルブラウザで動作し、写真ライブラリからスクリーンショットを直接選べます。ただしOCRは端末上で動くため、ページ数が多いとスマートフォンでは時間がかかります。
ページを1枚ずつ撮影していませんか?
ShotomaticならMacで連続スクリーンショットを撮影し、1つの検索可能なPDFとして書き出せます。