スマホで本を撮るだけで自炊(電子書籍化)。PDF化・OCRも
OCR(文字認識)サービスの中には、有料プランや画像のアップロードが必要なものも少なくありません。 「ホンスキャン」のOCRは完全無料で、しかも画像を外部に送信せず端末内だけで処理するため、 プライバシーが気になる書類や本のスキャンにも安心して使えます。
📖 ホンスキャンを使ってみる一般的なOCRサービスの多くは、画像をサーバーにアップロードして文字認識を行います。 「ホンスキャン」はブラウザ内蔵の文字認識エンジン(Tesseract.js)を使い、撮影から文字認識まですべての処理をスマホやPCの中だけで完結させます。 画像やテキストが外部のサーバーへ送信されることは一切なく、契約書や日記など人に見られたくない書類のOCRにも向いています。
OCRの認識言語は「日本語+英語」「日本語のみ」「英語のみ」から選べ、日本語は縦書き・横書きの両方に対応しています。 文字の認識精度は目安として約93%です。文字の大きさやフォント、撮影時の明るさ・ピントによって精度が変わるため、 文字中心のページは補正時に白黒モードを選ぶと認識率が上がりやすくなります。
検索可能なPDFとして書き出す手順は本を無料でPDF化する方法で詳しく解説しています。 スマホでの撮影のコツはスマホだけで本を自炊する方法もあわせてご覧ください。
OCRの結果には誤認識が含まれる場合があるため、内容は必ずご自身でご確認ください。 また書籍をOCR化する場合は、私的利用の範囲を守り、認識したテキストの公開・配布は行わないでください。 その他の疑問はよくある質問にまとめています。
📖 ホンスキャンを使ってみる