書類・変換

画像・PDFを無料の日本語OCRで文字起こし|使い方

紙の配布資料や画像の文章を、コピーできるテキストにします。日本語・英語の認識結果を元画像と並べて確認し、必要な箇所を直してから文書に使えます。認識は端末内で行い、外部AIのAPI契約は不要です。

内容更新:

無料・登録不要 / 端末内で処理

日本語OCR・文字起こしを使ってみる

日本語OCR・文字起こしを開く ↗
入力
PNG・JPG・WebP・PDF
言語
日本語・英語
上限
1ファイル20MB、1回10ページ

操作の手順

  1. 「画像・PDFを選択」から読み取り元を開きます。撮影した紙が傾いている場合は、先にスキャンで四隅を補正すると確認しやすくなります。
  2. PDFは開始ページと最大ページ数を指定し、「読み取る」を押します。初回は認識エンジンの取得に時間がかかります。
  3. 読み取り元の画像と認識テキストを照合し、文字・改行を修正します。氏名・日付・金額・型番は特に注意して確認します。
  4. 「コピー」「全ページをテキスト保存」「文書に追加」から用途に合う方法を選びます。

読み取りやすい画像を用意する

文字が小さすぎる画像、強い影、光の反射、斜めからの撮影は読み違いの原因になります。用紙全体を明るく撮り、文字が潰れない大きさの画像を用意します。大きな余白や背景を切り取る場合も、文字の端を切らないようにしてください。

表・手書き・縦書きの扱い

OCRの結果はテキストです。表の罫線や列、原本のレイアウトをそのまま再現するものではありません。手書きや縦書き、複雑な表では誤認識が増えます。表計算に移す際は、行と列を自分で確認して配置してください。

やり直しと保存

読み取りを再実行すると、前回の認識結果を置き換えます。必要な結果は先にTXTとして保存してください。読み取り済み画像と修正したテキストは案件に保存されます。別端末へ持ち出すときは .nexus を書き出します。パスワード付きPDFは読み取れません。

この機能のよくある質問

PDFをWord形式に変換できますか?

OCRのテキストをコピーしたり、文書ツールに追加したりできます。Word形式(.docx)の作成や原本と同じレイアウトへの変換は対応していません。

オフラインでも読み取れますか?

初回は認識エンジン等の取得に通信が必要です。保存済みのエンジンやブラウザのキャッシュ状況に依存するため、通信のない場所で使う前に必要な機能を確認してください。

手順を確認できたら、ファイルを用意して始めましょう。

日本語OCR・文字起こしを開く