スキャンした PDF を Word に変換する方法(無料・アップロードなし)
最終更新: 2026年9月16日
スキャンした PDF は写真の束です。人には文字が見えますが、コンピューターには見えません。ファイルの中にあるのは文字ではなく画素だけです。だからコピーしても何も取れず、そのまま Word に変換しても空の文書になります。先に必要なのが文字認識、いわゆる OCR です。
ブラウザーで変換する
- 文書の言語のページで PDF を Word に を開きます。日本語のページは日本語のスキャンを読み、ドイツ語のページはドイツ語を読みます。この点がいちばん効きます。
- スキャンした PDF を選びます。
- Word に変換を押します。最初のスキャンページで認識エンジン(数 MB)を一度だけ読み込み、そのあとはページを順に読みます。
- .docx が自動的にダウンロードされます。Word、Google ドキュメント、LibreOffice で開けます。
文字認識はこのサイトの他の機能より時間がかかります。処理するのがあなたの端末だからです。1 文書あたりではなく1 ページあたり数秒と考えてください。長いスキャンならタブを開いたままにして席を立ちましょう。その間もアップロードは行われません。自分で確認できます。
ページの言語が効く理由
認識モデルは言語ごとに学習されています。英語のモデルは「ひらがな」も「漢字」も学んでいないため、似た形に置き換えてしまいます。自分の言語のページで開けば正しいモデルが読み込まれ、こうした誤りは消えます。2 か国語が混ざる文書なら、本文で優勢な言語のページで変換してください。
引き継がれるもの・引き継がれないもの
- 本文。読む順に段落として組み直し、ページをまたいだ文をつなぎ、繰り返されるヘッダー・フッター・ページ番号は取り除きます。
- 画像。元の位置に入ります。
- 表。セルが罫線で描かれている場合です。スキャンでは罫線も画像の一部なので、スキャンした表はふつうテキストとして出ます。
- レイアウトそのものは再現しません。変換後のスキャンは編集用の文書で、複製ではありません。
信用する前に読み返す
認識は完璧にはなりません。金額、氏名、番号、日付など大事なところは一度目を通してください。請求書の合計で「5」が「S」と読まれるような誤りは、後で高くつきます。装飾的な文字や灰色の背景の上の文字が弱点です。
よいスキャンを作るコツ
- 300 dpi で取り込みます。200 未満は文字がつぶれ、400 を超えてもファイルが大きくなるだけです。
- 紙をまっすぐ置きます。数度の傾きは、照明の悪さより精度を落とします。
- 本文だけなら白黒かグレースケールで十分です。スマートフォンなら影を避けてください。写真で撮る場合はスマートフォンでスキャンするコツが役に立ちます。
検索やコピーだけでよい場合
近道があります。OCR PDF は見た目をそのままに、認識した文字を透明な層として重ねます。原本の見た目のまま検索もコピーもできるようになります。詳しくはスキャンした PDF を検索できるようにする方法をご覧ください。書き直すなら PDF を Word に、探すだけなら OCR PDF です。
ブラウザーで処理する理由
スキャンは手元でいちばん扱いに注意が要る書類であることが多いものです。契約書、給与明細、身分証、診断書など。ここではすべてが自分の端末で処理されるため、ファイルはアップロードされず、どこかのサーバーの順番待ちにも入らず、「1 時間後に削除します」を信じる必要もありません。確かめたいなら、ページを開いてから Wi-Fi を切って変換してみてください。そのまま動きます。
あわせて読みたい: PDFをWordに変換すると崩れる・文字化けする原因と対処法