Web便利ツール集

PDFが文字化けする原因と直し方|本文・ファイル名・コピペ時の3パターン

PDF文字化けフォント

届いたPDFが「□」や意味不明な記号の羅列になっている、あるいは見た目は正常なのにコピペすると文字化けする——原因のほとんどはフォントの未埋め込みですが、化ける場所によって直し方も、自分でできる対処の範囲も変わります。この記事では、症状別に原因を切り分け、実務で使える直し方をまとめます。

まず、どこが化けているかを見る

対処の前に、化け方を確認してください。ここを間違えると、見当違いの方法を試すことになります。

化けている場所主な原因
表示上、本文全体が「□」や文字化けフォントの未埋め込み
見た目は正常だがコピペ・検索すると化けるOCR・スキャンPDFのテキストレイヤー不良
添付ファイルの名前だけ化けるファイル名のエンコード方式の不一致
Excel等から書き出した直後だけ化ける変換時のフォント設定漏れ

「表示が化けている」のと「見た目は正常だがコピペすると化ける」は原因も対処もまったく別物です。ここを分けて考えるのが最初のポイントです。

本文が化ける:フォント未埋め込みが原因

PDFは、使用したフォントの情報をファイル内に埋め込むかどうかを選べます。埋め込まれていないPDFを、そのフォントを持たない環境で開くと、PC側が近い形の別フォントで代用しようとして失敗し、文字化けが起こります。

作成側の環境にしかない特殊なフォント(デザイン用の書体、古い業務システム専用フォントなど)を使ったPDFで特に起こりやすい現象です。

受け取った側で試せる直し方

  1. 別のビューアで開き直す。Adobe Acrobat Reader、Chrome、Edgeなど、ビューアによってフォント代用の挙動が違うため、これだけで直ることがあります
  2. 別の端末(スマホ・タブレット)で開く。フォントの持ち合わせが違うため、化けないこともあります
  3. ブラウザの印刷機能で再保存する。ChromeやEdgeでPDFを開き、印刷ダイアログから「PDFとして保存」を選ぶと、表示されている見た目のまま新しいPDFとして再生成されます

3番目の方法は多くの解説サイトで「確実」と紹介されていますが、見落とされがちな副作用があります。

落とし穴:ブラウザ経由の再保存は、テキストを画像として焼き付け直す処理に近く、文字が選択・コピペ・検索できなくなることがあります。 さらに、元のPDFに設定されていたしおりやリンク、フォームの入力項目も失われます。「表示上は直ったが、中身のデータとしては壊れた」状態になるため、あとで本文をコピペして使う予定がある資料には向きません。急いで見た目だけ直したい場合の応急処置と考えてください。

元データがある場合の恒久対応

自分が作成者、または元データ(Word・Excel・PowerPointなど)を持っている場合は、PDF書き出し時にフォントの埋め込みを有効にする設定を確認してください。多くのソフトでは既定で有効ですが、「Web用に最適化」「ファイルサイズを縮小」といった軽量化オプションを選ぶと、フォント埋め込みが無効化されることがあります。作り直せるなら、これが最も確実な解決策です。

見た目は正常なのにコピペすると化ける:OCRの落とし穴

紙の書類をスキャンして複合機やスキャンアプリで作ったPDFで、見た目には正常に文字が表示されているのに、範囲選択してコピペしたり、PDF内検索をかけたりすると文字化けすることがあります。

これは、スキャンPDFの裏側にOCR(文字認識)で生成した、目に見えないテキストレイヤーが重なっている仕組みが原因です。表示されている文字は実際には「文字の形をした画像」で、コピペや検索で拾われるのはその裏にあるテキストレイヤーの方です。OCRの認識精度が低かったり、対応していない言語・フォントで認識させたりすると、このテキストレイヤーだけが文字化けした状態で保存されます。

見た目の文字化けと違って印刷や閲覧では気づけないため、「あとで本文をコピペしようとしたら化けていた」という形で発覚しがちです。この記事の想定読者のように文字化けの原因を調べる場面でも見落とされやすいので、スキャンPDFを受け取ったら、渡された段階で一度本文の一部をコピペして確認しておくと、あとで困りません。直すには、OCRのやり直し(言語設定を正しく指定して再認識させる)以外に確実な方法はなく、元の紙原稿が残っているなら再スキャンが早いこともあります。

添付ファイル名が化ける

本文は正常なのに、メールに添付されたPDFのファイル名だけが文字化けするケースです。これは前述の2パターンとは別の問題で、ファイル名のエンコード方式が送信側と受信側で食い違っていることが原因です。

特に起こりやすいのが、日本語のファイル名を含んだPDFをZIP圧縮して送る場面です。Windows標準の圧縮機能と、一部の解凍ソフトとで、ファイル名に使う文字コードの扱いが異なるため、解凍した側でファイル名だけ「隒愛螳...」のような文字化けになることがあります。中身のPDF自体は無事でも、ファイル名から中身が推測できず、探すのに手間取ります。

実務上の対処はシンプルです。

添付するPDFのファイル名は半角英数字にする。 見積書_2026年9月.pdf ではなく quotation_202609.pdf にしておけば、圧縮・解凍を挟んでも文字化けは起きません。

メールの文字化け全般(本文・件名・添付ファイル名)についてはメールが文字化けする原因と直し方で詳しく整理しています。あわせて確認しておくと、送信側の予防策まで一通り把握できます。

Excel・PowerPointから書き出した直後に化ける

ExcelやPowerPointのファイルをPDFに書き出した直後から文字化けしている場合は、元データ側に機種依存文字(① ㈱ ℡ など)が含まれていないか確認してください。これらの文字は、書き出し先の環境によって正しく変換されないことがあります。機種依存文字の詳しい種類と安全な代替表記は機種依存文字(環境依存文字)とはにまとめています。

書き出し直後の文字化けでは、機種依存文字を使っていないかの確認と、前述のフォント埋め込み設定の確認を、両方チェックするのが確実です。

予防策:作成側でできること

受け取る側の対処には限界があるため、自分がPDFを作る側になったときの予防が結局いちばん効きます。

  1. PDF書き出し時、フォント埋め込みを無効化するオプションを選ばない(「Web用に最適化」系の設定に注意)
  2. 機種依存文字(① ㈱ ℡ など)を本文で使わない
  3. スキャンPDFはOCRの言語設定を正しく指定し、書類の一部をコピペして確認してから送る
  4. 添付ファイル名は半角英数字にする(特にZIP圧縮を挟む場合)
  5. 長期保存・提出用のPDFは、フォント埋め込みが標準仕様に含まれるPDF/A形式での書き出しも検討する

まとめ

  1. どこが化けているか(本文全体/コピペ時だけ/ファイル名)で原因も対処もまったく違う
  2. 本文全体の文字化けはフォント未埋め込みが主因。別ビューアや別端末で開き直すとまず直ることがある
  3. ブラウザの印刷機能での再保存は応急処置。テキストの選択・コピペ・検索ができなくなる副作用がある点に注意
  4. 見た目は正常なのにコピペで化けるのはスキャンPDFのOCRテキストレイヤーが原因。受け取った時点で一度確認しておくと安全
  5. 添付ファイル名だけ化ける場合は、ファイル名を半角英数字にするのが最も確実な予防策
  6. 自分が作成する側になったときは、フォント埋め込みを無効化しない設定と、機種依存文字を使わない習慣で、ほとんどのケースを未然に防げる

関連記事