「PDFをWordに変換(pdf to word)した途端、デザインが崩壊してしまう」という現象には、両者のファイル構造における根本的な違いが関係しています。PDFは印刷物と同じように「文字や図形を絶対座標で固定配置する形式」であるのに対し、Wordは「前後の文章量に応じて行が流動的に変化する形式」を採用しているためです。
特に崩れや文字化けを引き起こす要因は、主に以下の3点に集約されます。
まず挙げられるのが、「元フォントの非埋め込み」です。作成元で使われていた特殊なフォントがPDF内に埋め込まれていない場合、変換先の環境にある代替フォントへ強制的に置き換わり、文字幅のズレや記号化が発生します。
次に、「紙の書類をスキャンしただけの画像PDF」であるケースです。一見すると文字に見えても、実態は1枚の写真データに過ぎないため、通常のテキスト変換プログラムでは文字として認識されず、空白や意味不明な文字列として出力されてしまいます。
さらに、複数段組みや複雑な表の結合、背景画像の上に文字を重ねたレイアウトなども、Wordの段落構造へ再構築する際に計算の誤差が生じ、枠外へのテキスト飛び出しを引き起こす典型的な原因です。