結論:文章の再利用はWord、表らしい行の整理はExcel、ページの見た目を保った共有・追記はPowerPointを選びます。変換結果は必ず手直ししてから利用してください。
出力形式ごとの処理
| 形式 | このツールの処理 | 向く用途 |
|---|---|---|
| Word(DOCX) | PDF内の文字を位置順に抽出し、ページ単位の段落として作成 | 本文の引用、文章の再編集、下書き作成 |
| Excel(XLSX) | 同じ行の文字を並べ、広い間隔を列の区切りとして推定 | 単純な一覧表、行データの整理 |
| PowerPoint(PPTX) | 各PDFページを画像化し、1ページを1枚のスライドに配置 | 見た目を保つ配布、上から注釈を追加 |
復元できないもの
段組み、複雑な表、フォント、余白、ヘッダー・フッター、脚注などは元の作成データと同じにはなりません。Excelのセル結合、数式、列の意味もPDFには通常残っていないため、自動で完全復元できません。
スキャンPDFには文字データがないことがあります。このツールはOCRで画像中の文字を認識する機能ではないため、その場合WordやExcelは空に近い結果になります。PowerPointはページ画像として出力できます。
変換後の確認手順
- ページ範囲を絞る。
必要なページだけ変換すると確認と修正が短くなります。 - 数字と固有名詞を原本と照合する。
金額、日付、住所、製品名、単位は目視で確認します。 - 表の列ずれを直す。
PDF上で見えていた罫線と、抽出されたセルは別物です。列の境界を調整してください。 - アクセシビリティと体裁を整える。
見出し、読み順、代替テキスト、改ページを用途に合わせて設定します。
最大50MB、100ページまでの暗号化されていないPDFを対象にしています。処理はブラウザ内で行い、ファイル本体をSunDataのサーバーへ送信しません。