PDF / ドキュメント
PDFからExcelへ:ブラウザ上でローカル変換
シンプルな表形式のPDFからXLSXまたはCSVを抽出。グリッドをプレビューし、保存前に表ごとまたはページごとのシートを選べます。
PDFからExcelへ:ブラウザ上でローカル変換: テキストをベースラインごとにまとめ、そろった列位置をクラスタリングして、2行2列以上のシンプルな表を検出します。検出されたすべての表を、ページごとまたは表ごとにまとめたXLSXブックとして保存できます。CSVには選択したグリッドのみが保存されます。長い文章のセル、結合セルを含む表や複雑な表、空のセル、回転したテキスト、不規則な列は、見落とされたり正しく読み取れなかったりする場合があります。スキャンされたテキストの認識や、数式、スタイル、セル結合の保持には対応していません。 サーバーへのファイルアップロードは一切なく、100%ブラウザ内でローカル実行します。
- カテゴリ
- PDFツール
- 実行回数
- ブラウザ内で
- コスト
- 無料 · 登録不要
- 提供状況
- すぐに使えます
完全にブラウザ内で実行します
ファイルがこのデバイスから外部に送信されることはありません。変換はブラウザで実行されます。
クリック、ドラッグ&ドロップ、または貼り付け · このデバイス上にとどまります
簡単な表は整列されたテキストから推測します。複雑な表や結合された表、回転したテキスト、スキャンページは確認が必要です。空のセルや列の境界を誤認することがあります。CSVでは選択したシートのみダウンロードされます。
文書形式
Office Open XMLは、DOCXとXLSXのパッケージ構造、関連付け、テキスト、ワークシートを定義しています。ECMA-376のカタログ(https://ecma-international.org/publications-and-standards/standards/ecma-376/)では、この形式ファミリーについて説明しています。PDFのページコンテンツはISO 32000で規定されており、ISOのカタログ(https://www.iso.org/standard/75839.html)でこの規格を確認できます。これらの変換では、同一のレイアウトを保証するのではなく、利用可能なコンテンツを再構築します。
変換ライブラリ
PDFの作成にはpdf-lib(MIT; https://pdf-lib.js.org/docs/api/)を使用し、PDFの読み取りとレンダリングにはPDF.js(Apache 2.0; https://mozilla.github.io/pdf.js/)を使用しています。どちらもこのツール上でローカルに実行されます。文書をアップロードする必要はありません。
使い方
- テキストレイヤーを含むPDFを選択します。
- グループ化方法を選び、検出された各グリッドを確認して、位置のずれや欠落セルがないか調べます。
- XLSXに変換するか、選択したシートをCSVとして書き出します。
プライバシーと制限事項
ファイルがこのデバイスから外部に送信されることはありません。ファイルの読み込み、変換、編集はすべてブラウザ内で実行されます。
関連ツール
よくある質問
表が見つからないのはなぜですか?
スキャンしたページであるか、そろった列位置が繰り返し現れない可能性があります。スキャンにはPDF OCRが役立つ場合があります。複雑なレイアウトでは、手作業での転記が必要になることがあります。
結合セルや数式は復元されますか?
いいえ。PDFページには、ワークブックの数式や信頼できるセル構造ではなく、位置情報を持つテキストが含まれています。複雑な表や結合セルを含む表は、確認と修正が必要です。
CSVにはすべての表が含まれますか?
CSVに含まれるのは選択したシートのみです。XLSXには、選択したページまたは表のオプションに従ってまとめられた、検出されたすべての表が含まれます。ダウンロードする前にプレビューを確認してください。
無料ツール · ブラウザ内で · アカウント不要