PDF / ドキュメント

PDFからExcelへ:ブラウザ上でローカル変換

シンプルな表形式のPDFからXLSXまたはCSVを抽出。グリッドをプレビューし、保存前に表ごとまたはページごとのシートを選べます。

PDFからExcelへ:ブラウザ上でローカル変換: テキストをベースラインごとにまとめ、そろった列位置をクラスタリングして、2行2列以上のシンプルな表を検出します。検出されたすべての表を、ページごとまたは表ごとにまとめたXLSXブックとして保存できます。CSVには選択したグリッドのみが保存されます。長い文章のセル、結合セルを含む表や複雑な表、空のセル、回転したテキスト、不規則な列は、見落とされたり正しく読み取れなかったりする場合があります。スキャンされたテキストの認識や、数式、スタイル、セル結合の保持には対応していません。 サーバーへのファイルアップロードは一切なく、100%ブラウザ内でローカル実行します。

カテゴリ
PDFツール
実行回数
ブラウザ内で
コスト
無料 · 登録不要
提供状況
すぐに使えます
PDFをExcelに変換ローカル処理

完全にブラウザ内で実行します

ファイルがこのデバイスから外部に送信されることはありません。変換はブラウザで実行されます。

PDFを選択

クリック、ドラッグ&ドロップ、または貼り付け · このデバイス上にとどまります

簡単な表は整列されたテキストから推測します。複雑な表や結合された表、回転したテキスト、スキャンページは確認が必要です。空のセルや列の境界を誤認することがあります。CSVでは選択したシートのみダウンロードされます。

文書形式

Office Open XMLは、DOCXとXLSXのパッケージ構造、関連付け、テキスト、ワークシートを定義しています。ECMA-376のカタログ(https://ecma-international.org/publications-and-standards/standards/ecma-376/)では、この形式ファミリーについて説明しています。PDFのページコンテンツはISO 32000で規定されており、ISOのカタログ(https://www.iso.org/standard/75839.html)でこの規格を確認できます。これらの変換では、同一のレイアウトを保証するのではなく、利用可能なコンテンツを再構築します。

変換ライブラリ

PDFの作成にはpdf-lib(MIT; https://pdf-lib.js.org/docs/api/)を使用し、PDFの読み取りとレンダリングにはPDF.js(Apache 2.0; https://mozilla.github.io/pdf.js/)を使用しています。どちらもこのツール上でローカルに実行されます。文書をアップロードする必要はありません。

使い方

  1. テキストレイヤーを含むPDFを選択します。
  2. グループ化方法を選び、検出された各グリッドを確認して、位置のずれや欠落セルがないか調べます。
  3. XLSXに変換するか、選択したシートをCSVとして書き出します。

プライバシーと制限事項

ファイルがこのデバイスから外部に送信されることはありません。ファイルの読み込み、変換、編集はすべてブラウザ内で実行されます。

関連ツール

よくある質問

表が見つからないのはなぜですか?

スキャンしたページであるか、そろった列位置が繰り返し現れない可能性があります。スキャンにはPDF OCRが役立つ場合があります。複雑なレイアウトでは、手作業での転記が必要になることがあります。

結合セルや数式は復元されますか?

いいえ。PDFページには、ワークブックの数式や信頼できるセル構造ではなく、位置情報を持つテキストが含まれています。複雑な表や結合セルを含む表は、確認と修正が必要です。

CSVにはすべての表が含まれますか?

CSVに含まれるのは選択したシートのみです。XLSXには、選択したページまたは表のオプションに従ってまとめられた、検出されたすべての表が含まれます。ダウンロードする前にプレビューを確認してください。

無料ツール · ブラウザ内で · アカウント不要