PDFテキスト抽出、使う範囲を決めて取り出す

PDFテキスト抽出で、資料の必要な章やページから本文・表を取り出せます。コピーしたい内容を確認し、TXTやMarkdown、表のExcelへ保存できます。

開始

ファイルをアップロード

ドラッグ&ドロップまたはクリックして選択

0/30 · 0 credits · Free: 1 file

PDFテキスト抽出の進め方

必要なページと、文章の前後関係が分かる範囲を先に確認します。

1

指定する:取り出すページを選択

PDFをアップロードし、欲しい章と続きのページを対象に含めます。

2

選ぶ:本文か表かを決める

文章と表を扱うならContent extraction、表だけを主に使うならTable extractionを選択します。

3

確認する:抜けや混入を見直す

Process filesを押し、段落の途中で切れていないか、注記や見出しが足りているか原本を確認します。

4

取り出す:必要な内容を保存

本文をコピー・TXT・Markdownで持ち出します。表はCSVやExcelで保存できます。

欲しい内容は資料の一部分

全文を読む必要がなくても、コピーしたい章の前後関係は残す必要があります。

章の途中から抽出
冒頭の説明が欠けると、後の指示や定義の意味が分からなくなることがあります。
続きのページ
段落や表が次のページに続く場合、選択範囲に含める必要があります。
表の外の注記
条件や補足はセルの外に記載されることがあり、本文側の確認も必要です。
Image 1

資料の一部を再利用する作業に

原稿から確認した内容を、手元のノートや作業資料へ移せます。

マニュアルの控え
担当作業に必要な説明を取り出し、確認用のメモにできます。
文章の再編集
保存したTXTやMarkdownを、普段のエディターで整理できます。
表だけを整理
資料に含まれる一覧を出力し、出力先で必要な行や列へ整えられます。

PDFテキスト抽出のよくある質問

本文の取り出しとPDFそのものの編集の違い。