PDFをテキストに変換

PDFを1つアップロードすると、その中にすでに入っているテキストが、プレーンな.txtファイルとして手に入ります。無料、アカウント登録も透かしもありません。

無料 – 登録不要 – 完全な仕上がり

完全な仕上がりを無料で

透かしなし、ページ数の上限なし、1日の回数制限なし、アカウント登録も不要です。完成したファイルをそのままダウンロードできます。

はじめからプライバシー重視

ファイルはHTTPSで送信され、処理が終わり次第サーバーから削除されます。お客様の文書のコピーは一切保持しません。

PDFに対応

お使いの端末から直接アップロードでき、数秒でダウンロードできます。

インストール不要

パソコンでもスマホでも、最新のブラウザがあれば動きます。一般的なファイルなら数秒で終わります。

使い方

1

PDFをアップロード

PDFを1つ、アップロード欄にドロップしてください。100 MBまでのファイルに対応しています。

2

テキスト層を読み取る

ファイルに保存されているテキストを、当社のサーバー上のpdf.jsが1ページずつ、保存されたそのままの形で読み取ります。

3

.txtファイルをダウンロード

PDFと同じ名前が付いたUTF-8のテキストファイルが1つ手に入ります。そのまま貼り付けても、検索しても、別のツールに渡してもかまいません。

すでにファイルの中にあるテキスト

ほとんどのPDFは、言葉を画像ではなく本物のテキストとして持っています。Word、Google Docs、会計システム、ウェブサイトから書き出されたファイルには、文字も字間も改行もそろったテキスト層が入っています。このツールは、当社自身のサーバー上でpdf.jsを使ってその層を読み取り、UTF-8のプレーンな.txtファイルとして書き出します。

認識も、書き換えも、推測も一切しないので、結果は正確そのものです。手に入る言葉は、文書が実際に保存している言葉です。数百ページあっても抽出は数秒で終わり、ダウンロードされるファイルにはアップロードしたファイルと同じ名前が付きます。contract.pdfならcontract.txtです。

読み取れるテキストがPDFにないとき

正直にお伝えしておきたい限界が1つあります。PDFがスキャンやページの写真である場合、その中にあるのは画像だけです。読み取るテキスト層がないため、このツールは何も抽出できません。空のファイルをお渡しするのではなく、その事実をはっきりお伝えします。

これは意図してそうしています。画像の中の言葉を読み取るのはOCRであり、OCRは処理する1ページごとに実費がかかります。無料のツールが、お客様に断りなくその費用を使ってよいはずがありません。だからここで止めて、代わりに正しい行き先をご案内します。PDFをOCRでスキャンに検索できるテキスト層を追加してからこのページに戻るか、変換の一環としてスキャンも読み取るPDFをWordに変換をお使いください。

プレーンテキストが役に立つ場面

  • 文書を引用する。出典として示したい報告書の、きれいな全文が手に入ります。
  • 別のツールに渡す。検索インデックスも、スクリプトも、表計算ソフトも、求めているのはプレーンテキストです。
  • 検索して差分を取る。.txtファイルが2つあれば、どのエディタでも1行ずつ比べられます。
  • コピーできない内容を写す。ビューアによっては選択が無効にされていますが、テキスト層はちゃんとそこにあります。

文書の一部だけで足りるときは、まずPDFを分割して、必要な部分からテキストを取り出してください。前の版と突き合わせて確認したいときは、PDFを比較が並べて見せてくれます。

よくある質問

本当に無料ですか?

+

はい。抽出はファイルの中にすでにあるテキストを読むだけなので、当社側の処理費用はほとんどかかりません。アカウント登録も、透かしも、1日の回数制限も、途中で切り詰められた出力もありません。

スキャンしたPDFはどうなりますか?

+

スキャンはページの写真であってテキストではないため、取り出せるものがありません。空のファイルや中身を作ったファイルをお返しする代わりに、その旨をはっきりお伝えします。先に「PDFをOCR」を通していただくか、変換の一環としてスキャンも読み取る「PDFをWordに変換」をお使いください。

出力されるファイルはどんなものですか?

+

UTF-8のプレーンテキストファイルが1つ、PDFと同じ名前で出力されます。report.pdfならreport.txtです。テキストは文書のページ順に並び、改行もそのまま残ります。

テキストの順番がおかしくなることがあるのはなぜですか?

+

順番はPDF自体が持っているものです。新聞のような段組み、囲み記事、表は、それぞれ別のテキストのかたまりとして保存されているため、入り混じって出てくることがあります。普通の報告書や手紙、契約書なら、きれいに取り出せます。

サイズの上限はありますか?

+

一度に1ファイル、100 MBまでです。ページ数に上限はありません。長い文書はアップロードに時間がかかるだけで、抽出そのものが遅くなるわけではありません。

関連ツール

わかりやすい料金。ツールは無料、AIはサブスクリプションひとつ

ファイル系のツールは制限なく無料です。AI機能はクレジット制のサブスクリプションで動き、新規アカウントには無料クレジットを250進呈します。残高のクレジットに有効期限はありません。

料金の詳細を見る iOSアプリはApp Storeで近日公開

ログイン状態の維持とツールの動作に必要な範囲でブラウザの保存領域を使用し、あわせてCookieを使わない匿名の利用状況分析を行っています。広告やサイトをまたいだ追跡は行いません。