PDFの単語カウンター

注:計算はすべてブラウザー内で行われます。お客様のデータにアクセスすることはありません。

PDFの単語数を数える方法

  1. 上のエリアにPDF(またはWord、ODT、テキストファイル)をドラッグ&ドロップするか、クリックして選択します。
  2. モード切り替えを「単語」に設定します。
  3. カウントボタンを押すと、単語数がすぐに表示されます。いつでも文字数に切り替えられます。両方が同時に計算されます。

よくある質問

ファイルはサーバーにアップロードされますか?

いいえ。すべての処理はブラウザ内で完結します。ファイルは一切サーバーに送信されません — 受信するバックエンドが存在しないためです。

文字数はどのように数えられますか?

改行を除くすべての文字がカウントされます。スペース、句読点、特殊記号も含まれます。これは翻訳・出版業界で使われる基準に準拠しています。

複数のファイルを一度にカウントできますか?

はい。複数のファイルを一度に選択またはドロップできます。各ファイルを処理し、結果を表で表示します。結果はCSVファイルとしてエクスポートすることもできます。

なぜ単語数ではなく文字数を数えるのですか?

翻訳・出版では、単語数ではなく文字数で料金が決まることがよくあります。特にロシア語、日本語、中国語のように単語の区切りが異なる言語では顕著です。文字数は、より一貫性があり言語に依存しない指標を提供します。

対応しているファイル形式は?

.pdf — テキストを選択できるすべてのPDF。.docx、.docm — Microsoft Word(Office 2007以降)。.doc — Microsoft Word(Office 97~2003)、部分的に対応。

.docファイルの文字数が0と表示されるのはなぜですか?

古い.docファイル(Office 97~2003)は部分的に対応しています。ファイルがパスワードで保護されている場合や珍しいエンコーディングを使用している場合、抽出が失敗することがあります。まずMicrosoft Wordで.docx形式として保存してみてください。

PDFの単語数がWordと異なるのはなぜですか?

すべての形式は同じルールで数えられます。本文に加えて、ヘッダー、フッター、脚注、文末脚注、テキストボックスの文字も含みます。Microsoft Wordは自身のカウントにヘッダーとフッターを含めないため、当ツールの数値は通常大きくなります — これは意図的な仕様です。唯一の実質的な違いは、PDFで各ページに繰り返されるヘッダーはページごとに数えられる一方、.docxではヘッダーは一度だけ保存され、当ツールでも一度だけ数える点です。

ヘッダーやフッターの文字も数えますか?

はい、意図的にそうしています。.doc、.docx、.odt、.pdfのいずれも、本文に加えてヘッダー、フッター、脚注、文末脚注、テキストボックスの文字を数えます。Microsoft Wordは自身の単語数にヘッダーとフッターを含めないため、当ツールの数値は通常大きくなります。翻訳者はその文字分の報酬も受け取るため、当ツールでも数えます。

スキャンされたPDFの単語数を数えられますか?

現時点ではできません。スキャンされたPDFは画像であり、選択可能なテキストがありません。まずOCR(光学式文字認識)を実行してスキャンをテキストに変換してください。Adobe AcrobatやオンラインのOCRツールが利用できます。

ファイルサイズの制限はありますか?

ありません。すべての処理はブラウザ内で行われるため、サーバー側のサイズ制限はありません。非常に大きなファイルはデバイスのメモリによって時間がかかる場合があります。

このツールは役に立ちましたか?