お客様のファイルは、当社のサーバーに保存されることはありません。このツールはすべてメモリ上で動作し、結果をすぐに同じ応答として返します。このサイトにある他のツールとは異なり、処理後に45分間サーバーにデータが残ることはありません。なぜなら、何も書き込まれないからです。
ShinobiToolsチーム作成 · 最終更新日:2026年8月
Wiki、README、またはMarkdownを読み込むことができるあらゆるツールに貼り付けたいPDFファイル。すべての見出しが単なる段落にならないようにします。ページ内の他のテキストよりも明らかに大きいテキストはMarkdownの見出しになり、それ以外のテキストは通常のテキストのままになります。
PDFには、HTMLやMarkdownのような「見出し」という概念は実際にはありません。各文字がどこに配置され、どのくらいの大きさであるかしか認識していません。各行のサイズをページの平均サイズと比較することで、視覚的に見出しとして認識される部分と通常の段落テキストを、特定のドキュメントスタイルでトレーニングされたレイアウトモデルを必要とせずに、シンプルかつ確実に分離できます。
テーブル、複数列のレイアウト、画像は再構築されません。これは、視覚的なデザインではなく、テキストコンテンツのみを抽出します。レイアウトに大きく依存するドキュメントの場合は、Markdownを最終的な変換としてではなく、クリーンアップするための出発点として扱ってください。
このツールはすべてメモリ上で動作し、結果をすぐに同じ応答として返します。処理後にデータがサーバーに残ることはありません。なぜなら、何も書き込まれないからです。
Markdown形式ではなく、プレーンテキストが必要ですか?画像からテキストへはOCRを実行し、見出しの検出なしでコピー可能なテキストを返します。テキストレイヤーのないスキャンから始めますか?まずそのツールで処理してください。PDF自体の中に、個別のMarkdownファイルではなく、クリック可能な見出しへのジャンプリストを作成したいですか?PDF Bookmarksが、ファイルの目次としてそれを作成します。構造ではなく、要点だけが必要ですか?Summarize PDFは、同じテキストを読み取り、見出しやリストの代わりに短い要約を作成します。
PDFファイルをここにドラッグ&ドロップします。Markdownが下のボックスに表示され、コピーしたり、.mdファイルとしてダウンロードしたりできます。
各行のフォントサイズを、そのページの平均サイズと比較します。ページのほとんどのテキストよりも明らかに大きい行は、#見出しとして認識され、それ以外の行はプレーンテキストのままになります。
いいえ、単一の見出しレベルのみです。「この行は見出しとして際立っている」ということを、「これは本文である」ということを区別します。フォントサイズだけから、完全なアウトライン階層を推測しようとはしません。
いいえ。このツールは、ページごとにテキストコンテンツを読み込みます。テーブル、画像、複数カラムのレイアウトなどのレイアウト要素は、Markdown出力に再構築されません。
スキャン時にすでにテキストレイヤーが含まれている場合に限ります。たとえば、このサイトのOCRツールでテキストレイヤーを追加したPDFなどです。テキストレイヤーのないスキャン画像には、このツールで抽出できるものがありません。
1ファイルあたり25ページです。アカウント登録や透かし、1日の上限はありません。