PDF to JSON 変換
公開 URL の PDF を構造化 JSON に変換——各要素にタイプ、テキスト、ページ番号、座標が付きます。無料の AgentBody アカウントでブラウザから実行。
- 本物の構造化 JSON
- 要素タイプを保持
- ページ対応出力
- URL から動作
- Markdown 付属
- エージェント対応
入力
出力
ツールを実行すると結果がここに表示されます。
機能特徴
この PDF to JSON コンバーターの機能と、データ抽出・パイプライン・LLM ワークフローへの組み込み方。
本物の構造化 JSON
変換が返すのは型付きブロックです。各ブロックは id、要素タイプ、テキスト内容、ページ番号、バウンディングボックスを運びます。フラットなテキストのダンプではなく、コードが直接インデックス・フィルタ・保存できる機械可読な構造です。
要素タイプを保持
ブロックは type フィールドを持ち、見出し、段落、その他の文書要素を区別します。ダウンストリームのロジックは、パーサーを書かずにタイトルと本文を異なる扱いにできます。
ページ対応出力
すべてのブロックが自分のページ番号を知り、ページには独自のテキスト層が付きます。ページレベルと要素レベルの JSON が 1 つのレスポンスに並存——ページで切り出すも、ブロック単位で扱うも自由です。
URL から動作
PDF の公開 HTTPS URL を渡します。レポート、請求書、公開の場所にホストされた論文など。file_url と file_name だけでリクエストが成立し、ファイル選択もアップロードも不要です。
Markdown 付属
同じ結果は文書の Markdown レンダリングも運びます。読解とプロンプトにはきれいな散文を、プログラム処理には構造化ブロックを——1 回のパースで両方の形態が手に入ります。
エージェント対応
このページはエージェントが使うのと同じ POST /v1/documents/parse エンドポイントを呼び、結果は GET /v1/documents/{document_id} で読み戻せます。ここで手動、あとで API 自動化、データは同一です。
使い方
次のステップで PDF を JSON に変換します。URL を準備し、パースを実行し、構造化ブロックを読みます。
無料アカウントを作成
AgentBody の無料アカウントにログインまたは作成します。アカウントが変換を解放し、クレジット費用を担います。
PDF の URL をコピー
変換したい PDF を開き、公開 HTTPS URL とファイル名をコピーします。署名付き・期限付き・イントラネットのリンクは解決しません。
フォームに入力
このページで file_url と file_name を入力します。merge_tables や relevel_titles を任意で有効にし、表と見出しの処理を調整できます。
パースを実行
実行をクリックします。リクエストは POST /v1/documents/parse に送られ、document_id が返ります。構造化結果はアカウントに保存されます。
JSON を読む
保存された結果を開きます。id、type、text、page、bbox を持つブロックがページごとのテキストと共に届き、読み戻しエンドポイントでページ範囲クエリが可能です。
結果を活用
blocks 配列をデータベース、検索インデックス、LLM パイプラインに流し込みます。フィールドはリクエスト間で安定しており、抽出コードは一度書けば使い続けられます。
よくある質問
PDF を JSON に変換する方法は?
PDF の公開 HTTPS URL とファイル名をコピーし、このページのフォームに貼り付けて実行をクリックします。パースは構造化結果を保存し、JSON として読み戻せます——テキスト・ページ番号・位置付きの型付きブロックと、ページごとのテキストです。
これは無料の PDF to JSON コンバーターですか?
無料で始められます。ツールはブラウザで動作し、無料の AgentBody アカウントで利用でき、各パースはアカウントのクレジットを使用します。価格はゲートウェイが管理し、コンソールに表示されます。
コンバーターはどんな JSON 構造を返しますか?
各要素が id、type、text、page、bbox(ページ上の位置)を持つ blocks 配列と、ページごとのテキストを持つ pages 配列、markdown フィールドです。要素レベルとページレベルの構造が 1 回のレスポンスで揃います。
PDF の本を JSON 形式にする方法は?
公開 URL で一度パースし、保存された結果をページごとに読み戻します。page_start と page_end パラメータで長い本を範囲ごとに歩き、巨大な 1 回のレスポンスではなく、自分のペースで完全な JSON を組み立てられます。
アップロード不要の PDF to JSON コンバーターはありますか?
このコンバーターにアップロードは一切ありません。公開 HTTPS URL を指定するだけで、ツールが自分で文書を取得します。ファイル選択の摩擦がない PDF to JSON 変換です。URL を入れ、構造化ブロックを得る。各パースはアカウントのクレジットで計量されます。
PDF の本をページごとに JSON 形式にする方法は?
公開 URL で本を一度パースし、page_start と page_end で保存済み結果をページごとに読み戻します。すべてのブロックにページ番号が付いているため、章やセクションをプロジェクトに必要な粒度で JSON に組み立てられます。
スキャン PDF に対応していますか?
パーサーは抽出可能なテキストレイヤーを持つ文書を読み取ります。テキストレイヤーのない純粋なスキャンは使い物になるブロックを生成しません。OCR の約束はここではしません。テキストベースの PDF は直接変換できます。
JSON を PDF に戻せますか?
いいえ——このツールは一方向で、PDF から JSON への変換です。データから PDF を生成するのは別の仕事で、あなたのレンダリングパイプラインがこの JSON を消費できます。