PDF to JSON 変換

公開 URL の PDF を構造化 JSON に変換——各要素にタイプ、テキスト、ページ番号、座標が付きます。無料の AgentBody アカウントでブラウザから実行。

  • 本物の構造化 JSON
  • 要素タイプを保持
  • ページ対応出力
  • URL から動作
  • Markdown 付属
  • エージェント対応

入力

出力

ツールを実行すると結果がここに表示されます。

機能特徴

この PDF to JSON コンバーターの機能と、データ抽出・パイプライン・LLM ワークフローへの組み込み方。

本物の構造化 JSON

変換が返すのは型付きブロックです。各ブロックは id、要素タイプ、テキスト内容、ページ番号、バウンディングボックスを運びます。フラットなテキストのダンプではなく、コードが直接インデックス・フィルタ・保存できる機械可読な構造です。

要素タイプを保持

ブロックは type フィールドを持ち、見出し、段落、その他の文書要素を区別します。ダウンストリームのロジックは、パーサーを書かずにタイトルと本文を異なる扱いにできます。

ページ対応出力

すべてのブロックが自分のページ番号を知り、ページには独自のテキスト層が付きます。ページレベルと要素レベルの JSON が 1 つのレスポンスに並存——ページで切り出すも、ブロック単位で扱うも自由です。

URL から動作

PDF の公開 HTTPS URL を渡します。レポート、請求書、公開の場所にホストされた論文など。file_url と file_name だけでリクエストが成立し、ファイル選択もアップロードも不要です。

Markdown 付属

同じ結果は文書の Markdown レンダリングも運びます。読解とプロンプトにはきれいな散文を、プログラム処理には構造化ブロックを——1 回のパースで両方の形態が手に入ります。

エージェント対応

このページはエージェントが使うのと同じ POST /v1/documents/parse エンドポイントを呼び、結果は GET /v1/documents/{document_id} で読み戻せます。ここで手動、あとで API 自動化、データは同一です。

使い方

次のステップで PDF を JSON に変換します。URL を準備し、パースを実行し、構造化ブロックを読みます。

01

無料アカウントを作成

AgentBody の無料アカウントにログインまたは作成します。アカウントが変換を解放し、クレジット費用を担います。

02

PDF の URL をコピー

変換したい PDF を開き、公開 HTTPS URL とファイル名をコピーします。署名付き・期限付き・イントラネットのリンクは解決しません。

03

フォームに入力

このページで file_url と file_name を入力します。merge_tables や relevel_titles を任意で有効にし、表と見出しの処理を調整できます。

04

パースを実行

実行をクリックします。リクエストは POST /v1/documents/parse に送られ、document_id が返ります。構造化結果はアカウントに保存されます。

05

JSON を読む

保存された結果を開きます。id、type、text、page、bbox を持つブロックがページごとのテキストと共に届き、読み戻しエンドポイントでページ範囲クエリが可能です。

06

結果を活用

blocks 配列をデータベース、検索インデックス、LLM パイプラインに流し込みます。フィールドはリクエスト間で安定しており、抽出コードは一度書けば使い続けられます。

よくある質問

PDF を JSON に変換する方法は?

PDF の公開 HTTPS URL とファイル名をコピーし、このページのフォームに貼り付けて実行をクリックします。パースは構造化結果を保存し、JSON として読み戻せます——テキスト・ページ番号・位置付きの型付きブロックと、ページごとのテキストです。

これは無料の PDF to JSON コンバーターですか?

無料で始められます。ツールはブラウザで動作し、無料の AgentBody アカウントで利用でき、各パースはアカウントのクレジットを使用します。価格はゲートウェイが管理し、コンソールに表示されます。

コンバーターはどんな JSON 構造を返しますか?

各要素が id、type、text、page、bbox(ページ上の位置)を持つ blocks 配列と、ページごとのテキストを持つ pages 配列、markdown フィールドです。要素レベルとページレベルの構造が 1 回のレスポンスで揃います。

PDF の本を JSON 形式にする方法は?

公開 URL で一度パースし、保存された結果をページごとに読み戻します。page_start と page_end パラメータで長い本を範囲ごとに歩き、巨大な 1 回のレスポンスではなく、自分のペースで完全な JSON を組み立てられます。

アップロード不要の PDF to JSON コンバーターはありますか?

このコンバーターにアップロードは一切ありません。公開 HTTPS URL を指定するだけで、ツールが自分で文書を取得します。ファイル選択の摩擦がない PDF to JSON 変換です。URL を入れ、構造化ブロックを得る。各パースはアカウントのクレジットで計量されます。

PDF の本をページごとに JSON 形式にする方法は?

公開 URL で本を一度パースし、page_start と page_end で保存済み結果をページごとに読み戻します。すべてのブロックにページ番号が付いているため、章やセクションをプロジェクトに必要な粒度で JSON に組み立てられます。

スキャン PDF に対応していますか?

パーサーは抽出可能なテキストレイヤーを持つ文書を読み取ります。テキストレイヤーのない純粋なスキャンは使い物になるブロックを生成しません。OCR の約束はここではしません。テキストベースの PDF は直接変換できます。

JSON を PDF に戻せますか?

いいえ——このツールは一方向で、PDF から JSON への変換です。データから PDF を生成するのは別の仕事で、あなたのレンダリングパイプラインがこの JSON を消費できます。