PDFしおりからEPUBチャプター構成を作成
実用的なEPUBには明確な読書順序が必要ですが、PDFではその順序がしおりのアウトラインだけに示されていることがあります。この機能は抽出済みのPDFしおり一覧を受け取り、最上位の各しおりをEPUBのチャプター項目へ変換します。しおりの順序と題名を維持し、安定したXHTMLファイル名を付け、取得できる場合は移動先ページも引き継ぎます。入れ子のしおりはセクション情報として扱われ、独立したチャプターにはなりません。最上位のしおりがない場合は、存在しない構成を推測せず、明確なエラーを返します。
無料で実行
しおりアウトラインをご用意ください
ページ本文から目立つ見出しをコピーするのではなく、PDF解析ツールまたは検査ツールが出力したしおりアウトラインをご使用ください。各レコードは元の読書順で指定します。題名と数値のレベルが必須で、レベル1が最上位を表します。1から始まる移動先ページは任意です。レベル2以下のレコードは、小節、付録、図、その他の入れ子の移動先を表せます。不正なアウトラインを見逃さないよう検証しますが、EPUBチャプターへ昇格させることはありません。題名の前後の空白だけを除き、表記、句読点、大文字小文字、内部の空白は保ちます。ページを指定する場合は正の整数が必要です。この明示的な形式により、インデントや書体からの推測を避け、環境を問わず再現可能な結果を得られます。また、PDFからの抽出処理と出版構成の設計を明確に分離できます。
生成されたチャプター一覧をご確認ください
出力にはチャプター数と順序付きのチャプター配列が含まれます。各チャプターには1から始まるインデックス、対応する最上位しおりの正規化済み題名、chapter-001.xhtmlのような安定した名前が付きます。名前は題名ではなく位置に基づくため、句読点、題名の重複、非ラテン文字、将来のslug規則による衝突を防げます。最上位しおりに移動先ページがあればsource_pageを含め、なければ任意フィールドをnullにせず省略します。この機能は本文の抽出、PDFの分割、XHTMLの作成、EPUBナビゲーション文書の構築は行いません。後続処理がファイル名、抽出内容、spine項目、ナビゲーションリンクを作成するための中間構造を提供します。チャプター数は常にレベル1のレコード数と一致します。
アウトラインがない場合や不完全な場合
PDFのページが正常に表示されても、有効なしおりが含まれない場合があります。その場合、最上位チャプターを判断する信頼できる情報がないため、ページ番号、文字サイズ、文章パターンから推測せず、入力エラーを返します。推測した一覧はもっともらしく見えても、内容を誤った題名に割り当てたり、意図された階層を失わせたりするおそれがあります。すべてのしおりがレベル1より深い場合も、最上位の境界を確定できないため同じエラーになります。上流の抽出結果を修正するか、意図したアウトラインを追加してから再実行してください。空の題名、不正なレベル、正でないページなどは位置を示すメッセージで通知します。処理は最大10,000件を1回だけ走査し、ネットワークも時刻も使用しません。同一入力からは常に同一のインデックスと名前が生成され、1回あたり$0.002です。
活用例
EPUB変換を設計する
抽出したPDFアウトラインを、後続処理がXHTML本文で満たせるチャプターマニフェストへ変換します。
文書ナビゲーションを監査する
公開前に、予定するEPUBチャプターの数と順序をPDFの最上位しおりと比較できます。
安定したチャプター名を作る
題名の重複、句読点、非ラテン文字があっても衝突しない位置ベースのXHTML名を割り当てます。
よくある質問
料金はいくらですか?
APIは1回あたり$0.002で、同じ決定的な変換をブラウザーでも実行できます。
PDFファイル自体を読み取りますか?
いいえ。PDFから抽出済みのしおりアウトラインを受け取り、チャプター一覧へ変換します。
何がチャプターになりますか?
レベルが正確に1である各しおりが、入力と同じ順序で1つのチャプターになります。
入れ子のしおりはどうなりますか?
検証は行いますが、チャプターとして出力しません。後で最上位チャプター内のセクションとして扱えます。
最上位しおりがない場合はどうなりますか?
チャプター境界を推測せず、無効な入力としてエラーを返します。
移動先ページは必須ですか?
いいえ。ページがあればsource_pageとなり、なければ任意フィールドを省略します。
開発者向け — APIアクセス
このページの機能はすべてAPIからも利用できます。自社システムに組み込みたいチーム向けのセクションです。それ以外の方は上のツールをそのままお使いください。
エンドポイント
Bearerトークンで認証し、POST1回でタスクをキューに登録します。結果はWebhookまたは署名付きリンクで受け取れます。
お使いのスタックから呼び出す
curl -X POST https://api.kit.forhosting.com/pdf/to-epub-structure \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"outline":[{"title":"Introduction","level":1,"page":1},{"title":"Background","level":2,"page":3},{"title":"Methods","level":1,"page":12}]}'const res = await fetch("https://api.kit.forhosting.com/pdf/to-epub-structure", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"outline": [
{
"title": "Introduction",
"level": 1,
"page": 1
},
{
"title": "Background",
"level": 2,
"page": 3
},
{
"title": "Methods",
"level": 1,
"page": 12
}
]
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/pdf/to-epub-structure",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"outline": [
{
"title": "Introduction",
"level": 1,
"page": 1
},
{
"title": "Background",
"level": 2,
"page": 3
},
{
"title": "Methods",
"level": 1,
"page": 12
}
]
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/pdf/to-epub-structure", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"outline":[{"title":"Introduction","level":1,"page":1},{"title":"Background","level":2,"page":3},{"title":"Methods","level":1,"page":12}]}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"outline":[{"title":"Introduction","level":1,"page":1},{"title":"Background","level":2,"page":3},{"title":"Methods","level":1,"page":12}]}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/pdf/to-epub-structure", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)リクエスト例
{
"outline": [
{
"title": "Introduction",
"level": 1,
"page": 1
},
{
"title": "Background",
"level": 2,
"page": 3
},
{
"title": "Methods",
"level": 1,
"page": 12
}
]
}レスポンス例
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "pdf.to_epub_structure",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}非同期APIです。task_idは即時に返ります。ポーリングは1秒あたり1リクエストまでです。
料金
単価はすべて公開しています。トークン換算や独自クレジットはありません。失敗したタスクは課金されません。
制限
max_mb | 25 |
max_pages | 200 |
エラー
| HTTP | コード | 意味 |
|---|---|---|
401 | unauthorized | APIキーが無効か、指定されていません。Authorizationヘッダーを確認してください。 |
402 | insufficient_balance | 残高が不足しています。チャージ後に再度お試しください。 |
404 | unknown_type | 指定されたタスクタイプは存在しません。タイプ名を確認してください。 |
429 | rate_limited | リクエストが多すぎます。しばらく待ってから再度お試しください。 |