PDFの最初と最後のページを抽出
PDFの最初と最後のページ抽出機能は、既知の総ページ数を正確で決定的な抽出指示へ変換します。総数を入力すると、ページ1と最終ページを特定し、安定したファイル名とメディアタイプを含む2ページPDFのマニフェストを返します。1ページのファイルには異なる両端がないため、対象文書には2ページ以上が必要です。前の工程ですでに総ページ数を取得しており、後続のPDF処理へ曖昧さのない選択を渡したい場合に適しています。
無料で実行
文書の両端を構成する2ページを残します
長いPDFでは、文書を特徴づける重要な情報が両端に置かれることがよくあります。最初のページには表紙、題名、口座情報、報告期間、提出番号などがあり、最後のページには署名、承認文、合計、付録、受付印などが含まれる場合があります。この機能を使うと、最終ページ番号を別途計算せずに、これら2つの境界ページを保持できます。PDFの総ページ数を指定すると、元文書のページ1と、その総数と同じ番号のページが選ばれます。返されるマニフェストは、必ず元の順序どおりの2ページPDFを表します。最初のページが先、最後のページが後です。PDFのメディアタイプと予測可能なダウンロード用ファイル名も含まれるため、ファイル生成工程へ容易に渡せます。元の文書は変更されません。選択は位置だけに基づくため、対象ページの内容を調査、分類、要約、再解釈することもありません。
入力検証とページ番号の規則を確認します
ページ番号は一般的なPDFツールと同じく1から始まります。先頭はページ1であり、ページ0ではありません。`page_count`には2以上の有限な整数を指定する必要があります。小数、数字を表す文字列、欠損値、配列、オブジェクトは暗黙に変換せず拒否します。この厳格な規則により、元データが不正なのに抽出要求だけが有効に見える事態を防ぎます。1ページPDFも、最初と最後が同じ物理ページになるため拒否されます。この機能が扱うのは異なる2つの境界ページです。2ページの文書では1と2、300ページの文書では1と300が選択されます。出力には元の総数と、新しい文書の総数2の両方が示されるため、後続コードで各数値がどちらの文書を示すか推測する必要がありません。選択された元ページ番号も明示され、ログ、画面、後続工程で要求内容を正確に説明できます。
自動PDF処理でマニフェストを安全に利用します
この機能は意図的に決定的かつ有限です。ネットワーク要求、秘密情報の読み取り、文書の保存を行わず、現在時刻や乱数も利用しません。そのため、同じ有効な総ページ数からは毎回まったく同じマニフェストが得られます。一般的な処理では、PDF検査時に信頼できるページ数を取得し、この機能で境界を決め、`extracted_pages`を元バイト列から新しいPDFへページをコピーする部品へ渡します。選択とデータ転送を分離すると、ファイルアクセスと業務規則が別工程にあるブラウザーツール、待ち行列、監査システムで便利です。ページ数がコピー工程へ渡すPDFと同じ文書のものか確認してください。古い値では、新しい版の末尾を超えるページを指すおそれがあります。APIによる自動化は1回$0.002で、純粋な選択処理はブラウザーでも実行できます。元文書は変更されないため、生成ファイルの保存方針は別途設定してください。
活用例
表紙と署名ページを準備します
契約書一式から冒頭の表紙と末尾の署名ページを選び、確認用の小さなファイルを作成します。
報告書の両端を保存します
長い報告書の表題ページと最終証明ページを、コードで末尾位置を計算せずに記録します。
PDF処理フローを構築します
総ページ数のメタデータを、後続のPDFコピー処理が実行できる明示的な2ページ選択へ変換します。
よくある質問
APIリクエストの料金はいくらですか?
APIリクエスト1回の料金は$0.002です。決定的な選択処理はブラウザーでも実行できます。
1ページのPDFが拒否されるのはなぜですか?
1ページPDFでは最初と最後が同じです。この機能では異なる2つの元ページが必要です。
ページ番号は0と1のどちらから始まりますか?
1から始まります。最初は1で、最後は`page_count`と同じ番号です。
元のPDFは変更されますか?
いいえ。新しい2ページPDFを表す決定的なマニフェストを返し、元文書は変更しません。
総ページ数を文字列で指定できますか?
いいえ。`page_count`は整数で指定してください。曖昧さを避けるため、数字の文字列や小数は拒否されます。
開発者向け — APIアクセス
このページの機能はすべてAPIからも利用できます。自社システムに組み込みたいチーム向けのセクションです。それ以外の方は上のツールをそのままお使いください。
エンドポイント
Bearerトークンで認証し、POST1回でタスクをキューに登録します。結果はWebhookまたは署名付きリンクで受け取れます。
お使いのスタックから呼び出す
curl -X POST https://api.kit.forhosting.com/pdf/first-last-page-extract \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"page_count":12}'const res = await fetch("https://api.kit.forhosting.com/pdf/first-last-page-extract", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"page_count": 12
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/pdf/first-last-page-extract",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"page_count": 12
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/pdf/first-last-page-extract", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"page_count":12}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"page_count":12}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/pdf/first-last-page-extract", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)リクエスト例
{
"page_count": 12
}レスポンス例
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "pdf.first_last_page_extract",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}非同期APIです。task_idは即時に返ります。ポーリングは1秒あたり1リクエストまでです。
料金
単価はすべて公開しています。トークン換算や独自クレジットはありません。失敗したタスクは課金されません。
制限
max_mb | 25 |
max_pages | 200 |
エラー
| HTTP | コード | 意味 |
|---|---|---|
401 | unauthorized | APIキーが無効か、指定されていません。Authorizationヘッダーを確認してください。 |
402 | insufficient_balance | 残高が不足しています。チャージ後に再度お試しください。 |
404 | unknown_type | 指定されたタスクタイプは存在しません。タイプ名を確認してください。 |
429 | rate_limited | リクエストが多すぎます。しばらく待ってから再度お試しください。 |