ユースケース

ユースケース

このガイドでは、Aspose.PDF FOSS for Python の実際のユースケースを示します。ドキュメント生成、PDF から画像への変換、テキスト抽出、セキュア配布、そして AcroForm データ収集が含まれます。このライブラリは純粋な Python で、Python 3.11 以降が必要です。また、ネイティブな (C/C++) ランタイム依存性はありません。

ドキュメント生成

新しい Document にページを追加し、各ページにテキストを配置して結果の PDF を保存することで、PDF をゼロから作成します。このパターンは請求書生成、証明書印刷、ステートメント作成パイプラインの基盤となります:

import aspose_pdf

doc = aspose_pdf.Document()
page = doc.pages.add()
page.add_text("Monthly Report", x=72, y=720, font_size=18)
doc.save("report.pdf")

PDF から画像への変換

サムネイル、印刷用出力、またはビジュアルリグレッションのベースラインとして、ページをラスタ画像にレンダリングします。Document.save_page_as_image() は指定された DPI でページを1枚ずつレンダリングし、直接ファイルに書き出します:

import aspose_pdf

doc = aspose_pdf.Document()
doc.load_from("input.pdf")
doc.save_page_as_image(0, "page1.png", dpi=150)

テキスト抽出とインデックス作成

検索インデックス作成、データマイニングパイプライン、またはテストスイートにおける自動コンテンツ検証のために、TextAbsorber を使用して文書の全文を抽出します:

import aspose_pdf

doc = aspose_pdf.Document()
doc.load_from("input.pdf")
absorber = aspose_pdf.TextAbsorber()
absorber.visit(doc)
print(absorber.text)

安全な文書配布

配布前に、ユーザー用パスワードとオーナー用パスワードを別々に設定して文書を暗号化します。ユーザーパスワードはファイルを開くために必要です。オーナーパスワードは印刷やコンテンツ抽出などの権限を管理します:

import aspose_pdf

doc = aspose_pdf.Document()
doc.load_from("report.pdf")
doc.encrypt(user_password="user-password", owner_password="owner-password", permissions=0)
doc.save("report-secured.pdf")

Document.decrypt(password) はすでに開かれた文書から暗号化を除去し、Document.change_passwords() は完全な復号/暗号化の往復なしで両方のパスワードをローテーションします。

AcroForm データ収集

PDFフォームに入力された値を Document.form.fields でイテレートし、各フィールドの名前と現在の値を出力することで読み戻します——別途フォーム送信サーバーを用意せずに記入済みの申請書を処理する際に便利です:

import aspose_pdf

doc = aspose_pdf.Document()
doc.load_from("submitted-form.pdf")
for field in doc.form.fields:
    print(field.name, "=", field.value)

参照

 日本語