PDF Primitive
電話:03-5316-337503(5316)3375
info@trustss.co.jp
PDF Primitive SDK

PDFを「構成オブジェクト」に分解し、
構造情報を抽出する。

PDFの構成オブジェクトだけでなく、構造解析した文字・図形・画像の位置や描画範囲(Bounding Box)を含めた詳細データを抽出します。抽出したベクター図形は画像データへの変換も可能です。
RAG/LLMへのAI用前処理やセキュアな帳票解析システムなど種々のPDF解析に利用できる開発基盤です。

※ダウンロードをクリックすると、詳細エリアが展開します。

① アドレス登録なしで今すぐ14日間お試し

ダウンロードを開始した時点で、ソフトウェア使用許諾契約に同意したものとみなされます。

無料評価版(ZIP)をダウンロード
② 検証期間30日間の試用版ライセンスキー(無料)

自社システムへの組み込みなど、じっくり検証したい開発者向けに、30日間使える「試用版ライセンスキー」をメール送信します。


This site is protected by reCAPTCHA
WHY CHOOSE US

選ばれる3つの理由

PDFを構成する最小単位のオブジェクトだけではなく、ページを構成するテキスト・図形・画像要素を詳細な属性情報と共に抽出

PDFを構成するオブジェクトやテキスト・図形・画像を抽出

PDFを構成する全てのオブジェクトを抽出しますので、正確な解析ができます。抽出したオブジェクトを使えば独自のPDFパーサーを構築することができます。
さらに、PDFの内部構造を解析してページの構成要素としてのテキストや図形・画像を抽出します。

位置・サイズ・境界データ(属性情報)を抽出

PDFの内部構造解析では各要素が「どこに」「どのサイズで」配置されているかの座標情報、フォント名や色などの属性情報を加工せずに抽出
複雑なページレイアウトの解析はもちろん、特定のエリアを指定した高度なデータ抽出システムを容易に構築できます。

図形(ベクターパス)の抽出と画像化

線や塗りつぶしといったベクター図形情報をパスコマンドで(パスステータス)属性情報と共に抽出
さらに、抽出した図形データをそのまま画像(PNGやピクセルデータ等)へ変換して取得できます。属性データは加工されませんので、LLM(マルチモーダルAI)への高精度なデータインプットに大きな威力を発揮します。

SAMPLE CODES

サンプル コード

指定されたページからすべてのテキスト、画像、図形を抽出
(領域を指定した抽出もできます)
pdf_primitive_sample.cs
// ライブラリの初期化
using (var stc = new Structure("license-key")
// PDFファイル オープン
using (var prm = stc.GetPrimitiveInterface("in.pdf")
// ページ指定
using (var page = prm.GetPageInterface(1/*先頭ページ*/)
{
	// ページからの抽出
	using (var cont = page.GetContentInterface())
	{
		// 各文書内容を抽出
		AnyContentsObject res = cont.GetFirstContentObject();
		while(res != null)
		{
			switch(res.ContentType)
			{
			case PrmContentType.PRM_CONTENT_TEXT: PrintTextData(res); break;
			case PrmContentType.PRM_CONTENT_IMAGE: PrintImageData(res); break;
			case PrmContentType.PRM_CONTENT_PATH: PrintPathData(res); break;
			default: System.Environment.Exit(0);
			}
			res = cont.GetNextContentObject();
		}
	}
}
全体のコードは、こちらを参照してください。
PRICING PLANS

料金・ライセンス

PDF Primitive 評価版

技術検証用

¥0
  • すべての抽出機能を試用可能
  • ローカルまたはサーバー環境で動作可能
  • テクニカルサポート(利用手順など)
  • 出力データ(PDF)へ透かしが追加されます
  • 先頭3ページから無制限に抽出可能
  • 商用環境での運用
  • 自社内での本番運用
無料評価版をダウンロード

ダウンロードには「利用許諾契約書」への同意が必要です。

PDF Structure (多機能版)

抽出機能(PDF Primitive)および画像化、内容変更、スタンプ、電子署名機能

  • PDF内容の変更(削除、追加等)
  • 電子押印(スタンプ追加)
  • 画像をPDFに変換
  • 電子署名・タイムスタンプ
  • 必要な機能だけを選択購入可能
  • 処理枚数
    Client OS環境用:上限なし
    Server OS環境用:36万ページ/年
  • 年間サポート
要件を相談・問い合わせる
CONTACT / ESTIMATE

お見積もり依頼・ご質問

見積書を発行いたします。製品に関する技術的ご質問(使用手順など)にも回答いたします。

This site is protected by reCAPTCHA

Pdftools SDK

PDFをPDF/Aに変換

PDFを最適化・サイズを適切に圧縮

画像をPDFに変換

PDFを画像に変換

PDFを合成・分割

PDFに電子署名・署名検証

セキュアで暗号化されたPDFを作成

PDF仕様との規格準拠検証

フォームフィールドの追加と内容入力

PDFへの内容追加と削除

PDFからの情報抽出

PDF生成

印刷用にレイアウト

アノテーション管理

メタデータ管理

PDFの編集

PDF/A 概要

PDF/A とは

PDF/A 概要

PDF/A 入門

10の最も重要なこと

ディジタルソースから

PDF/A処理

PDFA-2

PDFA-3


PDF Toolsライト

PDF Structure(構成)

PDF Imager-LP(画像変換)

PDF Primitive

PDF Metadata

PDF Stamper(電子印鑑)

PDF 構文解説-1

PDFファイル解析手順

PDFファイル構造 -概要-

PDFファイル構造

ドキュメント カタログ

ページツリー

ページ

Contentsオブジェクト

Articlesノード

デスティネーション

アクション(Actions)

テキスト

フォント


お問い合わせ

PDF 構文解説-2

ナビゲーション

XMP

メタデータ

文書情報

オブジェクト ストリーム

クロスリファレンス ストリーム

各種 ディクショナリ

アノテーション

インターラクティブフォーム

増加更新(Incremental Update)

電子署名(Digital Signature)

出力色特性(Output Intent)