Agent skill
PDFファイルの読み取り、作成、操作を行うスキル。テキスト/テーブル抽出、マージ、注釈、メタデータ処理に対応。
Install this agent skill to your Project
npx add-skill https://github.com/HaRu-LLC/ai-pm_system_notebooklmuse/tree/main/.agent/skills/engineering/pdf
SKILL.md
目的
PDFファイルの包括的な操作を行う。テキスト・テーブル抽出、文書のマージ/分割、注釈追加、OCR処理まで対応。
トリガー語
- 「PDFを作成」
- 「PDFからテキスト抽出」
- 「PDFをマージ」
- 「PDFに注釈を追加」
- 「スキャン文書をOCR」
主要ライブラリ
pypdf
基本操作:マージ、分割、メタデータ抽出、ページ回転
from pypdf import PdfReader, PdfWriter
# マージ例
writer = PdfWriter()
for pdf in pdf_files:
reader = PdfReader(pdf)
for page in reader.pages:
writer.add_page(page)
writer.write("merged.pdf")
pdfplumber
テキスト・テーブル抽出(レイアウト維持)
import pdfplumber
with pdfplumber.open("document.pdf") as pdf:
for page in pdf.pages:
tables = page.extract_tables()
# DataFrameへ変換可能
reportlab
新規PDF作成(Canvas + Platypusフレームワーク)
コマンドラインツール
| ツール | 用途 |
|---|---|
| pdftotext | テキスト抽出(レイアウト維持オプション) |
| qpdf | マージ、分割、回転、復号化 |
| pdftk | マージ・分割の代替 |
専門タスク
スキャン文書のOCR
import pytesseract
from pdf2image import convert_from_path
images = convert_from_path("scanned.pdf")
for img in images:
text = pytesseract.image_to_string(img)
透かし(Watermark)
透かしページを既存文書にマージ
パスワード保護
pypdfの暗号化メソッドを使用
参照
- forms.md: PDFフォーム入力手順
- reference.md: 高度な機能
ライセンス
Anthropic Skills Repository License(LICENSE.txt参照)
Recommended Agent Skills
Expand your agent's capabilities with these related and highly-rated skills.
skills-creator
最高品質のSkillを設計・生成するメタスキル。新しいSkillが欲しい、繰り返し作業を自動化したい、ベストプラクティスに準拠したSkillを作りたいときに使う。
workflow-designer
複数のSkillsを連動させた一連のワークフローを設計するメタスキル。ユーザー確認ポイント、依存関係、エラー時のフォールバックを含む完全なワークフロー定義を生成。
template-miner
過去資料からテンプレ・スタイルガイド・チェックリストを抽出して資産化する。テンプレが無い、文書品質がバラつく、過去資料を活用したいときに使う。
brainstorming
ブレインストーミングスキル。アイデアを実装前に仕様に変換する協調的デザインプロセス。
test-driven-development
テスト駆動開発(TDD)の厳格な実践スキル。テストを先に書き、実装を後に書く規律あるアプローチ。
writing-plans
実装計画作成スキル。マルチステップ開発タスク向けの詳細な計画を生成する。
Didn't find tool you were looking for?