Skip to main content

timeline-pdf-notes

Extract timeline entries from PDF operator notes via pdfplumber.

Datos de origen

Repositorio
SpecterOps/skills
Última actividad en el origen
29 de mayo de 2026 a las 15:51
Idioma detectado de SKILL.md
inglés
Estrellas
689
Forks
77

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.

Explorador de archivos
4 archivos

Mostrando SKILL.md

SKILL.md
Instrucciones de origen · Vista previa de solo lectura
name
timeline-pdf-notes
description
Extract timeline entries from PDF operator notes via pdfplumber.
metadata
{"author":"GhostWorks"}
# Timeline PDF Notes Parser Use when provided operator notes are only available as PDFs. ## Input Contract - Directory `input/notes/` with `.pdf` files representing operator notes. ## Output - Write `output/pdf_notes_entries.json` with normalized entries (timestamp, source, operator, action, details, raw_timestamp). ## Workflow 1. Use `pdfplumber` to extract text per page and optional tables. 2. Apply the same timestamp patterns as the Markdown parser; use filename-derived dates/operator context when necessary. 3. Normalize timestamps to UTC and drop duplicates flagged by the consolidator. 4. Track page numbers or table origins in `source`/`details` for traceability. 5. Append `source_type = "pdf_notes"` in metadata with counts and errors. 6. Provide guidance to install `pdfplumber` if missing. ## Notes - Tables are optional; parse them to capture structured timeline rows when available. - Handle messy text by cleaning repeated headers/footers.
Ver en GitHub