**Purpose:** Document ingestion, extraction, fingerprinting, citation recovery. Depends only on citation-engine. The PDF ingest slice is implemented and consumed by citation-evidence (ESRC-WP-0001); HTML/MD, metadata enrichment, and citation recovery are deferred to ESRC-WP-0002..0004.