Deep Dives
Product: v0.19.0 · Contract: OpenAPI · Spec ops: Ingestion cancel & fairness
Detailed technical deep dives into EdgeQuake’s implementation.
Recently rewritten for v0.19.0: Pipeline Progress and PDF Processing reflect SPEC-047 vision ingest, mm-assets, convert→ingest split, and SPEC-057 cancel/status SSOT.
- Data Layer — PostgreSQL ER, KV SSOT, AGE, pgvector, FTS, and query×store matrix (code is law).
- LightRAG Algorithm — The algorithm behind entity extraction and graph construction.
- Entity Extraction — How LLMs extract entities from text.
- Entity Normalization — Deduplication and canonicalization of entities.
- Chunking Strategies — Document splitting approaches and trade-offs.
- Query Modes — The 6 retrieval modes explained.
- Graph Storage — PostgreSQL AGE integration for graph operations.
- Vector Storage — pgvector for embedding-based retrieval.
- Embedding Models — Supported embedding providers and configuration.
- Community Detection — Graph clustering for global queries.
- PDF Processing — Vision LLM PDF conversion, mm-assets, convert vs ingest.
- Gleaning — Multi-pass entity extraction for higher recall.
- Cost Tracking — Monitor and control LLM API costs.
- Pipeline Progress — Real-time processing status and progress tracking.