Light RAG по-Codver: dual-level без театра векторов

Между «просто chunk + cosine» и тяжёлым GraphRAG есть рабочий минимум: сущности, связи и два уровня поиска. Это и есть Light RAG-практика Codver.

Зачем

Классический RAG ломается на связях («кто → что → почему»). GraphRAG чинит это сообществом-саммари, но дорого обновлять. Light RAG (в духе HKUDS LightRAG + наш Knowledge Layer) держит entity–relation граф и достаёт и локальные факты, и тему целиком — без обязательной векторной фермы.

Два уровня (как устроен Codver)

  1. Low-level — entity: OpenAI, Claude, акт, продукт. У нас это entity_ids в facts.jsonl и страницы /entity-*.
  2. High-level — тема: RAG, agents, regulation. У нас это хабы /hub-* и keyword routing parent asset.

Ответ без цитаты на факт/страницу — fail. Смена embedding-модели без golden set — тоже fail.

Минимальный стек (начните отсюда)

Ops-команда на VPS: python3 scripts/light_rag_query.py "claude pricing"

Когда усложнять

Связанное