Skip to content

Pipeline de cunoaștere — de la „gunoi" la date structurate

Captură rapidă, fără filtrare → rafinare → cunoaștere structurată reutilizabilă. Inspirat din fluxul „capture → distill → express” (BASB) și note de literatură → atomice (Zettelkasten), adaptat pentru GovStack și Esempla Systems.

0-inbox/ ARUNCI orice: articole, researchuri, doc tehnică, PDF/docx, note. Nefiltrat.
│ /ingest (knowledge-curator + skill knowledge-ingest, în BATCH, reluabil)
▼
1-procesat/ Note de literatură: rezumat în cuvinte proprii, idei-cheie, sursă, încredere.
│ distilare
▼
2-structurat/ concepts/ note atomice (un concept/notă), linkate
candidates/ candidați CU-* (cerințe universale), decizii stack, ADR-uri
data/ glosar, referințe, entități, tabele comparative (date structurate)
│ aprobare teamlead/govstack-architect
▼
01-govstack-foundation/cerinte-universale.md (candidații promovați devin CU-* cu ID stabil)
  1. Arunci materialele în vault/0-inbox/ (oricum, oricât).
  2. claude → /ingest (sau /ingest 20 pentru lot mai mare).
  3. Curatorul scanează (manifest reluabil), procesează în loturi, produce 1-procesat/ + 2-structurat/, leagă totul, actualizează indexul, exportă RAG, face checkpoint.
  4. Candidații CU-* îți sunt prezentați în batch; pe cei aprobați îi promovezi în Bloc A.
  • Reluabil: .workplace/state/ingest-manifest.json reține ce e procesat (hash). După restart, /ingest continuă doar cu status=new.
  • Batch: procesare în loturi; întrebările se acumulează în inbox.md, nu te întrerup la fiecare fișier.
  • Drept de autor: se parafrazează; citate ≤15 cuvinte, max 1/sursă; trasabilitate la sursă.
  • Gunoiul rămâne gunoi: 0-inbox/ e arhivă și NU intră în RAG; doar cunoașterea curată e indexată.
  • Dedupe: concepte/glosar nu se dublează; se îmbogățește nota existentă.
  • Subagent: knowledge-curator. Skill: knowledge-ingest. Comandă: /ingest. Script: ingest_scan.py.
  • Alimentează: Bloc A (cerințe universale), Bloc B (caiete de sarcini citează concepte/glosar), RAG.