Geheugen
Gefundeerd zoeken in je eigen materiaal, met bronvermeldingen.
Wat het doet
Documenten, transcripten en uploads worden opgedeeld, ingebed (embedded) en geïndexeerd, en vervolgens bij het beantwoorden opgehaald via een hybride van vectorsimilariteit, trefwoordovereenkomsten en grafiekcentraliteit. Opgehaalde fragmenten bevatten bronvermeldingen, zodat een antwoord kan verwijzen naar de bron die het heeft gegenereerd, en toegangsregels filteren het corpus vóór het ophalen in plaats van erna.
Waarom het belangrijk is
Een agent die niet kan citeren, is een agent die je niet kunt controleren. Ophalen met bronvermeldingen verandert "de AI zegt het" in "dit document zegt het, hier is het", wat het verschil is tussen een demo en iets waarmee je een klant te woord zou laten staan.
Hoe het werkt
Toegangsfiltering vindt plaats vóór het ophalen
Het corpus waarin een agent kan zoeken is al beperkt door beleid, zodat een fout in de machtigingen niet kan leiden tot een gelekt citaat.
Hybride scoring, niet alleen vector
Vectorsimilariteit wordt gecombineerd met trefwoordovereenkomsten en grafiekcentraliteit, waardoor exacte identificatoren en zeldzame termen vindbaar blijven.
Antwoorden bevatten bronvermeldingen
Het fragment dat aanleiding gaf tot een bewering wordt aan de bewering gekoppeld, in plaats van achteraf te worden gereconstrueerd.
Vragen
- Onthoudt de agent onze gesprekken?
- Niet op de manier die "geheugen" meestal suggereert. Dit is ophalen uit materiaal dat je zelf aanlevert. Gespreksgeschiedenis wordt per sessie bewaard; het wordt niet gedestilleerd tot een permanent profiel.
- How does retrieval work?
- Documents are chunked, embedded and indexed. At answer time a hybrid of vector similarity, keyword match and graph centrality selects the best passages, and each one carries a receipt back to its source.
The rest of the bag
AccessControl
Machtigingen per document die antwoorden filteren, niet alleen pagina's.
Beleidsresolutie wordt voor de snelheid per sessie gecached; een wijziging in machtigingen wordt doorgevoerd bij cache-invalidatie in plaats van direct bij elk lopend verzoek.
Documentatie
Een mappenstructuur die de agent leest, en een configuratiebestand dat hij volgt.
Extractie omvat pdf's, spreadsheets en transcripten. Exotische binaire formaten worden niet verwerkt.
Gebeurtenissen
Een duurzaam logboek van wat agents hebben gedaan, en waarom.
De in-process eventbus is een single-node emitter, geen gedistribueerde broker. Het duurzame logboek over alle agents heen is een afzonderlijk Postgres-takenlogboek.
That was step 5 of 6: the agent consults its bag. Next, tasks, delegation edges, decisions and artifacts persist as rows you can replay, and the spend is already accounted for.