Taksonomi
Å vite hva et spørsmål handler om før det besvares.
Hva den gjør
Kunnskapstagger er avledet fra materialet en agent er forankret i og fra dens koblinger, og disse taggene er regelbevisste: en tagg kan være synlig selv om den underliggende kilden ikke er det. En lagdelt klassifiserer avgjør om et innkommende spørsmål er innenfor agentens omfang, og eskalerer fra rimelig mønstergjenkjenning til sammenligning av innebygginger (embeddings) bare når det er nødvendig.
Hvorfor det er viktig
De fleste dårlige agentsvar skyldes omfangsfeil, ikke resonneringsfeil: spørsmålet var aldri noe denne agenten burde ha prøvd seg på. Ved å klassifisere omfanget først, blir disse til en ren omdirigering i stedet for en skråsikker oppdikting.
Hvordan det fungerer
Tagger respekterer tilgangsregler
En tagg avledet fra begrenset materiale avslører ikke eksistensen av dette materialet til noen som ikke har tilgang til å se det.
Klassifiseringen er lagdelt for kostnad
Rimelig mønstergjenkjenning kjøres først; sammenligning av innebygginger kjøres bare når det rimelige laget er usikkert.
Det er ikke en ontologi, og vi kaller det ikke det
Det finnes ikke noe opprettet hierarki, ingen arv, og ikke noe skjema å vedlikeholde. Hvis du trenger en formell taksonomi du administrerer selv, er ikke dette det ennå.
Spørsmål
- Kan jeg definere min egen taksonomi?
- Ikke i dag. Tagger avledes fra materialet ditt i stedet for å opprettes som et skjema. Et hierarki som kan redigeres er det opplagte neste steget, men er ikke bygget ennå.
- Hva skjer med et spørsmål som er utenfor omfanget?
- Klassifisereren flagger det før modellen forplikter seg til et svar, slik at agenten kan omdirigere i stedet for å improvisere.
The rest of the bag
AccessControl
Rettigheter per dokument som filtrerer svar, ikke bare sider.
Policy-evaluering bufres per økt for hastighet; en endring i rettigheter rulles ut ved ugyldiggjøring av bufferen, i stedet for umiddelbart på alle pågående forespørsler.
Dokumentasjon
Et mappetre agenten leser, og en konfigurasjonsfil den følger.
Ekstraksjon dekker PDF-er, regneark og transkripsjoner. Eksotiske binærformater blir ikke parset.
Hendelser
En persistent logg over hva agenter gjorde, og hvorfor.
Hendelsesbussen i prosessen er en enkeltnode-sender, ikke en distribuert formidler. Den persistente loggen på tvers av agenter er en separat Postgres-oppgavelogg.
That was step 2 of 6: it crosses a tenant boundary. Next, for agent-to-agent traffic the edge is authorised before anything executes, and the caller token is minted for that hop alone.