ਮੈਮੋਰੀ
ਰਸੀਦਾਂ ਦੇ ਨਾਲ, ਤੁਹਾਡੀ ਆਪਣੀ ਸਮੱਗਰੀ 'ਤੇ ਅਧਾਰਤ ਰਿਟ੍ਰੀਵਲ।
ਇਹ ਕੀ ਕਰਦਾ ਹੈ
ਦਸਤਾਵੇਜ਼ਾਂ, ਟ੍ਰਾਂਸਕ੍ਰਿਪਟਾਂ ਅਤੇ ਅਪਲੋਡਾਂ ਨੂੰ ਚੰਕ ਕੀਤਾ ਜਾਂਦਾ ਹੈ, ਐਮਬੈਡ ਕੀਤਾ ਜਾਂਦਾ ਹੈ ਅਤੇ ਇੰਡੈਕਸ ਕੀਤਾ ਜਾਂਦਾ ਹੈ, ਫਿਰ ਜਵਾਬ ਦੇ ਸਮੇਂ ਵੈਕਟਰ ਸਮਾਨਤਾ, ਕੀਵਰਡ ਮੈਚ ਅਤੇ ਗ੍ਰਾਫ ਸੈਂਟਰਲਿਟੀ ਦੇ ਹਾਈਬ੍ਰਿਡ ਦੁਆਰਾ ਰਿਟ੍ਰੀਵ ਕੀਤਾ ਜਾਂਦਾ ਹੈ। ਰਿਟ੍ਰੀਵ ਕੀਤੇ ਪੈਸੇਜਾਂ ਵਿੱਚ ਰਸੀਦਾਂ ਹੁੰਦੀਆਂ ਹਨ, ਤਾਂ ਜੋ ਇੱਕ ਜਵਾਬ ਉਸ ਸਰੋਤ ਵੱਲ ਇਸ਼ਾਰਾ ਕਰ ਸਕੇ ਜਿਸਨੇ ਇਸਨੂੰ ਤਿਆਰ ਕੀਤਾ ਹੈ, ਅਤੇ ਪਹੁੰਚ ਨਿਯਮ ਰਿਟ੍ਰੀਵਲ ਤੋਂ ਬਾਅਦ ਦੀ ਬਜਾਏ ਪਹਿਲਾਂ ਕਾਰਪਸ ਨੂੰ ਫਿਲਟਰ ਕਰਦੇ ਹਨ।
ਇਹ ਕਿਉਂ ਮਹੱਤਵਪੂਰਨ ਹੈ
ਜਿਹੜਾ ਏਜੰਟ ਹਵਾਲਾ ਨਹੀਂ ਦੇ ਸਕਦਾ, ਉਹ ਅਜਿਹਾ ਏਜੰਟ ਹੈ ਜਿਸਨੂੰ ਤੁਸੀਂ ਚੈੱਕ ਨਹੀਂ ਕਰ ਸਕਦੇ। ਰਸੀਦਾਂ ਦੇ ਨਾਲ ਰਿਟ੍ਰੀਵਲ "AI ਨੇ ਅਜਿਹਾ ਕਿਹਾ" ਨੂੰ "ਇਹ ਦਸਤਾਵੇਜ਼ ਅਜਿਹਾ ਕਹਿੰਦਾ ਹੈ, ਇਹ ਇੱਥੇ ਹੈ" ਵਿੱਚ ਬਦਲ ਦਿੰਦਾ ਹੈ, ਜੋ ਕਿ ਇੱਕ ਡੈਮੋ ਅਤੇ ਕਿਸੇ ਅਜਿਹੀ ਚੀਜ਼ ਵਿੱਚ ਅੰਤਰ ਹੈ ਜਿਸਨੂੰ ਤੁਸੀਂ ਗਾਹਕ ਨਾਲ ਗੱਲ ਕਰਨ ਦਿਓਗੇ।
ਇਹ ਕਿਵੇਂ ਕੰਮ ਕਰਦਾ ਹੈ
ਐਕਸੈਸ ਫਿਲਟਰਿੰਗ ਰਿਟ੍ਰੀਵਲ ਤੋਂ ਪਹਿਲਾਂ ਹੁੰਦੀ ਹੈ
ਜਿਸ ਕਾਰਪਸ ਨੂੰ ਇੱਕ ਏਜੰਟ ਖੋਜ ਸਕਦਾ ਹੈ, ਉਹ ਪਹਿਲਾਂ ਹੀ ਨੀਤੀ ਦੁਆਰਾ ਸੀਮਤ ਹੁੰਦਾ ਹੈ, ਇਸ ਲਈ ਕੋਈ ਇਜਾਜ਼ਤ ਦੀ ਗਲਤੀ ਲੀਕ ਹੋਏ ਹਵਾਲੇ ਵਜੋਂ ਸਾਹਮਣੇ ਨਹੀਂ ਆ ਸਕਦੀ।
ਹਾਈਬ੍ਰਿਡ ਸਕੋਰਿੰਗ, ਸਿਰਫ਼ ਵੈਕਟਰ ਨਹੀਂ
ਵੈਕਟਰ ਸਮਾਨਤਾ ਨੂੰ ਕੀਵਰਡ ਮੈਚ ਅਤੇ ਗ੍ਰਾਫ ਸੈਂਟਰਲਿਟੀ ਨਾਲ ਜੋੜਿਆ ਜਾਂਦਾ ਹੈ, ਜੋ ਕਿ ਸਹੀ ਪਛਾਣਕਰਤਾਵਾਂ ਅਤੇ ਦੁਰਲੱਭ ਸ਼ਬਦਾਂ ਨੂੰ ਖੋਜਣਯੋਗ ਬਣਾਈ ਰੱਖਦਾ ਹੈ।
ਜਵਾਬਾਂ ਵਿੱਚ ਗਰਾਊਂਡਿੰਗ ਰਸੀਦਾਂ ਹੁੰਦੀਆਂ ਹਨ
ਜਿਸ ਪੈਸੇਜ ਨੇ ਦਾਅਵਾ ਪੈਦਾ ਕੀਤਾ ਹੈ ਉਹ ਦਾਅਵੇ ਨਾਲ ਜੁੜਿਆ ਹੁੰਦਾ ਹੈ, ਨਾ ਕਿ ਬਾਅਦ ਵਿੱਚ ਦੁਬਾਰਾ ਬਣਾਇਆ ਜਾਂਦਾ ਹੈ।
ਸਵਾਲ
- ਕੀ ਏਜੰਟ ਨੂੰ ਸਾਡੀਆਂ ਗੱਲਬਾਤਾਂ ਯਾਦ ਰਹਿੰਦੀਆਂ ਹਨ?
- ਉਸ ਤਰੀਕੇ ਨਾਲ ਨਹੀਂ ਜਿਸਦਾ ਆਮ ਤੌਰ 'ਤੇ "ਮੈਮੋਰੀ" ਤੋਂ ਮਤਲਬ ਹੁੰਦਾ ਹੈ। ਇਹ ਤੁਹਾਡੇ ਦੁਆਰਾ ਪ੍ਰਦਾਨ ਕੀਤੀ ਸਮੱਗਰੀ 'ਤੇ ਰਿਟ੍ਰੀਵਲ ਹੈ। ਗੱਲਬਾਤ ਦਾ ਇਤਿਹਾਸ ਪ੍ਰਤੀ ਸੈਸ਼ਨ ਰੱਖਿਆ ਜਾਂਦਾ ਹੈ; ਇਸਨੂੰ ਇੱਕ ਸਥਾਈ ਪ੍ਰੋਫਾਈਲ ਵਿੱਚ ਤਬਦੀਲ ਨਹੀਂ ਕੀਤਾ ਜਾਂਦਾ।
- How does retrieval work?
- Documents are chunked, embedded and indexed. At answer time a hybrid of vector similarity, keyword match and graph centrality selects the best passages, and each one carries a receipt back to its source.
The rest of the bag
ਪ੍ਰਤੀ-ਦਸਤਾਵੇਜ਼ ਪਰਮਿਸ਼ਨਾਂ ਜੋ ਸਿਰਫ਼ ਪੰਨਿਆਂ ਨੂੰ ਹੀ ਨਹੀਂ, ਬਲਕਿ ਜਵਾਬਾਂ ਨੂੰ ਵੀ ਫਿਲਟਰ ਕਰਦੀਆਂ ਹਨ।
ਸਪੀਡ ਲਈ ਪਾਲਿਸੀ ਰੈਜ਼ੋਲਿਊਸ਼ਨ ਪ੍ਰਤੀ ਸੈਸ਼ਨ ਕੈਸ਼ ਕੀਤਾ ਜਾਂਦਾ ਹੈ; ਇੱਕ ਪਰਮਿਸ਼ਨ ਤਬਦੀਲੀ ਹਰ ਇਨ-ਫਲਾਈਟ ਬੇਨਤੀ 'ਤੇ ਤੁਰੰਤ ਹੋਣ ਦੀ ਬਜਾਏ ਕੈਸ਼ ਅਵੈਧ ਹੋਣ 'ਤੇ ਪ੍ਰਸਾਰਿਤ ਹੁੰਦੀ ਹੈ।
ਹਰੇਕ ਫੋਲਡਰ ਅਤੇ ਹਰੇਕ ਲੀਫ ਦਸਤਾਵੇਜ਼ ਵਿੱਚ ਇੱਕ ਐਕਸੈਸ ਪਾਲਿਸੀ ਹੁੰਦੀ ਹੈ: ਜਨਤਕ, ਸਾਈਨ-ਇਨ ਕੀਤੇ ਹੋਏ, ਜਾਂ ਮਾਲਕ ਦੁਆਰਾ ਪ੍ਰਵਾਨਿਤ। ਇਹ ਪਾਲਿਸੀਆਂ ਇੱਕ ਪ੍ਰਤੀ-ਸੈਸ਼ਨ ਐਨਵੈਲਪ ਵਿੱਚ ਹੱਲ ਹੁੰਦੀਆਂ ਹਨ ਜੋ ਫਿਲਟਰ ਕਰਦਾ ਹੈ ਕਿ ਇੱਕ ਏਜੰਟ ਜਵਾਬ ਦੇਣ ਤੋਂ ਪਹਿਲਾਂ ਕੀ ਪ੍ਰਾਪਤ ਕਰ ਸਕਦਾ ਹੈ। ਇੱਕ ਕੈਪੇਬਿਲਟੀ ਰਜਿਸਟਰੀ ਪ੍ਰਤੀ ਕਿਰਾਏਦਾਰ ਪੂਰੀਆਂ ਵਿਸ਼ੇਸ਼ਤਾਵਾਂ ਨੂੰ ਗੇਟ ਕਰਦੀ ਹੈ, ਅਤੇ ਮਹੱਤਵਪੂਰਨ ਐਕਸੈਸ ਜਾਂਚਾਂ ਫੇਲ੍ਹ ਹੋਣ 'ਤੇ ਬੰਦ ਹੋ ਜਾਂਦੀਆਂ ਹਨ।
ਦਸਤਾਵੇਜ਼
ਇੱਕ ਫੋਲਡਰ ਟ੍ਰੀ ਜਿਸ ਨੂੰ ਏਜੰਟ ਪੜ੍ਹਦਾ ਹੈ, ਅਤੇ ਇੱਕ ਕੌਂਫਿਗ ਫਾਈਲ ਜਿਸ ਦੀ ਉਹ ਪਾਲਣਾ ਕਰਦਾ ਹੈ।
ਐਕਸਟਰੈਕਸ਼ਨ ਵਿੱਚ PDF, ਸਪ੍ਰੈਡਸ਼ੀਟਾਂ ਅਤੇ ਟ੍ਰਾਂਸਕ੍ਰਿਪਟਾਂ ਸ਼ਾਮਲ ਹਨ। ਅਣਜਾਣ ਬਾਈਨਰੀ ਫਾਰਮੈਟਾਂ ਨੂੰ ਪਾਰਸ ਨਹੀਂ ਕੀਤਾ ਜਾਂਦਾ।
ਇਵੈਂਟਸ
ਏਜੰਟਾਂ ਨੇ ਕੀ ਕੀਤਾ, ਅਤੇ ਕਿਉਂ ਕੀਤਾ, ਇਸਦਾ ਇੱਕ ਸਥਾਈ ਲੈਜਰ।
ਇਨ-ਪ੍ਰੋਸੈਸ ਇਵੈਂਟ ਬੱਸ ਇੱਕ ਸਿੰਗਲ-ਨੋਡ ਐਮੀਟਰ ਹੈ, ਨਾ ਕਿ ਇੱਕ ਡਿਸਟ੍ਰੀਬਿਊਟਡ ਬ੍ਰੋਕਰ। ਸਥਾਈ ਕਰਾਸ-ਏਜੰਟ ਰਿਕਾਰਡ ਇੱਕ ਵੱਖਰਾ Postgres ਟਾਸਕ ਲੈਜਰ ਹੈ।
That was step 5 of 6: the agent consults its bag. Next, tasks, delegation edges, decisions and artifacts persist as rows you can replay, and the spend is already accounted for.