Conținut principal

Chatbot pentru documentele firmei

Knowledge Hub este un chatbot care răspunde din documentele pe care firma le ține deja în Drive, Confluence, SharePoint sau Notion. Fiecare răspuns trimite la pasajul din care provine.

Întrebare

Perioada de preaviz din contractul standard cu furnizorii

Răspuns

Preaviz scris de treizeci de zile, trimis la adresa din clauza 2.[1] Contractele pe modelul vechi prevăd șaizeci de zile.[2]

Surse

  1. 1Model contract furnizori 2024Clauza 14.2 · Juridic / Contracte
  2. 2Model contract furnizori 2021Clauza 11 · Juridic / Arhivă

Ambele pot fi citite de utilizator în SharePoint

Întrebare de exemplu, documente fictive

Cum se construiește un răspuns

Întâi căutarea; modelul scrie doar din pasajele pe care utilizatorul le poate citi.

FIG. 1Căutare, apoi răspuns cu surse
Flux RAG: documentele firmei se sincronizează într-un index de pasaje cu listele lor de acces; întrebarea duce identitatea utilizatorului la căutare, care păstrează doar pasajele permise; modelul scrie din aceste pasaje; răspunsul citează fiecare pasaj.Drepturile se verifică înainte ca modelul să vadă vreun text. Când niciun pasaj nu răspunde la întrebare, asistentul spune asta în loc să ghicească.DocumenteUnde sunt dejaIndexPasaje, drepturiCăutarePasaje permiseÎntrebareCine întreabăModelDoar din pasajeRăspuns citatSursă la fiecare frază

Surse și ce se indexează

SursăCe se indexează
Google DriveDocumente, foi de calcul și PDF-uri, cu drepturile pe foldere
ConfluenceSpații și pagini, cu restricțiile fiecărei pagini
SharePoint și OneDriveSite-uri și biblioteci, cu drepturile din Microsoft 365
NotionPagini și baze de date partajate cu integrarea
PDF-uri și scanăriText extras prin OCR pe server, inclusiv contracte scanate

RAG sau fine-tuning pentru un asistent de firmă

Fine-tuning-ul schimbă felul în care scrie un model. RAG schimbă ce știe modelul în momentul întrebării.

RAG sau fine-tuning pentru un asistent de firmă
CriteriuRAGFine-tuning
Se schimbă un documentUrmătoarea sincronizare îl preiaModelul trebuie reantrenat
CităriUna pentru fiecare afirmațieNicio metodă sigură
Drepturi de accesFiltrate pe utilizatorVizibile pentru toți
Potrivit pentruProceduri, contracte, manuale, wiki-uriUn stil sau un format fix

Etapele proiectului: import, calibrare, lansare

Import
Surse conectate doar pentru citire și indexate, cu tot cu drepturi.
Calibrare
Întrebări reale cu răspunsuri cunoscute. Lansarea vine după ce le trece.
Lansare
În Slack, Teams sau pe o pagină web. Întrebările fără răspuns arată lacunele.

Răspunsuri doar din ce poate citi utilizatorul

Un document pe care utilizatorul nu îl poate deschide nu influențează răspunsul.

FIG. 2Filtrul de drepturiSchemă
Filtrul de drepturi: fiecare pasaj indexat păstrează lista de acces a sursei, fiecare întrebare poartă contul de firmă al utilizatorului, iar filtrul trimite modelului doar pasajele pe care utilizatorul le poate citi. Restul nu ajung la model.PasajeListe de accesUtilizatorCont de firmăFiltru de drepturiLa orice cerereModelDoar permiseFiltrateNu ajung la model

Cum funcționează filtrul de drepturi

Index
Fiecare pasaj indexat păstrează lista de acces a documentului sursă.
Filtru
Fiecare întrebare poartă identitatea utilizatorului din contul firmei, Google sau Microsoft, iar căutarea filtrează după ea.
Răspuns
Modelul primește doar pasajele rămase după filtru. Un acces retras în sursă dispare din index la următoarea sincronizare.

Baza noastră de cunoștințe, unde agenții arhivează fiecare ședință

Cel mai apropiat proiect livrat: fiecare ședință arhivată ca notă la proiectul ei, cu transcrierea ca sursă. Studiul de caz LifeOS

Fiecare ședință, arhivată la proiectul ei

Ședințe arhivate la proiectul lor

Fiecare sarcină, consemnată în scris

Sarcini consemnate în scris

O singură bază de cunoștințe, versionată în git

Note în baza de cunoștințe

Tratarea datelor: unde ajung datele și cum tratează ELASTO securitatea.

Chatbotul pentru documente: întrebări frecvente

RAG sau fine-tuning pentru un asistent de firmă

RAG, aproape de fiecare dată. Informațiile firmei se schimbă săptămânal și trebuie citate și filtrate după drepturi, lucru pe care fine-tuning-ul nu îl poate face. Fine-tuning-ul ajută doar când asistentul trebuie să scrie într-un format fix și poate fi adăugat peste RAG.

Răspunsuri din Confluence, Google Drive sau PDF-uri, cu sursa

Confluence, Google Drive, SharePoint, Notion și PDF-urile se citesc acolo unde sunt, iar PDF-urile scanate trec printr-un OCR pe server. Fiecare răspuns citează documentul și secțiunea, cu un link care le deschide.

Documente pe care unii oameni nu au voie să le vadă

Asistentul filtrează fiecare căutare după drepturile utilizatorului din sistemul sursă, înainte ca modelul să vadă vreun text. Un document pe care cineva nu îl poate deschide în SharePoint sau Drive nu poate apărea în răspunsul lui, iar un acces retras dispare din index la următoarea sincronizare.

Răspunsuri la zi când se schimbă documentele

Sursele se sincronizează periodic sau prin notificările de modificare ale fiecărui sistem, așa că o procedură editată înlocuiește pasajele vechi. Fiecare răspuns arată data ultimei modificări a documentului, iar documentele șterse ies din index.

Datele firmei în ChatGPT față de un asistent privat

Aplicațiile de chat pentru consumatori pot păstra și folosi conversațiile conform propriilor condiții de utilizare. Un asistent privat apelează modelul printr-un API pentru firme, unde Anthropic nu antrenează modele pe date fără acord explicit, iar indexul stă pe o infrastructură stabilită împreună cu firma. Drumul complet al datelor e descris pe pagina despre agenți AI.

Când documentele nu conțin răspunsul

Asistentul spune că documentele nu acoperă întrebarea și listează cele mai apropiate pasaje găsite. Nu umple lacuna cu cunoștințele generale ale modelului. Întrebările fără răspuns se adună și arată ce documente lipsesc.

Documentele unei echipe, analizate la consultanța AI

Ce surse, ce întrebări apar în fiecare săptămână și cât costă dezvoltarea și rularea.

Studio
Cluj-Napoca, România, UE