Baza wiedzy
Wpisy wiedzy, skanowanie strony internetowej i przesyłanie plików — jak Twój chatbot uczy się wiedzy.
Strona „Baza wiedzy dla chatbotów – Dodawanie wiedzy” dotyczy obszaru funkcjonalnego wskazanego w adresie URL. Istniejące treści zostały uzupełnione o rzeczywisty przebieg, wymagania wstępne oraz znane ograniczenia. Wiedzę można dodawać ręcznie, przez skanowanie strony internetowej (crawl) lub przez przesyłanie plików. Crawl przetwarza maksymalnie 300 stron w ciągu ośmiu minut, przestrzega robots.txt i może być uruchamiany ponownie co 24 godziny. Pliki mogą mieć do 100 MB; faktycznie przetwarzane są PDF, HTML, tekst i eksporty WordPress.
Wiedzę można dodawać ręcznie, przez skanowanie strony internetowej (crawl) lub przez przesyłanie plików. Crawl przetwarza maksymalnie 300 stron w ciągu ośmiu minut, przestrzega `robots.txt` i może być uruchamiany ponownie co 24 godziny. Przesyłany plik może mieć maksymalnie 100 MB; faktycznie przetwarzane są PDF, HTML, tekst i eksport WordPress.
Baza wiedzy jest rozdzielona między tenantów. Wpisy jednego tenanta nie mogą pojawiać się w odpowiedziach innego tenanta. Chatbot korzysta z treści tylko wtedy, gdy baza wiedzy jest poprawnie przypisana, a możliwość RAG jest włączona. RAG jest domyślnie wyłączony przy tworzeniu chatbota i musi zostać świadomie włączony.
Przed crawlem należy wykluczyć zduplikowane, nieaktualne lub prawnie nieodpowiednie strony. Po przetworzeniu należy sprawdzić status, a następnie konkretnymi pytaniami przetestować, czy znajdowane są istotne treści. Udany crawl oznacza jedynie, że strony zostały przetworzone; nie gwarantuje automatycznie dobrej jakości odpowiedzi.
Pakiety Starter i Individuell zawierają po 1 000 MB pamięci i 100 wpisów wiedzy. Ogólny eksport bazy wiedzy nie jest zaimplementowany. Przed usunięciem lub gruntowną zmianą struktury należy zatem sprawdzić, które oryginalne źródła poza Zentor pozostają dostępne.
Dla strony „Baza wiedzy dla chatbotów – Dodawanie wiedzy” obowiązuje zatem: dotychczasowy krótki tekst zostaje rozszerzony do rzetelnej instrukcji, bez obiecywania funkcji produktu wykraczających poza potwierdzony stan. Miarodajne pozostają zweryfikowane źródła faktów oraz widoczny podział odpowiedzialności między tenantem a Zentor. W razie rozbieżności należy zawsze podać dokładnie ten adres URL, tenanta, którego to dotyczy, oraz zaobserwowany krok.