Cơ sở dữ liệu kiến thức
Bản ghi kiến thức, quét website và tải lên tệp — cách chatbot của bạn học hỏi kiến thức.
Trang "Cơ sở tri thức cho Chatbot – Thêm kiến thức" mô tả khu vực chức năng được chỉ định trong URL. Nội dung hiện có được bổ sung bằng quy trình thực tế, các điều kiện tiên quyết và các giới hạn đã biết. Kiến thức có thể được thêm thủ công, qua việc thu thập dữ liệu từ website hoặc tải lên tệp. Việc thu thập dữ liệu xử lý tối đa 300 trang trong vòng tám phút, tuân thủ `robots.txt` và có thể chạy lại mỗi 24 giờ. Tải lên cho phép tối đa 100 MB; thực tế xử lý được PDF, HTML, văn bản và các xuất WordPress.
Kiến thức có thể được thêm thủ công, qua việc thu thập dữ liệu từ website hoặc tải lên tệp. Việc thu thập dữ liệu xử lý tối đa 300 trang trong vòng tám phút, tuân thủ `robots.txt` và có thể chạy lại mỗi 24 giờ. Một lần tải lên không được vượt quá 100 MB; thực tế xử lý được PDF, HTML, văn bản và các xuất WordPress.
Cơ sở tri thức được tách biệt theo tenant. Các mục của một tenant không được xuất hiện trong câu trả lời của tenant khác. Chatbot chỉ sử dụng nội dung khi cơ sở kiến thức được gán chính xác và tùy chọn RAG được kích hoạt. RAG mặc định bị tắt khi tạo bot và bắt buộc phải được bật một cách có ý thức.
Trước khi thu thập dữ liệu, nên loại bỏ các trang trùng lặp, lỗi thời hoặc không phù hợp về mặt pháp lý. Sau khi xử lý, cần kiểm tra trạng thái và sau đó thử nghiệm bằng các câu hỏi cụ thể để xem có tìm thấy nội dung liên quan hay không. Một lần thu thập dữ liệu thành công chỉ có nghĩa là các trang đã được xử lý; nó không đảm bảo tự động chất lượng câu trả lời tốt.
Gói Starter và gói Cá nhân hóa đều chứa 1.000 MB bộ nhớ và 100 mục kiến thức. Việc xuất cơ sở tri thức nói chung chưa được triển khai. Do đó, trước khi xóa hoặc tái cấu trúc cơ bản, cần kiểm tra xem các nguồn gốc ban đầu bên ngoài Zentor vẫn có sẵn hay không.
Đối với trang "Cơ sở tri thức cho Chatbot – Thêm kiến thức", điều này có nghĩa là: Văn bản ngắn hiện có được mở rộng thành hướng dẫn đáng tin cậy, mà không hứa hẹn các khả năng ngoài phạm vi trạng thái sản phẩm đã xác nhận. Các nguồn dữ kiện đã được xác minh và trách nhiệm rõ ràng giữa Tenant và Zentor vẫn là yếu tố quyết định. Trong trường hợp có sai lệch, luôn cần nêu rõ URL, tenant liên quan và bước được quan sát.