Từ trả lời đến thực hiện
Chatbot thường được thiết kế để nhận câu hỏi và trả lời trong cuộc hội thoại. AI agent hướng tới hoàn thành một nhiệm vụ: nó có thể lập bước thực hiện, dùng công cụ, đọc kết quả rồi quyết định bước tiếp theo. Tuy vậy, giao diện trò chuyện không nói lên kiến trúc bên trong; một hệ thống có cửa sổ chat vẫn có thể thực hiện hành động. [1]
Gợi ý: khi khảo sát sản phẩm, hãy yêu cầu mô tả cụ thể hệ thống chỉ đưa ra câu trả lời, đề xuất thao tác cho nhân viên hay trực tiếp gọi công cụ để thao tác. Ba mức này cần quyền truy cập và quy trình phê duyệt khác nhau. Tên gọi “agent” trên tài liệu giới thiệu không thay thế được việc kiểm tra luồng xử lý thực tế.
Quy trình cố định hay tự chọn bước?
Không phải cứ xử lý nhiều bước là agent. Trong một workflow, các bước và đường đi chính được định sẵn; agent có thể quyết định cần làm gì tiếp theo dựa trên nhiệm vụ và phản hồi nhận được. Workflow phù hợp hơn khi công việc có cấu trúc rõ, còn agent đáng cân nhắc khi khó dự đoán trước các bước cần thiết. [1]
Gợi ý: hãy viết ra những quyết định mà hệ thống thật sự cần tự đưa ra. Nếu mọi yêu cầu đều đi qua cùng các bước, một quy trình cố định có điểm kiểm tra có thể đủ. Chỉ mở rộng quyền tự quyết cho phần việc biến đổi theo từng yêu cầu, thay vì áp dụng cho toàn bộ quy trình.
Quyền truy cập quyết định phạm vi
Khả năng dùng công cụ làm thay đổi bản chất của bài toán triển khai: trả lời về một đơn hàng khác với sửa trạng thái đơn hàng. Gợi ý: lập danh sách thao tác đọc, ghi và gửi ra bên ngoài; xác định dữ liệu nào được truy cập, hành động nào cần người duyệt và tài khoản nào đứng tên thực hiện. Phân quyền nên theo nhiệm vụ, không theo tên gọi sản phẩm.
Ví dụ: với yêu cầu xử lý hóa đơn sai địa chỉ, hệ thống có thể tra cứu hóa đơn và soạn đề xuất chỉnh sửa, nhưng chờ nhân viên xác nhận trước khi cập nhật hồ sơ. Đây là một phương án thiết kế để bàn với đội nghiệp vụ, không phải chức năng mặc định của mọi chatbot hay agent.
Kiểm tra kết quả và dừng đúng lúc
Một agent cần phản hồi từ môi trường, chẳng hạn kết quả gọi công cụ, để đánh giá tiến độ. Các điểm xin ý kiến con người và điều kiện dừng giúp giữ công việc trong phạm vi kiểm soát. Tự động hóa nhiều bước cũng có thể tăng chi phí và khiến lỗi ở bước trước ảnh hưởng các bước sau. [1]
Gợi ý: trước khi đưa vào vận hành, hãy thống nhất thế nào là hoàn thành, khi nào phải dừng và ai xử lý trường hợp dữ liệu mâu thuẫn. Lưu lại yêu cầu, thao tác và kết quả để người phụ trách đối chiếu. Kiểm thử các tình huống sai lệch là biện pháp giảm rủi ro, không phải bảo đảm hệ thống luôn an toàn hoặc luôn đúng.
Chọn mức tự động hóa cho dự án
Khung quản lý rủi ro AI của NIST hướng tới việc đưa yếu tố đáng tin cậy vào thiết kế, phát triển, sử dụng và đánh giá hệ thống AI; việc áp dụng khung này là tự nguyện. Với doanh nghiệp, đó là lời nhắc rằng đánh giá một giải pháp không nên dừng ở chất lượng câu trả lời, mà còn xét tác động khi hệ thống được phép hành động. [2]
Gợi ý: bắt đầu bằng một công việc có đầu vào, đầu ra và người chịu trách nhiệm rõ ràng. So sánh chatbot trả lời, workflow có bước cố định và agent được dùng công cụ trên cùng tiêu chí nghiệp vụ. Chỉ tăng quyền tự động khi lợi ích của bước đó rõ ràng và đội vận hành có thể nhận biết, xử lý kết quả ngoài dự kiến.

