AI Agent không nhất thiết phải bắt đầu từ một hệ thống phức tạp. Với công việc công vụ, cách tiếp cận thực tế hơn là bắt đầu từ những bài toán nhỏ, có đầu vào rõ ràng, có quy trình nhiều bước và có thể kiểm tra kết quả ở từng chặng.
Trong phần này, chúng ta sẽ lần lượt nhìn vào 8 bài toán quen thuộc: từ nghiên cứu và tổng hợp thông tin, theo dõi nguồn, phân tích dữ liệu, xử lý hồ sơ, chuẩn bị hỏi–đáp cho người dân, chuẩn bị cuộc họp, quản lý công việc cho đến hỗ trợ thao tác trên website. Đây không phải là danh sách những việc AI “có thể tự động làm hoàn toàn”, mà là 8 kịch bản để hình dung Agent có thể tham gia vào một chuỗi công việc như thế nào.
Điểm quan trọng là mỗi bài toán đều cần được đặt trong một quy trình có kiểm soát: xác định rõ nhiệm vụ → chuẩn bị dữ liệu → giao việc cho AI → đặt giới hạn và điểm dừng → kiểm tra từng bước → con người quyết định trước khi sử dụng kết quả.
Vì vậy, khi đọc 8 bài toán dưới đây, đừng chỉ hỏi “AI có làm được không?”. Hãy thử đặt thêm ba câu hỏi:
AI được phép làm đến đâu?
Ở bước nào con người phải kiểm tra hoặc phê duyệt?
Nếu AI làm sai, thiếu dữ liệu hoặc gặp tình huống bất thường thì hệ thống phải dừng ở đâu?
Đó chính là cách chuyển từ việc thử một chatbot sang tư duy về một quy trình làm việc có AI hỗ trợ và cũng là bước đầu để thử nghiệm AI Agent một cách có trách nhiệm trong môi trường công vụ.
Lưu ý trước khi thực hành: giao diện, tên nút, khả năng kết nối ứng dụng và giới hạn sử dụng có thể thay đổi theo sản phẩm, gói tài khoản, khu vực và quyền của tổ chức. Hướng dẫn dưới đây ưu tiên các thao tác đã được nhà cung cấp công bố trong tài liệu chính thức. Nếu tài khoản của bạn không nhìn thấy một nút hoặc tính năng được đề cập, không tự suy đoán cách bật; hãy kiểm tra tài liệu hỗ trợ của phiên bản đang sử dụng.
MỘT QUY TẮC QUAN TRỌNG KHI DÙNG AGENT TRÊN WEBSITE
Nếu Agent yêu cầu:
“Tôi cần bạn đăng nhập.”
→ người dùng đăng nhập.
Nếu Agent yêu cầu:
“Tôi cần bạn xác nhận hành động này.”
→ đọc kỹ hành động trước khi xác nhận.
Nếu Agent xuất hiện một hành động không nằm trong yêu cầu:
→ dừng task.
Nếu website xuất hiện nội dung lạ yêu cầu Agent bỏ qua hướng dẫn ban đầu:
→ không tiếp tục một cách máy móc.
Đây là một phần của việc phòng ngừa prompt injection và các hành vi không mong muốn khi Agent làm việc trên web. OpenAI cũng khuyến nghị theo dõi hành động và dừng nếu phát hiện hành vi đáng ngờ.
BÀI THỰC HÀNH TỐT NHẤT: CHỈ CHỌN MỘT WORKFLOW
Đừng thử cả 8 bài cùng lúc.
Hãy chọn một workflow nhỏ.
Ví dụ:
Tuần 1
Nghiên cứu → tổng hợp → bảng so sánh
Tuần 2
Dữ liệu → phát hiện thiếu → bản nháp báo cáo
Tuần 3
Văn bản → hỏi–đáp → đối chiếu nguồn
Tuần 4
Task → schedule → bản tin định kỳ
Sau mỗi lần thử, ghi lại 4 thứ:
Agent làm tốt gì?
Agent sai ở đâu?
Con người phải kiểm tra bước nào?
Nếu triển khai thật thì cần thêm quyền kiểm soát nào?
Đây mới là dữ liệu có giá trị để quyết định một workflow có nên mở rộng hay không.
BÀI TOÁN 1 — NGHIÊN CỨU CHÍNH SÁCH
BÀI TOÁN 2 — THEO DÕI VÀ TỔNG HỢP THÔNG TIN
BÀI TOÁN 3 — LẬP BÁO CÁO TỪ DỮ LIỆU
BÀI TOÁN 4 — XỬ LÝ VÀ PHÂN LOẠI HỒ SƠ
BÀI TOÁN 5 — SOẠN HỎI – ĐÁP CHO NGƯỜI DÂN
BÀI TOÁN 6 — CHUẨN BỊ CUỘC HỌP
BÀI TOÁN 7 — QUẢN LÝ CÔNG VIỆC
BÀI TOÁN 8 — THAO TÁC TRÊN WEBSITE VÀ MÁY TÍNH
Từ 8 bài toán đến một quy trình thử nghiệm thực tế
8 bài toán trên không phải là 8 hệ thống cần triển khai ngay, mà là 8 điểm bắt đầu để đặt đúng câu hỏi về AI Agent trong công việc. Mỗi cơ quan, đơn vị có quy trình, dữ liệu, hệ thống và mức độ phân quyền khác nhau, vì vậy không nên mặc định rằng một workflow phù hợp với nơi này sẽ phù hợp với nơi khác.
Mục tiêu của thử nghiệm không phải là chứng minh “AI có thể làm thay con người”, mà là tìm ra những khâu AI có thể hỗ trợ tốt, những khâu vẫn cần con người kiểm soát, và những ranh giới không nên giao cho AI.
Hãy để lại bình luận chia sẻ những góc nhìn của bạn và đừng quên bấm theo dõi kênh để nhận những bài viết hướng dẫn tiếp theo nhé.


