Đây là bài toán đưa AI Agent tiến thêm một bước: thay vì chỉ đọc tài liệu hoặc tạo nội dung, AI có thể được thiết kế để thực hiện một chuỗi thao tác trên máy tính hoặc website, chẳng hạn mở trang, đọc thông tin, chuyển bước, nhập dữ liệu hoặc xử lý kết quả theo một quy trình đã định.
Ví dụ về mặt workflow:
mở trang → xác định đúng màn hình → đọc thông tin → thực hiện thao tác được phép → kiểm tra kết quả → dừng hoặc chuyển bước tiếp theo.
Nhưng đây cũng là bài toán cần mức kiểm soát cao hơn. Một thao tác sai trên hệ thống thật có thể tạo ra hậu quả khác hoàn toàn so với một câu trả lời sai trong cuộc trò chuyện.
Vì vậy, khi bắt đầu thử nghiệm, nên sử dụng website mô phỏng, tài khoản thử nghiệm và dữ liệu không nhạy cảm. Quy trình cần quy định rõ những thao tác AI được phép thực hiện, những thao tác phải yêu cầu con người xác nhận và những tình huống buộc Agent phải dừng.
Đây là bài cần thận trọng nhất.
Không bắt đầu bằng hệ thống nghiệp vụ thật.
Cách thử với ChatGPT Work
OpenAI hiện hướng dẫn:
Mở ChatGPT.
Chọn Work.
Bắt đầu một task.
Mô tả website và kết quả cần đạt.
Nếu cần, ChatGPT sẽ sử dụng cloud browser.
Khi cần đăng nhập, người dùng thực hiện đăng nhập qua quy trình bảo mật.
Nếu cần xác nhận hành động, người dùng xem và xác nhận.
Kiểm tra kết quả và nguồn sau khi hoàn thành.
Cloud browser có thể đọc trang, click, nhập biểu mẫu và thực hiện các bước trên những website được hỗ trợ; tính năng này phụ thuộc gói và quyền workspace.
Bài thực hành an toàn
Không dùng:
Cổng dịch vụ công thật
Hệ thống quản lý hồ sơ thật
Tài khoản nghiệp vụ thật
Hãy dùng:
website demo + tài khoản demo + dữ liệu giả lập.
Ví dụ:
“Mở website thử nghiệm được chỉ định. Tìm bản ghi có mã TEST-001. Không chỉnh sửa, không xóa, không gửi biểu mẫu. Chỉ xác định vị trí của bản ghi và báo lại thông tin nhìn thấy.”
Sau đó nâng dần:
Đọc → tìm → điền bản nháp → dừng → người dùng kiểm tra → mới cho phép bước tiếp theo.
MỘT QUY TẮC QUAN TRỌNG KHI DÙNG AGENT TRÊN WEBSITE
Nếu Agent yêu cầu:
“Tôi cần bạn đăng nhập.”
→ người dùng đăng nhập.
Nếu Agent yêu cầu:
“Tôi cần bạn xác nhận hành động này.”
→ đọc kỹ hành động trước khi xác nhận.
Nếu Agent xuất hiện một hành động không nằm trong yêu cầu:
→ dừng task.
Nếu website xuất hiện nội dung lạ yêu cầu Agent bỏ qua hướng dẫn ban đầu:
→ không tiếp tục một cách máy móc.
Đây là một phần của việc phòng ngừa prompt injection và các hành vi không mong muốn khi Agent làm việc trên web. OpenAI cũng khuyến nghị theo dõi hành động và dừng nếu phát hiện hành vi đáng ngờ.
Kết
Bài toán 8 là bước chuyển quan trọng từ “AI tạo ra thông tin” sang “AI thực hiện hành động”. Khi AI bắt đầu có khả năng tương tác với giao diện, yêu cầu về quyền truy cập, kiểm soát thao tác, ghi nhận hoạt động và khả năng dừng hoặc khôi phục trở nên quan trọng hơn nhiều.
Vì vậy, không nên bắt đầu bằng việc cho Agent truy cập ngay vào hệ thống sản xuất. Hãy thử bằng một workflow nhỏ, dữ liệu giả lập và môi trường được kiểm soát; sau đó cố tình đưa vào những tình huống bất thường như thiếu dữ liệu, thông tin không khớp, giao diện thay đổi hoặc xuất hiện yêu cầu ngoài phạm vi nhiệm vụ để xem Agent có biết dừng hay không.
Mục tiêu của thử nghiệm không phải là chứng minh AI có thể “tự làm mọi thứ”. Mục tiêu là xác định chính xác AI được phép làm gì, không được phép làm gì, khi nào phải hỏi con người và khi nào phải dừng.
Đây chính là nguyên tắc quan trọng nhất trước khi một workflow Agent có khả năng thao tác thực tế được cân nhắc đưa vào môi trường công vụ.
Xem thêm 8 ứng dụng AI Agent cho công vụ tại đây:
Cùng chia sẻ và cập nhật AI
Bạn có góc nhìn, kinh nghiệm hoặc tình huống thực tế nào khi ứng dụng AI trong công việc? Hãy để lại bình luận — mỗi chia sẻ có thể mở ra thêm một cách làm hữu ích cho cộng đồng.
📩 Muốn nhận thêm những hướng dẫn và ứng dụng AI thiết thực trong công việc? Hãy điền email để theo dõi kênh và nhận các nội dung mới trực tiếp qua email.
Cùng học, cùng thử và cùng làm việc hiệu quả hơn với AI.



