BeelyWeb
31/08/2026

Các mức độ tự chủ của AI Agent và ranh giới an toàn

Phong Nguyen
Các mức độ tự chủ của AI Agent và ranh giới an toàn

Nếu bạn vừa đọc được một tin đồn dở khóc dở cười về việc một AI Agent tự động gửi nhầm bản nháp email khuyến mãi (còn nguyên lỗi chính tả) cho toàn bộ danh sách khách hàng chỉ vì được cấp quyền "tự gửi" ngay từ ngày đầu, thì bài này sẽ giúp bạn tránh đúng kịch bản đó bằng cách nắm rõ có bao nhiêu mức tự chủ mà một AI Agent có thể được giao, và việc nào bắt buộc phải có con người bấm nút duyệt trước khi nhé.

Rất nhiều chủ doanh nghiệp khi mới tìm hiểu AI Agent thường rơi vào một trong hai thái cực: hoặc quá dè dặt, bắt agent việc gì cũng phải hỏi qua nên cuối cùng chẳng tiết kiệm được bao nhiêu thời gian so với làm tay, hoặc quá hào hứng, cấp luôn quyền "tự làm hết" cho một quy trình nhạy cảm như gửi email cho khách hay chi tiền quảng cáo, để rồi một hôm agent hiểu sai ngữ cảnh và tự thực hiện một hành động mà nếu có người xem qua trước, chắc chắn đã không xảy ra. Cả hai thái cực đều xuất phát từ cùng một chỗ thiếu: chưa có một thang đo rõ ràng để biết việc nào nên giao hẳn cho agent, việc nào chỉ nên để nó gợi ý rồi người thật quyết định.

Đừng lo, vì đây không phải bài toán bạn phải tự mò mẫm một mình. Các nền tảng agent nghiêm túc hiện nay - trong đó có chính bộ công cụ phát triển agent của Anthropic - đều xây dựng sẵn cơ chế phân quyền theo từng nấc, giúp bạn chọn đúng mức tự chủ phù hợp với từng loại công việc thay vì chỉ có hai lựa chọn "tự làm hết" hoặc "không làm gì cả". Bài viết này sẽ đưa ra một thang 5 mức dễ áp dụng, kèm nguyên tắc chọn mức theo giá trị và rủi ro của từng hành động, giúp bạn tự tin giao việc mà vẫn ngủ ngon.

Bảng tóm tắt 5 mức tự chủ

Trước khi đi vào chi tiết từng mức, đây là bảng nhìn nhanh giúp bạn hình dung toàn cảnh thang tự chủ - càng lên mức cao, agent càng được tự quyết nhiều hơn nhưng đồng thời cũng cần được kiểm chứng kỹ hơn trước khi giao, chứ không phải cứ mức cao là "hiện đại hơn, nên dùng hơn".

Mức Vai trò agent Ví dụ hành động
Mức 0 Chỉ gợi ý, người làm hết Agent phân tích và đề xuất để giúp nhân viên quyết định nhanh hơn, còn nhân viên tự tay thực hiện toàn bộ
Mức 1 Soạn sẵn, chờ duyệt Agent soạn email/báo giá, người quản lý bấm duyệt mới gửi đi
Mức 2 Tự làm việc rủi ro thấp Agent tự trả lời câu hỏi thường gặp, tự cập nhật trạng thái đơn hàng
Mức 3 Tự làm phần lớn, báo cáo sau Agent tự xử lý cả quy trình, chỉ báo cáo tổng kết cuối ngày
Mức 4 Tự chủ hoàn toàn Agent tự quyết định cả mục tiêu con và cách đạt mục tiêu, hiếm khi cần cho SME

Mức 0 - Chỉ gợi ý, người làm hết

Ở mức này, agent đóng vai trò giống một trợ lý phân tích ngồi cạnh bạn: nó đọc dữ liệu, tổng hợp thông tin và đưa ra gợi ý, nhưng mọi hành động thật sự - gõ email, gọi điện, cập nhật hệ thống - đều do con người tự tay làm. Ví dụ cụ thể: agent phân tích dữ liệu bán hàng tháng rồi gợi ý "nên tăng ngân sách quảng cáo cho nhóm sản phẩm A vì tỷ lệ chuyển đổi đang cao hơn 30% so với nhóm B", còn việc có tăng ngân sách hay không, tăng bao nhiêu vẫn do người quản lý quyết định và tự tay thao tác trên nền tảng quảng cáo.

Mức 0 giúp bạn làm quen dần với AI Agent mà không lo rủi ro, phù hợp nhất khi bạn chưa có đủ dữ liệu để tin tưởng chất lượng phân tích của nó, hoặc khi quyết định liên quan tới số tiền lớn cần cân nhắc nhiều yếu tố ngoài dữ liệu mà chỉ con người mới nắm được, ví dụ quan hệ đối tác lâu năm hay yếu tố thời điểm nhạy cảm.

Mức 1 - Soạn sẵn, chờ duyệt

Đây là mức mà agent đã bắt đầu "nhúng tay" vào việc thật, nhưng luôn dừng lại đúng một nhịp trước khi hành động chạm tới thế giới bên ngoài để chờ con người bấm duyệt. Cơ chế này không chỉ là lý thuyết suông mà đã có bằng chứng thực tế: chính bộ công cụ phát triển agent của Anthropic có hẳn một chế độ cho phép mọi thao tác quan trọng phải đi qua bước xác nhận của người dùng trước khi thực thi, và nhiều nền tảng tự động hoá quy trình cũng có bước "chờ duyệt" tương tự trước khi một email hay một đơn hàng thật được gửi đi.

Ví dụ cụ thể: agent tự soạn toàn bộ nội dung email trả lời khiếu nại của khách, kèm đề xuất mức bồi hoàn, nhưng email chỉ thật sự được gửi đi sau khi người quản lý đọc lướt và bấm "Duyệt". Mức 1 giúp bạn vừa tiết kiệm phần lớn thời gian soạn thảo vừa giữ được lớp kiểm soát cuối cùng, rất phù hợp cho các tình huống có thể gây ảnh hưởng tới khách hàng hoặc thương hiệu nếu sai sót.

Mức 2 - Tự làm việc rủi ro thấp

Ở mức 2, agent được phép tự thực hiện mà không cần chờ duyệt, nhưng chỉ với những việc có tính lặp lại cao, dễ đảo ngược nếu sai và giá trị mỗi lần thực hiện không lớn. Ví dụ cụ thể: agent tự trả lời các câu hỏi thường gặp về giờ mở cửa, chính sách đổi trả trong khung giờ hành chính, hoặc tự cập nhật trạng thái "đang giao hàng" lên hệ thống khi nhận được xác nhận từ đơn vị vận chuyển - những việc mà kể cả có sai một vài lần cũng không gây thiệt hại đáng kể và dễ dàng sửa lại ngay.

Mức này giúp giải phóng rất nhiều thời gian cho nhân viên khỏi các câu hỏi lặp đi lặp lại, tuy nhiên bạn vẫn nên giữ một kênh giám sát nhẹ, ví dụ xem lại nhật ký hoạt động cuối tuần, để kịp phát hiện nếu agent bắt đầu trả lời sai một câu hỏi tưởng chừng đơn giản do dữ liệu chính sách thay đổi mà chưa cập nhật kịp cho nó.

Mức 3 - Tự làm phần lớn, báo cáo sau

Đến mức 3, agent đã đủ tin cậy để tự vận hành gần trọn vẹn một quy trình có nhiều bước, chỉ dừng lại để hỏi con người ở những điểm quyết định thật sự quan trọng, còn lại tự chạy và tổng hợp báo cáo sau khi hoàn tất thay vì xin duyệt từng bước nhỏ. Ví dụ cụ thể: agent tự xử lý toàn bộ quy trình từ nhận đơn, kiểm tra tồn kho, tạo phiếu xuất kho cho tới nhắn tin xác nhận với khách, chỉ tạm dừng xin duyệt riêng khi đơn hàng vượt một ngưỡng giá trị nhất định, còn lại cuối ngày gửi một bản tổng kết cho người quản lý xem lại.

Mức này thường chỉ nên áp dụng sau khi agent đã chạy ổn định ở mức 1 và mức 2 trong một thời gian đủ dài để bạn tin tưởng vào chất lượng xử lý của nó, đừng nhảy thẳng từ mức 0 lên mức 3 chỉ vì muốn tiết kiệm thời gian nhanh hơn - niềm tin với agent cũng cần được xây dựng từng bước như với một nhân viên mới vậy.

Mức 4 - Tự chủ hoàn toàn

Đây là mức cao nhất, nơi agent không chỉ tự thực hiện hành động mà còn tự đặt ra cả mục tiêu con và cách đạt mục tiêu đó, gần như không cần con người can thiệp trong suốt quá trình. Ví dụ cụ thể: agent tự quyết định toàn bộ chiến lược phân bổ ngân sách quảng cáo giữa nhiều kênh trong một khoảng ngân sách tổng được giao, tự điều chỉnh theo hiệu quả thời gian thực mà không cần hỏi lại.

Với phần lớn doanh nghiệp SME, mức 4 hiện vẫn là mức nên cân nhắc rất kỹ trước khi áp dụng, bởi giá trị và rủi ro đi kèm thường lớn hơn hẳn ba mức trước, chỉ phù hợp với những quy trình đã được kiểm chứng kỹ càng qua thời gian dài và có cơ chế giám sát tự động đủ mạnh đứng phía sau - đừng vì nghe "tự chủ hoàn toàn" có vẻ hiện đại mà vội áp dụng cho một quy trình còn non.

Nguyên tắc chọn mức theo giá trị và rủi ro

Câu hỏi cốt lõi không phải là "agent này thông minh tới đâu" mà là "nếu agent làm sai ở bước này, thiệt hại lớn tới đâu và có dễ sửa lại không". Việc vừa xét giá trị của hành động (số tiền, số người bị ảnh hưởng) vừa xét khả năng đảo ngược nếu sai sẽ giúp bạn tự khoanh vùng được mức tự chủ phù hợp cho từng loại việc, thay vì áp một mức chung cho tất cả. Bảng dưới đây giúp bạn tra nhanh theo hai trục này.

Giá trị / Rủi ro hành động Dễ đảo ngược nếu sai Khó/không thể đảo ngược
Giá trị thấp Mức 2 - Mức 3: có thể để agent tự làm, giám sát định kỳ Mức 1 - Mức 2: nên có bước duyệt nhẹ hoặc kiểm tra mẫu ngẫu nhiên
Giá trị cao Mức 1 - Mức 2: chờ duyệt hoặc giới hạn ngưỡng giá trị mỗi lần Mức 0 - Mức 1: bắt buộc có người duyệt hoặc chỉ dùng ở vai trò gợi ý

Ngoài ra, một nguyên tắc thực tế rất đáng nhớ là hãy để agent "thăng cấp" dần theo thời gian giống như một nhân viên thử việc: bắt đầu ở mức thấp cho một quy trình mới, theo dõi kết quả trong vài tuần, rồi mới cân nhắc nâng lên mức cao hơn khi đã đủ dữ liệu chứng minh độ tin cậy. Bên cạnh đó, đừng quên rằng mức tự chủ có thể khác nhau ngay trong cùng một quy trình tuỳ theo giá trị đơn hàng hay mức độ nhạy cảm của khách hàng, ví dụ đơn hàng dưới 2 triệu đồng để agent tự xử lý ở mức 2 nhưng đơn trên 20 triệu đồng thì luôn đẩy về mức 1 để có người duyệt trước khi xác nhận.

Kết quả bạn nên nhắm tới

Một bảng phân quyền rõ ràng theo từng loại việc - việc nào mức mấy, ai là người duyệt ở mức 1, ngưỡng giá trị nào cần đẩy về mức thấp hơn - được viết ra thành văn bản và cả đội cùng thống nhất, thay vì để mỗi người hiểu quyền hạn của agent một kiểu.

Một khi đã có bảng phân quyền rõ ràng như vậy giúp cả đội cùng hiểu đúng giới hạn, bạn sẽ thấy AI Agent không còn là một "hộp đen" đáng lo mà trở thành một cộng sự đáng tin cậy, càng làm lâu càng được giao thêm việc theo đúng tốc độ niềm tin bạn xây dựng được, để rồi một ngày nhìn lại, bạn nhận ra cả đội đã rảnh tay hơn hẳn mà không hề đánh đổi bằng một sự cố đáng tiếc nào.

Nếu bạn muốn có ngay một bảng phân quyền tự chủ áp dụng riêng cho các quy trình của công ty mình - từ chăm sóc khách hàng, xử lý đơn hàng cho tới email marketing - đội ngũ BeelyWeb có sẵn checklist/template phân mức tự chủ theo đúng khung 5 mức ở trên, bạn chỉ cần liên hệ để nhận template và điền theo đúng quy trình thật của mình nhé.