Tóm tắt nhanh

  • AI agent không ủy quyền tốt chỉ bằng cách chuyển prompt cho một agent khác. Hệ thống cần hợp đồng nhiệm vụ rõ ràng, cơ chế chọn đúng bên thực thi, kiểm tra đầu ra và khả năng truy vết toàn bộ quyết định.
  • Ủy quyền thiếu kiểm soát có thể khuếch đại lỗi qua nhiều agent, làm tăng chi phí và khiến đội vận hành khó xác định trách nhiệm. Một quy trình có tiêu chí chấp nhận và điểm dừng rõ ràng giúp workflow agent an toàn hơn khi đưa vào production.
  • Chọn một workflow agent hiện có, bổ sung schema nhiệm vụ, tiêu chí chấp nhận, giới hạn quyền và trace cho từng lần chuyển giao trước khi tăng mức tự chủ.

Điều gì đã xảy ra

Khi một AI agent có thể gọi công cụ hoặc giao việc cho agent khác, bài toán không còn dừng ở chất lượng câu trả lời. Hệ thống phải quyết định việc nào nên giao, giao cho ai, truyền bao nhiêu ngữ cảnh và làm thế nào để biết kết quả đủ tốt.

Bài viết của Google Cloud về cách agent ủy quyền tốt hơn đặt vấn đề này vào đúng trọng tâm của agent engineering. Từ góc nhìn triển khai, ủy quyền nên được xem là một giao thức có thể kiểm tra, không phải một cuộc hội thoại tự do giữa các mô hình.

Ủy quyền của AI agent thực sự gồm những quyết định nào?

Một agent điều phối trước tiên phải nhận ra giới hạn của chính nó. Nó cần phân biệt giữa công việc có thể tự hoàn thành, công việc cần công cụ chuyên biệt và công việc phải chuyển cho một agent có năng lực hoặc quyền truy cập khác.

Sau đó, agent phải biến mục tiêu ban đầu thành một nhiệm vụ độc lập. Nhiệm vụ đó cần nêu đầu vào, phạm vi, ràng buộc, định dạng kết quả và điều kiện hoàn thành. Nếu chỉ chuyển tiếp toàn bộ lịch sử hội thoại, bên nhận có thể phải tự suy đoán mục tiêu và dễ kế thừa cả những thông tin không liên quan.

Bước cuối là xử lý kết quả: chấp nhận, yêu cầu sửa, thử một bên thực thi khác hoặc chuyển cho con người. Vì vậy, delegation là một vòng điều khiển gồm định tuyến, thực thi và đánh giá, chứ không chỉ là một lệnh gọi model.

Một hợp đồng nhiệm vụ tốt cần chứa gì?

Đơn vị ủy quyền nên nhỏ đến mức có thể đánh giá độc lập nhưng vẫn đủ ngữ cảnh để thực thi. Với tác vụ kỹ thuật, một hợp đồng tối thiểu có thể gồm các thành phần sau:

  • Mục tiêu: trạng thái cuối cần đạt được, thay vì một chỉ dẫn mơ hồ như “xử lý vấn đề này”.
  • Đầu vào và nguồn dữ liệu: dữ liệu nào được phép dùng, dữ liệu nào chỉ để tham khảo và dữ liệu nào không được truy cập.
  • Ràng buộc: giới hạn quyền, thời gian, chi phí, công cụ và những hành động bị cấm.
  • Đầu ra: schema, tệp, bản vá, quyết định hoặc bằng chứng mà agent điều phối mong đợi.
  • Tiêu chí chấp nhận: điều kiện có thể kiểm tra để xác định thành công, thất bại hoặc cần xem xét thủ công.

Ví dụ, agent xử lý sự cố không nên giao nhiệm vụ “sửa production”. Nó có thể giao một nhiệm vụ hẹp hơn: phân tích log đã được cấp, xác định các giả thuyết phù hợp với bằng chứng và trả về kế hoạch khắc phục mà chưa thực hiện thay đổi. Quyền ghi chỉ được cấp ở bước sau, nếu chính sách và người phê duyệt cho phép.

Cách tách biệt phân tích khỏi hành động làm giảm phạm vi ảnh hưởng của quyết định sai. Đây cũng là nguyên tắc hữu ích khi xây dựng control plane tự động hóa có quản trị: bên điều phối quyết định chính sách, còn executor chỉ nhận quyền cần thiết cho nhiệm vụ cụ thể.

Làm thế nào chọn đúng agent và giới hạn ngữ cảnh?

Routing tốt cần dựa trên mô tả năng lực có thể kiểm chứng, không dựa vào tên agent. Registry nên cho biết agent hỗ trợ loại nhiệm vụ nào, cần công cụ và quyền gì, tạo loại đầu ra nào và có những giới hạn vận hành nào.

Trong giai đoạn đầu, quy tắc định tuyến rõ ràng thường dễ kiểm thử hơn việc để một mô hình tự do chọn mọi tuyến thực thi. Khi dùng model để routing, đội phát triển vẫn nên áp dụng danh sách agent cho phép, ngân sách tối đa, giới hạn số lần chuyển giao và tuyến dự phòng xác định trước.

Ngữ cảnh cũng phải tuân theo nguyên tắc tối thiểu cần thiết. Agent nhận việc cần đủ thông tin để hoàn thành nhiệm vụ, nhưng không mặc nhiên cần toàn bộ bộ nhớ, credential hay lịch sử của agent cha. Có thể truyền bản tóm tắt có cấu trúc, tham chiếu tới dữ liệu được cấp quyền và một mã tương quan để nối các sự kiện khi truy vết.

Quan trọng hơn, mỗi lần chuyển giao đều có thể làm mất ý định hoặc thêm diễn giải sai. Hệ thống nên giới hạn độ sâu ủy quyền, phát hiện vòng lặp và buộc agent cấp dưới trả về cả kết quả lẫn bằng chứng hoặc trạng thái không chắc chắn.

Đánh giá và vận hành delegation trong production ra sao?

Không thể chỉ chấm agent cuối cùng vì lỗi có thể xuất hiện từ khâu phân rã hoặc chọn sai bên thực thi. Bộ đánh giá nên tách ít nhất bốn câu hỏi: có nên ủy quyền không, nhiệm vụ có được mô tả đúng không, agent được chọn có phù hợp không và đầu ra có đạt tiêu chí chấp nhận không.

Telemetry cần ghi lại phiên bản policy, agent gửi và nhận, công cụ được gọi, thời gian, chi phí, kết quả kiểm tra và lý do retry hoặc escalation. Dữ liệu nhạy cảm không nên bị sao chép nguyên trạng vào log; khả năng quan sát phải đi cùng kiểm soát truy cập và chính sách lưu giữ.

Về vận hành, đội ngũ có thể bắt đầu bằng các workflow ít rủi ro, sử dụng đầu ra chỉ đọc và yêu cầu phê duyệt trước hành động có tác động bên ngoài. Sau đó mới tăng quyền tự chủ dựa trên kết quả đánh giá, thay vì mở toàn bộ quyền ngay từ đầu. Các vấn đề về tài nguyên và độ trễ cũng nên được theo dõi cùng quy trình vận hành AI production và model serving.

Một dashboard tổng hợp chưa đủ để gỡ lỗi delegation. Đội phát triển cần dựng lại được chuỗi quyết định: mục tiêu ban đầu là gì, mỗi agent đã nhận phiên bản ngữ cảnh nào, điều kiện nào dẫn đến chuyển giao và validator nào đã chấp nhận kết quả.

Kết luận

  • Hãy mô hình hóa ủy quyền như một giao thức có đầu vào, quyền hạn, đầu ra và tiêu chí chấp nhận.
  • Chọn agent theo năng lực có thể kiểm chứng và chỉ truyền ngữ cảnh tối thiểu cần thiết.
  • Đánh giá riêng quyết định giao việc, chất lượng nhiệm vụ, routing và kết quả cuối.
  • Giới hạn độ sâu, số lần thử và quyền hành động; luôn có đường escalation rõ ràng.
  • Tăng mức tự chủ dựa trên telemetry và kiểm thử thực tế, không dựa vào cảm giác agent “có vẻ thông minh”.

Bài viết liên quan

Nguồn tham khảo

How agents can delegate better

Vì sao developer cần quan tâm

Ủy quyền thiếu kiểm soát có thể khuếch đại lỗi qua nhiều agent, làm tăng chi phí và khiến đội vận hành khó xác định trách nhiệm. Một quy trình có tiêu chí chấp nhận và điểm dừng rõ ràng giúp workflow agent an toàn hơn khi đưa vào production.

  1. 1Chọn một workflow agent hiện có, bổ sung schema nhiệm vụ, tiêu chí chấp nhận, giới hạn quyền và trace cho từng lần chuyển giao trước khi tăng mức tự chủ.