Two AI agents at New Street Studios đã biến một ý tưởng thẻ bài thành một tệp tin sẵn sàng để in ấn. Tuy nhiên, điểm đáng chú ý nhất là cách hệ thống phát hiện ra một lỗi trước khi nó trôi xuống các công đoạn tiếp theo. Khi bot sản xuất gắn cờ một vật phẩm quan trọng bị ẩn trên tác phẩm nghệ thuật, nó đã gửi tệp tin ngược lại cho bot thiết kế, ngăn chặn lỗi mà không cần sự can thiệp của con người.
Tại sao việc bàn giao lại quan trọng
Thử nghiệm này đo lường khả năng ngăn ngừa lỗi, chứ không phải tốc độ. Thông thường, một nhà thiết kế sẽ phác thảo thẻ bài, một công cụ sản xuất sẽ tinh chỉnh bố cục, và một người kiểm duyệt sẽ phê duyệt. Nếu bước sản xuất phát hiện ra vấn đề, một người sẽ can thiệp, diễn giải vấn đề và phân công lại nhiệm vụ. Trong thử nghiệm này, bot sản xuất—INKA-01—đã phát hiện ra tư thế của một nhân vật làm che khuất một yếu tố quan trọng trong trò chơi. Thay vì cắt xén nhanh chóng, nó đã tạo ra một thông báo từ chối nêu rõ lỗi cụ thể, giải thích tại sao các công cụ hiện tại không thể khắc phục và gửi trả sản phẩm lại cho bot thiết kế—LUDO-01. Quy trình khép kín mà không cần đến sự diễn giải của con người.
Cách thức vận hành của nhóm
Studio vận hành một kênh Slack công khai, nơi tập hợp các nhân viên AI. Mỗi bot có một trách nhiệm duy nhất và được xác định rõ ràng:
- LUDO-01 tạo ra các khái niệm trò chơi và hình ảnh thẻ bài.
- INKA-01 chuẩn bị các tệp tin để in ấn.
- VENDA-01 cập nhật cửa hàng trực tuyến.
- CORA-01 điều phối kênh.
Một người vận hành—chỉ được định danh là “Tôi”—sẽ xem xét bất kỳ thứ gì rời khỏi kênh. Cấu trúc này biến một tập hợp các câu lệnh (prompts) thành một hệ thống đa tác nhân (multi-agent system) thực thụ, nơi mỗi tác nhân có thể chấp nhận hoặc từ chối kết quả đầu ra của tác nhân khác.
Cơ chế từ chối rõ ràng
Một bản đánh giá hữu ích không chỉ dừng lại ở việc nói “có gì đó không ổn.” Nó phải:
- Nêu rõ lỗi – chỉ ra chính xác vấn đề (ví dụ: “vật phẩm quan trọng bị ẩn”).
- Giải thích tại sao công cụ hiện tại không thể khắc phục – làm rõ giới hạn (ví dụ: “việc cắt xén sẽ làm mất đi các chi tiết thiết yếu”).
- Gửi trả sản phẩm cho đúng tác nhân ở công đoạn trước – chuyển công việc ngược lại cho nhà thiết kế để thiết kế lại.
Việc buộc bot thứ hai phải diễn đạt rõ vấn đề sẽ tạo ra một điểm quyết định có thể truy xuất được. Lệnh từ chối trở thành một phần của nhật ký kiểm tra (audit log), hiển thị cho bất kỳ ai theo dõi kênh, và nó ngăn chặn tệp lỗi chuyển sang các giai đoạn sau như in ấn hoặc tải lên cửa hàng.
Xây dựng một hệ thống tương tự
Thử nghiệm này đã đúc kết năm quy tắc thực tế cho bất kỳ ai muốn tái lập mô hình này:
- Giao một sản phẩm cụ thể cho mỗi công việc. Hãy yêu cầu một tệp tin cụ thể, thay vì một yêu cầu mơ hồ như “hãy giúp tôi việc này.”
- Xác định trước các điều kiện dừng. Tạm dừng quy trình làm việc nếu thiếu hướng dẫn hoặc bị từ chối quyền truy cập.
- Yêu cầu sự chấp nhận hoặc từ chối rõ ràng. Chỉ một tin nhắn thôi là chưa đủ để báo hiệu hoàn thành.
- Giữ con người trong quy trình đối với các lựa chọn chiến lược. Người vận hành giữ vai trò về thẩm mỹ, chính sách và quyền phát hành cuối cùng.
- Làm cho hồ sơ công việc trở nên hiển thị. Một kênh dùng chung cho phép bất kỳ ai cũng có thể kiểm tra quy trình và hiểu tại sao việc bàn giao lại diễn ra.
Tuân thủ các hướng dẫn này sẽ biến một chuỗi các câu lệnh thành một đội ngũ phối hợp nhịp nhàng, nơi mỗi thành viên đều biết mình cần sản xuất gì, khi nào cần dừng lại và cách thông báo các lỗi xảy ra.
Bài học rút ra: Khi các tác nhân AI nêu rõ lỗi, giải thích các giới hạn của công cụ và chuyển công việc ngược lại cho đúng bot ở công đoạn trước, các lỗi sẽ được chặn lại sớm, giúp con người có thể tập trung vào những quyết định thực sự thúc đẩy doanh nghiệp tiến lên.
