Amazon đã ấn định một ngày hết hạn. Vào ngày 30 tháng 7 năm 2026, Mechanical Turk sẽ ngừng tiếp nhận khách hàng mới. Các tài khoản hiện có sẽ tiếp tục hoạt động, và Amazon cho biết họ sẽ duy trì tính bảo mật cũng như thời gian hoạt động của nền tảng. Tuy nhiên, công ty cũng làm rõ rằng sẽ không có thêm tính năng mới nào được ra mắt. Đối với một dịch vụ từng góp phần định hình kỷ nguyên lao động internet, đây chẳng khác nào một thông báo ngừng hoạt động.
Sàn giao dịch công việc tự do nguyên bản
Mechanical Turk ra mắt vào năm 2005, rất lâu trước khi các ứng dụng như Uber hay TaskRabbit biến lao động vụn vặt thành một khái niệm quen thuộc với mọi nhà. Amazon xây dựng nó như một thị trường cho các "nhiệm vụ trí tuệ con người" (human intelligence tasks) — những công việc nhỏ mà phần mềm chưa thể xử lý. Những người lao động, hầu hết là ẩn danh và rải rác khắp toàn cầu, đăng nhập để chép lại các đoạn âm thanh, xác minh địa chỉ cửa hàng, kiểm duyệt nội dung và gắn thẻ hình ảnh. Bạn cần ai đó giải mã CAPTCHA, xếp hạng kết quả tìm kiếm, hay đánh giá xem một bài đánh giá sản phẩm mang sắc thái tích cực hay giận dữ? MTurk chính là nơi đó.
Giá cả thường được tính bằng đơn vị cent. Một đợt phân loại một nghìn hình ảnh có thể chỉ trả một xu cho mỗi hình. Đối với các nhà nghiên cứu, nhà tiếp thị và các startup tự thân (bootstrapped), điều này mang tính cách mạng. Đột nhiên, bạn có thể thực hiện một cuộc khảo sát với hàng trăm người tham gia chỉ trong một buổi chiều, hoặc dán nhãn dữ liệu huấn luyện cho một mô hình thị giác máy tính mà không cần thuê một đội ngũ dán nhãn chuyên nghiệp. Nền tảng này đã trở thành một cơ sở hạ tầng. Các nhà khoa học xã hội thực hiện các thí nghiệm trên đó. Các công ty công nghệ thử nghiệm giao diện. Các đội ngũ AI xây dựng các bộ dữ liệu.
Khoảng năm 2018, Amazon đã cố gắng hiện đại hóa vai trò đó. Họ tái định vị Mechanical Turk như một công cụ dán nhãn dữ liệu cho các mạng thần kinh (neural networks), gắn kết nó chặt chẽ hơn với Amazon SageMaker AI. Ý tưởng là để cung cấp cho quy trình học máy (machine learning pipeline): con người sẽ làm sạch, dán nhãn và xác minh các nguyên liệu thô mà các thuật toán cần để học hỏi. MTurk không còn chỉ là những công việc lặt vặt nữa. Nó được kỳ vọng sẽ trở thành xương sống nhân lực cho sự bùng nổ AI.
Sự bùng nổ đó tiếp tục tăng trưởng. Nhưng Mechanical Turk thì không.
Khi lớp nhân lực bắt đầu sử dụng AI
Sự mâu thuẫn đến một cách âm thầm, rồi đột ngột ập đến. Một phân tích năm 2023 cho thấy có khoảng 33% đến 46% công nhân MTurk đang sử dụng các Mô hình Ngôn ngữ Lớn (Large Language Models) để hoàn thành các nhiệm vụ mà họ được trả tiền để làm thủ công. Các nhà nghiên cứu trả tiền để có được sự đánh giá của con người. Thay vào đó, họ lại nhận được ChatGPT.
Đây không chỉ là câu chuyện về việc người lao động làm việc qua loa cho xong chuyện. Khi một người dán nhãn sử dụng LLM để dán nhãn cảm xúc trong các đánh giá của khách hàng, hoặc để phân loại văn bản y tế, hoặc để viết lời thoại cho bộ dữ liệu huấn luyện chatbot, dữ liệu đó không còn là sự thật dựa trên nền tảng con người nữa. Nó trở thành một bản sao của những phỏng đoán tốt nhất từ máy móc. Nếu đưa bản sao đó ngược lại vào một mô hình khác như là sự thật khách quan (ground truth), vòng lặp sẽ càng thắt chặt hơn. Tín hiệu sẽ thoái hóa thành nhiễu. Khái niệm "con người trong vòng lặp" (human in the loop) trở thành một con dấu xác nhận cho phần mềm vốn đã đang chạy ngầm phía sau.
Đối với ngành công nghiệp AI, đây là một cuộc khủng hoảng thực tế. Các đội ngũ chi hàng ngàn đô la cho các hợp đồng MTurk với niềm tin rằng họ đang mua được những góc nhìn đa dạng và tự nhiên của con người. Nếu một bộ phận lớn lao động đó được tự động hóa, bộ dữ liệu thu được sẽ thừa hưởng các định kiến, điểm mù và sự ảo tưởng (hallucinations) của chính LLM đang thực hiện công việc đó. Việc kiểm soát chất lượng trở nên khó khăn hơn. Các nhà nghiên cứu phải thiết kế các bài kiểm tra sự chú ý và các câu hỏi bẫy ngày càng phức tạp chỉ để chứng minh rằng thực sự có con người ở đó. Thái độ phòng thủ đó làm tăng chi phí và làm chậm tiến độ các dự án.
