OpenAI vừa nhận được một sự hỗ trợ hiếm hoi từ Bộ Tư pháp Hoa Kỳ khi cơ quan này đệ trình một bản ý kiến hỗ trợ (amicus brief) dài 20 trang nhằm ủng hộ lập luận bào chữa dựa trên nguyên tắc "sử dụng hợp lý" (fair use) của công ty trong vụ kiện bản quyền với tờ New York Times. Hồ sơ được đệ trình tại Tòa án Quận phía Nam New York, cho thấy chính phủ liên bang coi các hoạt động huấn luyện AI là một vấn đề lợi ích quốc gia, chứ không chỉ là một tranh chấp pháp lý tư nhân.

Tại sao Chính phủ lại tham gia vào vụ việc này

Bản ý kiến này đặt vụ việc dưới góc độ địa chính trị. Nó lập luận rằng Hoa Kỳ có "lợi ích mạnh mẽ" trong việc duy trì khả năng cạnh tranh của ngành công nghiệp AI, liên kết sự dẫn đầu về AI với cả sự thịnh vượng kinh tế và an ninh quốc gia. Bằng cách ủng hộ OpenAI, chính quyền ám chỉ rằng việc diễn giải luật bản quyền một cách hẹp hòi có thể làm chậm chu kỳ nghiên cứu và phát triển, vốn là yếu tố giúp các công ty Mỹ luôn dẫn trước các đối thủ nước ngoài. Quan điểm này tương đồng với các sắc lệnh hành pháp trước đó kêu gọi cách tiếp cận "ưu tiên Hoa Kỳ" đối với các tiêu chuẩn và quản trị AI.

Câu hỏi pháp lý cốt lõi: Sử dụng mang tính chuyển đổi hay Vi phạm bản quyền?

Vấn đề then chốt là liệu việc đưa các tập dữ liệu (corpora) khổng lồ có bản quyền vào một mô hình ngôn ngữ lớn (LLM) có được coi là "sử dụng hợp lý" hay không. Nguyên tắc "sử dụng hợp lý" bảo vệ các cách sử dụng mang tính "chuyển đổi" (transformative) – nghĩa là những cách sử dụng tạo ra điều gì đó mới mẻ, với mục đích khác biệt, thay vì chỉ đơn thuần là sao chép tác phẩm gốc. Lập luận bào chữa của OpenAI, được bản ý kiến của chính phủ ủng hộ, cho rằng các LLM học các quy luật và tạo ra văn bản mới, một quá trình giống với việc một người đọc hấp thụ thông tin hơn là một thao tác sao chép và dán.

Bản ý kiến cảnh báo rằng việc "kìm hãm sự phát triển của LLM do hiểu sai về học thuyết sử dụng hợp lý" sẽ gây tổn hại đến khả năng dịch chuyển kinh tế của Hoa Kỳ. Cách diễn đạt này tương tự như một nhận định trong một vụ kiện khác, nơi một thẩm phán đã ví việc huấn luyện LLM giống như một người đọc học hỏi từ sách để tạo ra những ý tưởng mới, thay vì là một công cụ được thiết kế để thay thế tác giả gốc.

Các vụ kiện trước đây định hình cuộc tranh luận như thế nào

Bản ý kiến này không có hiệu lực như một phán quyết của tòa án, nhưng nó chỉ ra các vụ kiện tụng gần đây giúp xác định ranh giới giữa việc huấn luyện được phép và việc thu thập dữ liệu bất hợp pháp. Trong một vụ việc liên quan đến Anthropic, công ty này đã phải đối mặt với một thỏa thuận dàn xếp trị giá 1,5 tỷ USD không phải vì mô hình của họ học từ các tác phẩm có bản quyền, mà vì họ đã lấy tài liệu đó từ các "thư viện bóng bất hợp pháp" (illegal shadow libraries) – về cơ bản là các cơ sở dữ liệu lậu. Thỏa thuận này nhấn mạnh rằng phương thức thu thập dữ liệu có thể dẫn đến trách nhiệm pháp lý khổng lồ ngay cả khi bản thân quá trình huấn luyện có thể được coi là mang tính chuyển đổi.

Những quan sát trước đó của Thẩm phán William Alsup cũng cung cấp thêm bối cảnh. Ông nhấn mạnh rằng việc huấn luyện một LLM giống với quá trình học tập của con người hơn là một bản sao trực tiếp, gợi ý rằng các tòa án có thể sẽ cởi mở hơn với một cách diễn giải rộng hơn về nguyên tắc sử dụng hợp lý. Tuy nhiên, kết quả của vụ Anthropic cho thấy các tòa án sẽ vạch ra một ranh giới cứng rắn đối với việc thu thập dữ liệu bất hợp pháp, bất kể mục đích sử dụng sau đó là gì.

Ai được lợi và ai gặp rủi ro

Các nhà phát triển AI sẽ được hưởng lợi từ một môi trường pháp lý coi việc nạp dữ liệu quy mô lớn là sử dụng hợp lý. Một phán quyết có lợi có thể làm giảm chi phí xây dựng các mô hình thế hệ tiếp theo như Claude, Gemini, hoặc một GPT-5 trong tương lai, vì các công ty sẽ không còn cần phải thương lượng bản quyền cho mọi đoạn văn bản mà họ nạp vào. Điều đó có thể thúc đẩy đổi mới và giữ cho các công ty Hoa Kỳ luôn ở vị trí dẫn đầu trong cuộc đua AI toàn cầu.

Các nhà sáng tạo nội dung và nhà xuất bản vẫn là những bên phản đối mạnh mẽ nhất. Họ lập luận rằng việc thu thập dữ liệu (scraping) không kiểm soát sẽ làm xói mòn giá trị tác phẩm của họ và tước đi doanh thu của họ. Vụ kiện của New York Times phản ánh mối quan ngại đó: tờ báo tuyên bố việc OpenAI sử dụng các bài báo của họ mà không có sự cho phép là vi phạm bản quyền. Nếu các tòa án đứng về phía tờ báo, các phòng thí nghiệm AI có thể phải đối mặt với các lệnh đình chỉ, bồi thường thiệt hại, hoặc nhu cầu phải cấp phép hồi tố cho hàng tỷ từ ngữ — một gánh nặng tài chính và hậu cần có thể bóp nghẹt các đơn vị nhỏ hơn.

Chính phủ có trách nhiệm cân bằng các lực lượng này. Mặc dù bản ý kiến ủng hộ sự phát triển của AI, nhưng nó cũng ngầm thừa nhận nhu cầu về một khung pháp lý rõ ràng. Những phán quyết quá lỏng lẻo có thể gây ra phản ứng dữ dội từ lĩnh vực sáng tạo, tiềm ẩn nguy cơ dẫn đến các đạo luật mới có thể khắt khe hơn cả tranh chấp hiện tại.

Lập luận phản bác: Bảo vệ quyền sáng tạo

Những người chỉ trích lập trường của chính phủ chỉ ra rằng học thuyết sử dụng hợp lý chưa bao giờ được dự định để bao trùm toàn bộ các hoạt động dữ liệu của một ngành công nghiệp. Họ cảnh báo rằng việc coi tất cả các hoạt động nạp văn bản quy mô lớn là mang tính chuyển đổi có thể tạo ra một tiền lệ làm suy yếu cấu trúc khuyến khích của hệ thống bản quyền. Hơn nữa, thỏa thuận với Anthropic cho thấy ngay cả khi quá trình huấn luyện là được phép, phương thức thu thập dữ liệu vẫn có thể là bất hợp pháp. Sự lưỡng tính này có nghĩa là các nhà phát triển AI không thể chỉ đơn thuần dựa vào việc bào chữa bằng quyền sử dụng hợp lý; họ cũng phải đảm bảo rằng các đường ống dữ liệu của mình là sạch.

Những điều cần theo dõi tiếp theo

  • Các phán quyết của tòa án: Tòa án Quận phía Nam New York cuối cùng sẽ đưa ra quyết định về khiếu nại của New York Times. Phán quyết đó có khả năng sẽ trở thành điểm tham chiếu cho các vụ kiện bản quyền liên quan đến AI trong tương lai.
  • Các động thái lập pháp: Các nhà lập pháp có thể phản ứng trước định hướng của tòa án bằng cách soạn thảo các đạo luật nhằm làm rõ các hoạt động sử dụng dữ liệu được phép cho AI, có khả năng sẽ thắt chặt hoặc nới lỏng vùng xám hiện tại.
  • Phản ứng của ngành: Các công ty AI có thể điều chỉnh chiến lược thu thập dữ liệu của họ, bằng cách tìm kiếm các thỏa thuận cấp phép rộng hơn hoặc xây dựng các bộ dữ liệu nội bộ nhằm tránh hoàn toàn các tài liệu có bản quyền.

Điểm mấu chốt

Bản ý kiến amicus của Bộ Tư pháp đã biến cuộc chiến bản quyền của Open AI thành một cuộc chiến ủy nhiệm về tương lai AI của nước Mỹ. Bằng cách đóng khung việc huấn luyện LLM như một hoạt động sử dụng hợp lý thiết yếu cho năng lực cạnh tranh quốc gia, chính phủ phát đi tín hiệu rằng các cách giải thích bản quyền hạn chế có thể là một bất lợi chiến lược. Tuy nhiên, sự căng thẳng đang diễn ra giữa quyền của người sáng tạo và nhu cầu của các nhà phát triển có nghĩa là các tòa án, và có thể là cả Quốc hội, sẽ phải vạch ra một ranh giới nhằm cân bằng giữa đổi mới sáng tạo và việc bảo vệ các tác phẩm sáng tạo.