OpenAI זכתה בחיזוק נדיר ממשרד המשפטים של ארה"ב כאשר הסוכנות הגישה חוות דעת ידידותית (amicus brief) בת 20 עמודים התומכת בטיעון ה"שימוש ההוגן" (fair-use) של החברה בתביעת זכויות היוצרים של ה-New York Times. ההגשה, שהוגשה במחוז הדרומי של ניו יורק, מסמנת כי הממשל הפדרלי רואה בשיטות האימון של AI עניין של אינטרס לאומי, ולא רק סכסוך משפטי פרטי.
מדוע הממשלה מתערבת
חוות הדעת מציגה את המקרה במונחים גיאופוליטיים. היא טוענת כי לארצות הברית יש "אינטרס חזק" לשמור על תחרותיות תעשיית ה-AI שלה, תוך קישור למנהיגות בתחום ה-AI הן לשגשוג כלכלי והן לביטחון לאומי. באמצעות תמיכה ב-OpenAI, הממשל מרמז כי פרשנות צרה של חוק זכויות היוצרים עלולה להאט את מחזור המחקר והפיתוח ששומר על חברות אמריקאיות בחזית מול מתחרות מחוץ למדינה. העמדה מהדהדת צווים נשיאותיים קודמים הקוראים לגישה של "ארה"ב תחילה" בכל הנוגע לתקנים וממשל של AI.
השאלה המשפטית המרכזית: שימוש טרנספורמטיבי או הפרה?
השאלה העומדת על הפרק היא האם הזנת מאגרי נתונים (corpora) עצומים המוגנים בזכויות יוצרים לתוך מודל שפה גדול (LLM) נחשבת ל"שימוש הוגן". השימוש ההוגן מגן על שימושים שהם "טרנספורמטיביים" – כלומר, שימושים שמוסיפים משהו חדש, עם מטרה שונה, במקום פשוט לשחזר את היצירה המקורית. ההגנה של OpenAI, שמהדהדת בחוות הדעת הממשלתית, טוענת כי מודלי LLM לומדים תבניות ומייצרים טקסט חדש, תהליך הדומה יותר לספיגת מידע על ידי קורא אנושי מאשר לפעולת העתק-הדבק.
חוות הדעת מזהירה כי "הגבלת פיתוח LLM תחת הבנה שגויה של דוקטרינת השימוש ההוגן" תפגע בניידות הכלכלית של אמריקה. ניסוח זה משקף הערה מתיק משפטי נפרד, שבו שווה שופט את אימון ה-LLM לקורא הלומד מספרים כדי ליצור רעיונות חדשים, ולא לכלי שנועד להחליף את היוצר המקורי.
כיצד תיקים קודמים מעצבים את הוויכוח
לחוות הדעת אין תוקף של פסיקת בית משפט, אך היא מצביעה על ליטיגציה אחרונה המסייעת להגדיר את הגבול בין אימון מותר לבין רכישת נתונים בלתי חוקית. בתיק שכלל את Anthropic, החברה הגיעה לפשרה של 1.5 מיליארד דולר לא בגלל שהמודל שלה למד מיצירות המוגנות בזכויות יוצרים, אלא בגלל שהיא השיגה את החומרים הללו מ"ספריות צללים בלתי חוקיות" – למעשה, מאגרי מידע פיראטיים. הפשרה מדגישה כי שיטת השגת הנתונים עלולה להוביל לחבות משפטית עצומה, גם אם תהליך האימון עצמו עשוי להיחשב כטרנספורמטיבי.
התבטאויותיו המוקדמות של השופט William Alsup מספקות הקשר נוסף. הוא הדגיש שאימון LLM דומה יותר לתהליך למידה אנושי מאשר להעתקה ישירה, מה שמרמז כי בתי המשפט עשויים להיות פתוחים לפרשנות רחבה יותר של השימוש ההוגן. עם זאת, התוצאה בתיק Anthropic מראה כי בתי המשפט מציבים קו אדום ברכישה בלתי חוקית, ללא קשר לשימוש המאוחר בנתונים.
מי מרוויח ומי מסתכן
מפתחי AI עשויים להפיק תועלת מסביבה משפטית המתייחסת להזנת נתונים בקנה מידה גדול כשימוש הוגן. פסיקה נוטה לטובתם עשויה להוזיל את עלות בניית מודלים מהדור הבא, כגון Claude, Gemini, או GPT-5 עתידי, מכיוון שחברות לא יצטרכו עוד לנהל משא ומתן על רישיונות עבור כל פיסת טקסט שהן מעבדות. זה עשוי להאיץ את החדשנות ולהשאיר חברות אמריקאיות בחזית המרוץ העולמי ל-AI.
יוצרי תוכן ומוציאים לאור נותרו המתנגדים הקולניים ביותר. הם טוענים כי איסוף נתונים (scraping) ללא הגבלה שוחק את ערך עבודתם ומונע מהם הכנסות. התביעה של ה-New York Times משקפת חשש זה: העיתון טוען כי השימוש של OpenAI בכתבותיו ללא רשות מפר את זכויות היוצרים שלו. אם בתי המשפט יצדקו עם העיתון, מעבדות AI עלולות לעמוד בפני צווי מניעה, פיצויים, או הצורך להנפיק רישיונות רטרואקטיביים למיליארדי מילים – נטל כלכלי ולוגיסטי שעלול לחנוק שחקנים קטנים יותר.
הממשלה מעוניינת באיזון בין הכוחות הללו. בעוד שחוות הדעת תומכת בצמיחת ה-AI, היא גם מכירה במשתמע בצורך במסגרת משפטית ברורה. פסיקות מרחיבות מדי עלולות לעורר תגובת נגד מהמגזר היצירתי, מה שעלול להוביל לחקיקה חדשה שעשויה להיות מגבילה יותר מהסכסוך הנוכחי.
הטיעון הנגדי: הגנה על זכויות יצירתיות
מבקרים של עמדת הממשלה מצביעים על כך שדוקטרינת השימוש ההוגן מעולם לא נועדה להעניק כיסוי גורף לפרקטיקות הנתונים של תעשייה שלמה. הם מזהירים כי התייחסות לכל איסוף טקסט בקנה מידה גדול כפעולה טרנספורמטיבית עלולה ליצור תקדים שיערער את מבנה התמריצים של מערכת זכויות היוצרים. יתרה מכך, ההסדר עם Anthropic מדגים שאפילו אם תהליך האימון מותר, האמצעים להשגת הנתונים עדיין יכולים להיות בלתי חוקיים. דואליות זו פירושה שמפתחי AI אינם יכולים פשוט להסתמך על הגנת שימוש הוגן; עליהם גם לוודא שצינורות הנתונים (data pipelines) שלהם נקיים.
מה כדאי לעקוב אחריו בהמשך
- החלטות בתי משפט: המחוז הדרומי של ניו יורק ייתן בסופו של דבר החלטה בנוגע לתביעת ה-New York Times. פסיקה זו תהפוך ככל הנראה לנקודת ייחוס למקרי זכויות יוצרים עתידיים הקשורים ל-AI.
- צעדים חקיקתיים: המחוקקים עשויים להגיב לכיוון של בית המשפט על ידי ניסוח חוקים שיבהירו את פרקטיקות השימוש המותרות בנתונים עבור AI, מה שעשוי להדק או להקל על האזור האפור הנוכחי.
- תגובת התעשייה: חברות AI עשויות להתאים את אסטרטגיות איסוף הנתונים שלהן, בין אם על ידי חיפוש הסכמי רישוי רחבים יותר ובין אם על ידי בניית מאגרי נתונים פנימיים שמונעים שימוש בחומרים המוגנים בזכויות יוצרים לחלוטין.
שורה תחתונה
חוות הדעת (amicus brief) של משרד המשפטים הופכת את המאבק על זכויות היוצרים של OpenAI למלחמת פרוקסי על עתיד ה-AI של אמריקה. על ידי הצגת אימון LLM כפעילות של שימוש הוגן החיונית לתחרותיות לאומית, הממשלה מאותתת שפרשנויות מגבילות של זכויות יוצרים עלולות להוות נטל אסטרטגי. עם זאת, המתח המתמשך בין זכויות היוצרים של יוצרים לבין צרכי המפתחים פירושו שבתי המשפט, ואולי גם הקונגרס, יצטרכו לשרטט קו שיאזן בין חדשנות לבין הגנה על עבודות יצירתיות.
