OpenAI-ക്ക് അപൂർവ്വമായ ഒരു കരുത്ത് ലഭിച്ചു. ന്യൂയോർക്ക് ടൈംസിൻ്റെ പകർപ്പവകാശ കേസിൽ കമ്പനിയുടെ 'ഫെയർ-യൂസ്' (fair-use) പ്രതിരോധത്തിന് പിന്തുണ നൽകിക്കൊണ്ട് യു.എസ്. നീതിന്യായ വകുപ്പ് 20 പേജുള്ള ഒരു അമിക്സ് ബ്രീഫ് (amicus brief) സമർപ്പിച്ചതോടെയാണിത്. സതേൺ ഡിസ്ട്രിക്റ്റ് ഓഫ് ന്യൂയോർക്കിൽ സമർപ്പിച്ച ഈ രേഖ, എഐ (AI) പരിശീലന രീതികളെ വെറുമൊരു സ്വകാര്യ നിയമതർക്കമായിട്ടല്ല, മറിച്ച് ഒരു ദേശീയ താൽപ്പര്യമായിട്ടാണ് ഫെഡറൽ ഗവൺമെന്റ് കാണുന്നത് എന്ന് സൂചിപ്പിക്കുന്നു.
ഗവൺമെന്റ് ഇതിൽ ഇടപെടുന്നത് എന്തുകൊണ്ട്?
ഈ ബ്രീഫ് കേസിനെ ഭൗമരാഷ്ട്രീയ പശ്ചാത്തലത്തിലാണ് അവതരിപ്പിക്കുന്നത്. അമേരിക്കയുടെ എഐ വ്യവസായത്തെ മത്സരക്ഷമമായി നിലനിർത്തുന്നതിൽ രാജ്യത്തിന് "ശക്തമായ താൽപ്പര്യമുണ്ടെന്ന്" ഇത് വാദിക്കുന്നു; എഐ നേതൃത്വത്തെ സാമ്പത്തിക അഭിവൃദ്ധിയുമായും ദേശീയ സുരക്ഷയുമായും ഇത് ബന്ധിപ്പിക്കുന്നു. OpenAI-യെ പിന്തുണയ്ക്കുന്നതിലൂടെ, പകർപ്പവകാശ നിയമത്തെ വളരെ ഇടുങ്ങിയ രീതിയിൽ വ്യാഖ്യാനിക്കുന്നത് അമേരിക്കൻ കമ്പനികളെ വിദേശ എതിരാളികളേക്കാൾ മുന്നിൽ നിലനിർത്തുന്ന ഗവേഷണ-വികസന പ്രക്രിയയെ മന്ദഗതിയിലാക്കിയേക്കാം എന്ന് ഭരണകൂടം സൂചിപ്പിക്കുന്നു. എഐ മാനദണ്ഡങ്ങളിലും ഭരണത്തിലും അമേരിക്കയ്ക്ക് മുൻഗണന നൽകണമെന്ന് ആവശ്യപ്പെടുന്ന മുൻപത്തെ എക്സിക്യൂട്ടീവ് ഉത്തരവുകളുടെ പ്രതിഫലനമാണ് ഈ നിലപാട്.
പ്രധാന നിയമപരമായ ചോദ്യം: പരിവർത്തനപരമായ ഉപയോഗമോ (Transformative Use) അതോ ലംഘനമോ?
വൻതോതിലുള്ള പകർപ്പവകാശമുള്ള വിവരശേഖരങ്ങൾ ഒരു ലാർജ് ലാംഗ്വേജ് മോഡലിലേക്ക് (LLM) നൽകുന്നത് "ഫെയർ യൂസ്" (fair use) പരിധിയിൽ വരുമോ എന്നതാണ് ഇവിടെ പ്രധാന വിഷയം. ഒറിജിനൽ കൃതിയെ വെറുതെ പുനർനിർമ്മിക്കുന്നതിന് പകരം, പുതിയൊരു ലക്ഷ്യത്തോടെ അതിൽ പുതിയ എന്തെങ്കിലും ചേർക്കുന്ന "പരിവർത്തനപരമായ" (transformative) ഉപയോഗങ്ങളെ ഫെയർ യൂസ് സംരക്ഷിക്കുന്നു. ഗവൺമെന്റ് ബ്രീഫിൽ പ്രതിപാദിക്കുന്നതുപോലെ, LLM-കൾ പാറ്റേണുകൾ പഠിക്കുകയും പുതിയ വാചകങ്ങൾ നിർമ്മിക്കുകയും ചെയ്യുന്നു; ഇത് ഒരു കോപ്പി-ആൻഡ്-പേസ്റ്റ് പ്രക്രിയയേക്കാൾ ഉപരിയായി, ഒരു മനുഷ്യ വായനക്കാരൻ വിവരങ്ങൾ ഉൾക്കൊള്ളുന്നതിന് സമാനമാണ് എന്നതാണ് OpenAI-യുടെ വാദം.
"ഫെയർ-യൂസ് സിദ്ധാന്തത്തെക്കുറിച്ചുള്ള തെറ്റിദ്ധാരണ കാരണം LLM വികസനത്തെ നിയന്ത്രിക്കുന്നത്" അമേരിക്കയുടെ സാമ്പത്തിക വളർച്ചയെ ദോഷകരമായി ബാധിക്കുമെന്ന് ബ്രീഫ് മുന്നറിയിപ്പ് നൽകുന്നു. ഒരു വേറിട്ട കേസിൽ, LLM പരിശീലനത്തെ പുതിയ ആശയങ്ങൾ സൃഷ്ടിക്കാൻ പുസ്തകങ്ങളിൽ നിന്ന് പഠിക്കുന്ന ഒരു വായനക്കാരനോട് ജഡ്ജി ഉപമിച്ച ഒരു പരാമർശത്തിന്റെ പ്രതിഫലനമാണിത്; ഇത് ഒറിജിനൽ സ്രഷ്ടാവിനെ മാറ്റിസ്ഥാപിക്കാൻ രൂപകൽപ്പന ചെയ്ത ഒരു ഉപകരണമല്ല.
മുൻകാല കേസുകൾ ചർച്ചയെ എങ്ങനെ സ്വാധീനിക്കുന്നു
ഈ ബ്രീഫിന് ഒരു കോടതി വിധിയുടെ ശക്തിയില്ലെങ്കിലും, അനുവദനീയമായ പരിശീലനവും നിയമവിരുദ്ധമായ ഡാറ്റാ ശേഖരണവും തമ്മിലുള്ള വ്യത്യാസം നിർണ്ണയിക്കാൻ സഹായിക്കുന്ന സമീപകാല നിയമനടപടികളെ ഇത് ചൂണ്ടിക്കാട്ടുന്നു. Anthropic ഉൾപ്പെട്ട ഒരു കേസിൽ, കമ്പനി 1.5 ബില്യൺ ഡോളറിന്റെ സെറ്റിൽമെന്റിന് തയ്യാറായത് അവരുടെ മോഡൽ പകർപ്പവകാശമുള്ള കൃതികളിൽ നിന്ന് പഠിച്ചതുകൊണ്ടല്ല, മറിച്ച് ആ വിവരങ്ങൾ "നിയമവിരുദ്ധമായ ഷാഡോ ലൈബ്രറികളിൽ" (illegal shadow libraries) നിന്ന് ശേഖരിച്ചതുകൊണ്ടാണ്. പരിശീലന പ്രക്രിയ പരിവർത്തനപരമാണെന്ന് കരുതിയാലും, ഡാറ്റ ശേഖരിക്കുന്ന രീതി വലിയ നിയമപരമായ ബാധ്യതകൾ ഉണ്ടാക്കിയേക്കാം എന്ന് ഈ സെറ്റിൽമെന്റ് അടിവരയിടുന്നു.
ജഡ്ജി വില്യം ആൽസപ്പിന്റെ മുൻകാല നിരീക്ഷണങ്ങൾ കൂടുതൽ പശ്ചാത്തലം നൽകുന്നു. LLM പരിശീലനം എന്നത് നേരിട്ടുള്ള പകർപ്പെടുപ്പിനേക്കാൾ ഉപരിയായി ഒരു മനുഷ്യന്റെ പഠന പ്രക്രിയയ്ക്ക് സമാനമാണെന്ന് അദ്ദേഹം ഊന്നിപ്പറഞ്ഞു; ഇത് കോടതികൾ ഫെയർ-യൂസിനെക്കുറിച്ച് കൂടുതൽ വിപുലമായ വ്യാഖ്യാനങ്ങൾ സ്വീകരിച്ചേക്കാം എന്ന സൂചന നൽകുന്നു. എങ്കിലും, ഡാറ്റയുടെ ഉപയോഗം എന്തുതന്നെയായാലും, നിയമവിരുദ്ധമായ രീതിയിൽ അത് ശേഖരിക്കുന്നതിൽ കോടതികൾ കർശനമായ നിലപാടെടുക്കുമെന്ന് Anthropic കേസിന്റെ ഫലം കാണിച്ചുതരുന്നു.
ആർക്കാണ് നേട്ടവും ആർക്കാണ് റിസ്കും?
AI ഡെവലപ്പർമാർക്ക് വൻതോതിലുള്ള ഡാറ്റാ ശേഖരണത്തെ ഫെയർ യൂസ് ആയി പരിഗണിക്കുന്ന ഒരു നിയമസാഹചര്യം ഗുണകരമാകും. അനുകൂലമായ ഒരു വിധി വന്നാൽ Claude, Gemini അല്ലെങ്കിൽ ഭാവിയിലെ GPT-5 പോലുള്ള അടുത്ത തലമുറ മോഡലുകൾ നിർമ്മിക്കുന്നതിനുള്ള ചിലവ് കുറയ്ക്കാൻ സാധിക്കും; കാരണം ഓരോ വാചകത്തിനും ലൈസൻസ് എടുക്കേണ്ട ആവശ്യം കമ്പനികൾക്ക് ഇല്ലാതാകും. ഇത് നവീകരണത്തെ വേഗത്തിലാക്കുകയും ആഗോള എഐ മത്സരത്തിൽ അമേരിക്കൻ കമ്പനികളെ മുന്നിൽ നിലനിർത്തുകയും ചെയ്യും.
കണ്ടന്റ് ക്രിയേറ്റർമാരും പബ്ലിഷർമാരും ഇതിന്റെ ശക്തമായ എതിരാളികളായി തുടരുന്നു. നിയന്ത്രണമില്ലാത്ത സ്ക്രാപ്പിംഗ് (scraping) തങ്ങളുടെ കൃതികളുടെ മൂല്യം കുറയ്ക്കുമെന്നും വരുമാനം ഇല്ലാതാക്കുമെന്നും അവർ വാദിക്കുന്നു. ന്യൂയോർക്ക് ടൈംസിന്റെ കേസ് ഈ ആശങ്കയെ പ്രതിഫലിപ്പിക്കുന്നു: അനുമതിയില്ലാതെ ലേഖനങ്ങൾ ഉപയോഗിക്കുന്നത് പകർപ്പവകാശ ലംഘനമാണെന്ന് പത്രം അവകാശപ്പെടുന്നു. കോടതികൾ പത്രത്തിന്റെ പക്ഷം ചേരുകയാണെങ്കിൽ, എഐ ലാബുകൾക്ക് ഇൻജക്ഷനുകൾ നേരിടേണ്ടി വരും, അല്ലെങ്കിൽ കോടിക്കണക്കിന് വാക്കുകൾക്കായി പിൻകാല ലൈസൻസുകൾ എടുക്കേണ്ടി വരും—ഇത് ചെറിയ കമ്പനികളെ തകർക്കാൻ ശേഷിയുള്ള വലിയ സാമ്പത്തികവും ലോജിസ്റ്റിക്കൽ ആയതുമായ ഭാരമായിരിക്കും.
ഗവൺമെന്റിന് ഈ രണ്ട് വശങ്ങളെയും സന്തുലിതമാക്കുന്നതിൽ താൽപ്പര്യമുണ്ട്. ബ്രീഫ് എഐ വളർച്ചയെ പിന്തുണയ്ക്കുമ്പോൾ തന്നെ, ഒരു വ്യക്തമായ നിയമ ചട്ടക്കൂടിന്റെ ആവശ്യകതയും അത് പരോക്ഷമായി അംഗീകരിക്കുന്നു. അമിതമായി അനുമതി നൽകുന്ന വിധികൾ ക്രിയേറ്റീവ് മേഖലയിൽ നിന്ന് ശക്തമായ പ്രതിഷേധത്തിന് കാരണമായേക്കാം, ഇത് നിലവിലുള്ള തർക്കത്തേക്കാൾ കർശനമായ പുതിയ നിയമനിർമ്മാണത്തിന് വഴിയൊരുക്കിയേക്കാം.
എതിർവാദം: സർഗ്ഗാത്മക അവകാശങ്ങൾ സംരക്ഷിക്കുക
സർക്കാരിന്റെ നിലപാടിനെ വിമർശിക്കുന്നവർ ചൂണ്ടിക്കാട്ടുന്നത്, ഒരു വ്യവസായത്തിന്റെ മുഴുവൻ ഡാറ്റാ രീതികളെയും ഉൾക്കൊള്ളാൻ fair-use doctrine ഉദ്ദേശിച്ചിട്ടില്ല എന്നാണ്. വൻതോതിലുള്ള text ingestion എല്ലാം transformative ആയി കണക്കാക്കുന്നത് കോപ്പിറൈറ്റ് സംവിധാനത്തിന്റെ ഇൻസെന്റീവ് ഘടനയെ തകർക്കുന്ന ഒരു കീഴ്വഴക്കം സൃഷ്ടിക്കുമെന്ന് അവർ മുന്നറിയിപ്പ് നൽകുന്നു. കൂടാതെ, ട്രെയിനിംഗ് പ്രക്രിയ അനുവദനീയമാണെങ്കിൽ പോലും, ഡാറ്റ ശേഖരിക്കുന്ന രീതികൾ നിയമവിരുദ്ധമാകാം എന്ന് Anthropic സെറ്റിൽമെന്റ് തെളിയിക്കുന്നു. ഈ ഇരട്ട സ്വഭാവം സൂചിപ്പിക്കുന്നത് AI ഡെവലപ്പർമാർക്ക് വെറുമൊരു fair-use പ്രതിരോധത്തിൽ മാത്രം ആശ്രയിക്കാൻ കഴിയില്ല എന്നാണ്; അവരുടെ ഡാറ്റാ പൈപ്പ്ലൈനുകൾ നിയമപരമാണെന്ന് അവർ ഉറപ്പുവരുത്തുകയും വേണം.
ഇനി ശ്രദ്ധിക്കേണ്ട കാര്യങ്ങൾ
- കോടതി വിധികൾ: New York Times-ന്റെ അവകാശവാദത്തിൽ Southern District of New York ഒടുവിൽ ഒരു തീരുമാനം പുറപ്പെടുവിക്കും. ആ വിധി ഭാവിയിലെ AI സംബന്ധമായ കോപ്പിറൈറ്റ് കേസുകൾക്ക് ഒരു റഫറൻസ് പോയിന്റായി മാറിയേക്കാം.
- നിയമനിർമ്മാണ നീക്കങ്ങൾ: AI-ക്ക് അനുവദനീയമായ ഡാറ്റാ ഉപയോഗ രീതികൾ വ്യക്തമാക്കുന്ന നിയമങ്ങൾ രൂപീകരിച്ചുകൊണ്ട് നിയമനിർമ്മാതാക്കൾ കോടതിയുടെ നിർദ്ദേശങ്ങളോട് പ്രതികരിച്ചേക്കാം; ഇത് നിലവിലെ gray area-യെ കൂടുതൽ കർശനമാക്കുകയോ ലഘൂകരിക്കുകയോ ചെയ്തേക്കാം.
- വ്യവസായത്തിന്റെ പ്രതികരണം: AI കമ്പനികൾ അവരുടെ ഡാറ്റാ ശേഖരണ തന്ത്രങ്ങളിൽ മാറ്റം വരുത്തിയേക്കാം; ഒന്നുകിൽ കൂടുതൽ വിപുലമായ ലൈസൻസിംഗ് കരാറുകൾ തേടുകയോ അല്ലെങ്കിൽ കോപ്പിറൈറ്റ് ഉള്ള വിവരങ്ങൾ പൂർണ്ണമായും ഒഴിവാക്കി സ്വന്തമായി ഡാറ്റാസെറ്റുകൾ നിർമ്മിക്കുകയോ ചെയ്തേക്കാം.
ചുരുക്കത്തിൽ
Justice Department-ന്റെ amicus brief, Open AI കോപ്പിറൈറ്റ് പോരാട്ടത്തെ അമേരിക്കയുടെ AI ഭാവിക്ക് വേണ്ടിയുള്ള ഒരു പരോക്ഷ യുദ്ധമാക്കി മാറ്റുന്നു. LLM ട്രെയിനിംഗിനെ രാജ്യത്തിന്റെ മത്സരശേഷിക്ക് അത്യാവശ്യമായ ഒരു fair-use പ്രവർത്തനമായി ചിത്രീകരിക്കുന്നതിലൂടെ, നിയന്ത്രണാത്മകമായ കോപ്പിറൈറ്റ് വ്യാഖ്യാനങ്ങൾ ഒരു തന്ത്രപരമായ ബാധ്യതയാകാം എന്ന് സർക്കാർ സൂചിപ്പിക്കുന്നു. എങ്കിലും, സ്രഷ്ടാക്കളുടെ അവകാശങ്ങളും ഡെവലപ്പർമാരുടെ ആവശ്യങ്ങളും തമ്മിലുള്ള നിലവിലുള്ള സംഘർഷം കാരണം, നൂതനമായ കണ്ടുപിടുത്തങ്ങളും സർഗ്ഗാത്മകമായ സൃഷ്ടികളുടെ സംരക്ഷണവും തമ്മിൽ സന്തുലിതാവസ്ഥ നിലനിർത്തുന്ന ഒരു പരിധി കോടതികളും ഒരുപക്ഷേ കോൺഗ്രസും നിശ്ചയിക്കേണ്ടി വരും.
