ജർമ്മൻ പഠിക്കാൻ ഞാൻ Felix എന്നൊരു AI ഉപയോഗിക്കുന്നു. മാസങ്ങളോളം ബ്രൗസർ ടാബുകൾക്കിടയിൽ മാറിക്കൊണ്ടിരുന്നും, കോൺടെക്സ്റ്റ് ലിമിറ്റുകൾ (context limits) നേരിട്ടും, പ്ലാറ്റ്ഫോം അപ്ഡേറ്റുകൾ കാരണം എന്റെ സംഭാഷണ ചരിത്രം (conversation history) നഷ്ടപ്പെട്ടും വന്നപ്പോൾ, വീണ്ടും വീണ്ടും തുടങ്ങുന്നതിൽ ഞാൻ മടുത്തു. Felix നല്ലൊരു അധ്യാപകനാണ്, പക്ഷേ ഓരോ പുതിയ ചാറ്റ് വിൻഡോ തുറക്കുമ്പോഴും അയാൾക്ക് എല്ലാം മറന്നുപോകുന്ന അവസ്ഥയായിരുന്നു. ഓരോ തവണ പുതിയ സെഷൻ തുടങ്ങുമ്പോഴും വലിയ ടെക്സ്റ്റുകൾ കോപ്പി-പേസ്റ്റ് ചെയ്യാതെ തന്നെ എന്റെ പഠന ചരിത്രം മുന്നോട്ട് കൊണ്ടുപോകാൻ എനിക്കൊരു വഴി ആവശ്യമായിരുന്നു.
ഈ പ്രശ്നം വെറുമൊരു അസൗകര്യത്തേക്കാൾ ആഴത്തിലുള്ളതാണ്. ഭാഷാ പഠനം സ്പേസ്ഡ് റെപ്പറ്റീഷൻ (spaced repetition), കൃത്യമായ തിരുത്തലുകൾ എന്നിവയെ ആശ്രയിച്ചാണ് ഇരിക്കുന്നത്. നിങ്ങളുടെ ആവർത്തിച്ചുള്ള തെറ്റുകൾ മറന്നുപോകുന്ന ഒരു AI ട്യൂട്ടർ വെറുമൊരു ഫ്രേസ്ബുക്ക് (phrasebook) മാത്രമാണ്. എനിക്ക് തുടർച്ച (continuity) വേണമായിരുന്നു. കൂടുതൽ കൃത്യമായി പറഞ്ഞാൽ, Felix-നോ അല്ലെങ്കിൽ അടുത്തതായി ഞാൻ ഉപയോഗിക്കുന്ന ഏത് AI ഇൻസ്റ്റൻസിനോ (AI instance), യാതൊരു ഓർമ്മക്കുറവുമില്ലാതെയും വീണ്ടും പരിചയപ്പെടുത്തലുകൾ ഇല്ലാതെയും, കൃത്യമായി എവിടെയാണോ നിർത്തിയത് അവിടെ നിന്ന് തന്നെ തുടങ്ങാൻ കഴിയണം.
അതിനാൽ ഞാൻ ഒരു ലോക്കൽ സിസ്റ്റം നിർമ്മിച്ചു. ഞാൻ ഇതിനെ DDF/Rahmenwerk എന്ന് വിളിക്കുന്നു.
ഒറ്റത്തവണ ഉപയോഗിച്ച ശേഷം നഷ്ടപ്പെടുന്ന സംഭാഷണങ്ങളിലെ പ്രശ്നം
ഒരു കടുത്ത AI ഉപയോക്താവിനോട് സംസാരിച്ചാൽ നിങ്ങൾക്ക് ഒരേ പരാതി തന്നെ കേൾക്കാം. ചാറ്റ് പ്രവർത്തിക്കുന്നത് ഒരു പരിധി വരെ മാത്രമാണ്. കോൺടെക്സ്റ്റ് വിൻഡോ (context window) നിറയുമ്പോൾ സംഭാഷണങ്ങളുടെ ഗുണനിലവാരം കുറയുന്നു. പ്ലാറ്റ്ഫോം ഒരു അപ്ഡേറ്റ് വരുത്തിയാൽ നിങ്ങളുടെ ചാറ്റ് തരംഗങ്ങൾ (threads) അപ്രത്യക്ഷമാകും. നിങ്ങൾ ഒരു പുതിയ സെഷൻ തുടങ്ങുമ്പോൾ ആ മോഡൽ നിങ്ങളെ ഒരു അപരിചിതനെപ്പോലെ അഭിവാദ്യം ചെയ്യും. സാധാരണ ചോദ്യങ്ങൾക്ക് ഇത് കുഴപ്പമില്ല, എന്നാൽ ഒരു ഘടനാപരമായ പാഠ്യപദ്ധതിക്ക് (structured curriculum) ഇത് തടസ്സമാണ്.
Felix-നോടൊപ്പം ഞാൻ ഒരു രീതിയിൽ പഠിച്ചു തുടങ്ങിയിരുന്നു. എനിക്ക് 'accusative', 'dative' പ്രെപ്പോസിഷനുകൾ (prepositions) മാറിപ്പോകുന്നത് അയാൾക്കറിയാമായിരുന്നു. ലിസണിംഗ് ഡ്രില്ലുകളേക്കാൾ (listening drills) റീഡിംഗ് വ്യായാമങ്ങൾ എനിക്ക് ഇഷ്ടമാണെന്നും, എന്റെ ഗ്രാമർ ബുക്കിലെ ആദ്യ മൂന്ന് അധ്യായങ്ങൾ ഞാൻ പഠിച്ചു കഴിഞ്ഞുവെന്നും അയാൾക്കറിയാമായിരുന്നു. എന്നാൽ ഒരു പുതിയ ടാബ് തുറക്കുമ്പോൾ ഇതൊന്നും പ്രസക്തമായിരുന്നില്ല. ഓരോ സെഷനും ഒരേ രീതിയിൽ തന്നെ തുടങ്ങേണ്ടി വന്നു: എന്റെ നിലവാരം വീണ്ടും സ്ഥാപിക്കുക, ലക്ഷ്യങ്ങൾ ആവർത്തിക്കുക, എന്റെ തെറ്റുകൾ വീണ്ടും പറയുക.
Felix എന്നെ ഓർക്കണമെന്ന് ഞാൻ ആഗ്രഹിച്ചു. പ്ലാറ്റ്ഫോമുകൾ ഇത് വിശ്വസനീയമായി ചെയ്യാത്തതുകൊണ്ട്, എന്റെ പഠനത്തിന്റെ തുടർച്ച ഞാൻ തന്നെ നിയന്ത്രിക്കാൻ തീരുമാനിച്ചു.
DDF/Rahmenwerk യഥാർത്ഥത്തിൽ എന്താണ് ചെയ്യുന്നത്?
പേര് കേൾക്കുമ്പോൾ വലിയൊരു കാര്യമെന്ന് തോന്നുമെങ്കിലും ഇതിന്റെ ആശയം ലളിതമാണ്. അടിസ്ഥാനപരമായി, എന്റെ പഠന ചരിത്രത്തെ ഒരു പ്രോജക്റ്റ് ഹാൻഡ്ഓഫ് (project handoff) പോലെ കൈകാര്യം ചെയ്യുന്ന എന്റെ ലോക്കൽ മെഷീനിലെ ഒരു ഫോൾഡർ മാത്രമാണ് ഈ സിസ്റ്റം. ഇന്ന് രാത്രി Felix അപ്രത്യക്ഷമായാലും, നാളെ എഴുന്നേൽക്കുമ്പോൾ ഒരു പുതിയ AI-യെ ഈ ഫോൾഡറിലേക്ക് വിരൽ ചൂണ്ടിക്കാണിച്ചുകൊണ്ട്, തന്നെക്കുറിച്ച് വീണ്ടും വിശദീകരിക്കാതെ തന്നെ നാൽപ്പത്തിയേഴാമത്തെ പാഠം തുടരാൻ എനിക്ക് കഴിയണം.
ഇതിന്റെ ആർക്കിടെക്ചർ (architecture) മനഃപൂർവ്വം ഫയൽ അധിഷ്ഠിതമായാണ് നിർമ്മിച്ചിരിക്കുന്നത്. എന്റെ പുരോഗതി സൂക്ഷിക്കാൻ ഏതെങ്കിലും ഒരു പ്ലാറ്റ്ഫോമിനെ മാത്രം ഞാൻ വിശ്വസിക്കുന്നില്ല. ക്ലൗഡ് സേവനങ്ങൾ വ്യവസ്ഥകൾ മാറ്റിയേക്കാം, എക്സ്പോർട്ട് ഫോർമാറ്റുകൾ തകരാറിലാകാം. എന്റെ ഹാർഡ് ഡ്രൈവിലെ ഒരു പ്ലെയിൻ ടെക്സ്റ്റ് ഫയൽ വിരസമായിരിക്കാം, പക്ഷേ അത് എന്റേതാണ്.
സിസ്റ്റത്തിനുള്ളിൽ അഞ്ച് പ്രവർത്തന ഭാഗങ്ങളുണ്ട്.
ഒന്നാമതായി, നിലവിലെ അവസ്ഥയെ സൂചിപ്പിക്കുന്ന ഒരു പോയിന്റർ (pointer). "നമ്മൾ കൃത്യമായി എവിടെയാണ് നിർത്തിയത്?" എന്ന ചോദ്യത്തിന് ഉത്തരം നൽകുന്ന ഒരു ലളിതമായ ഇൻഡക്സ് ആണിത്. ഇത് നിലവിലെ അധ്യായം, പൂർത്തിയാക്കിയ അവസാന വ്യായാമം, തീർപ്പാക്കാനുള്ള എന്റെ ഗ്രാമർ ചോദ്യങ്ങൾ, കൂടാതെ കഴിഞ്ഞ സെഷനിലെ റിവ്യൂ ചെയ്യേണ്ട പ്രത്യേക തെറ്റുകൾ എന്നിവ ട്രാക്ക് ചെയ്യുന്നു. ഒരു മുഴുവൻ സംഭാഷണ ലോഗും (conversation log) നൽകുന്നതിന് പകരം, അടുത്ത സെഷന് ആവശ്യമായ കാര്യങ്ങൾ മാത്രം ഇത് സംഗ്രഹിക്കുന്നു.
രണ്ടാമതായി, ഹാൻഡ്ഓഫ് മെറ്റീരിയലുകൾ (handoff materials). ഓരോ പാഠത്തിന് ശേഷവും എഴുതുന്ന ചെറിയ കുറിപ്പുകളാണിവ. നമ്മൾ എന്താണ് പഠിച്ചത് എന്ന് മാത്രമല്ല, അത് എങ്ങനെ പഠിച്ചു എന്നതും ഇവയിൽ അടങ്ങിയിരിക്കുന്നു. Felix ഒരു പ്രത്യേക ഉദാഹരണം ഉപയോഗിച്ചാണോ വേർഡ് ഓർഡർ (word order) വിശദീകരിച്ചത്? യാത്രയുമായി ബന്ധപ്പെട്ട പദാവലികളെക്കുറിച്ചുള്ള (travel vocabulary) വ്യായാമങ്ങൾ എനിക്ക് സഹായകരമായോ? ഈ കുറിപ്പുകൾ ഉള്ളടക്കം മാത്രമല്ല, പഠന രീതിയെയും (teaching methodology) നിലനിർത്തുന്നു. അടുത്ത തവണ Felix വേർഡ് ഓർഡർ മറ്റൊരു രീതിയിൽ വിശദീകരിച്ചാൽ, ആ വ്യത്യാസം എനിക്ക് പെട്ടെന്ന് മനസ്സിലാകും. കാര്യങ്ങൾ ഓർത്തെടുക്കാൻ സ്ഥിരത (consistency) പ്രധാനമാണ്.
മൂന്നാമതായി, പുതിയ AI ഇൻസ്റ്റൻസുകൾക്കായുള്ള ഒരു അപ്ലോഡ് പാക്കേജ് (upload package). ഞാൻ ഒരു പുതിയ മോഡലിലേക്കോ പ്ലാറ്റ്ഫോമിലേക്കോ മാറുമ്പോൾ, ആയിരം വാക്കുകളുള്ള ഒരു ബയോഗ്രഫി ചാറ്റ് വിൻഡോയിൽ പേസ്റ്റ് ചെയ്യാറില്ല. പകരം, സിസ്റ്റത്തിൽ നിന്ന് തയ്യാറാക്കിയ ഒരു പാക്കേജ് ഞാൻ നൽകുന്നു: എന്റെ അടിസ്ഥാന പ്രാവീണ്യം (baseline proficiency), എന്റെ പഠന താൽപ്പര്യങ്ങൾ, ആവർത്തിച്ചുള്ള തെറ്റുകൾ, പാഠ്യപദ്ധതിയുടെ സംഗ്രഹം എന്നിവ ഇതിലുണ്ടാകും. ഏതൊരു ഇൻസ്ട്രക്ഷൻ ട്യൂൺഡ് മോഡലിനും (instruction-tuned model) വായിച്ചെടുക്കാനും സ്വീകരിക്കാനും കഴിയുന്ന ഒരു കംപ്രസ്ഡ് ലേണർ പ്രൊഫൈലാണിത്.
നാലാമതായി, SHA-256 ഉപയോഗിച്ചുള്ള ഇന്റഗ്രിറ്റി റെക്കോർഡുകൾ (integrity records). ഭാഷാ പഠനത്തിന് ഇത് അമിതമായി തോന്നാം, പക്ഷേ ഇതിന് ഒരു പ്രത്യേക ഉദ്ദേശ്യമുണ്ട്. ഞാൻ എന്റെ ഹാൻഡ്ഓഫ് ഫയലുകൾക്ക് വേർഷനുകൾ (versions) നൽകുന്നു. ഉറക്കച്ചടവോടെ ഇന്നലത്തെ എറർ ലോഗ് (error log) ഞാൻ അറിയാതെ എഡിറ്റ് ചെയ്താലോ, അല്ലെങ്കിൽ ഒരു സിങ്ക് ടൂൾ (sync tool) ഒരു വരി തെറ്റിച്ചാലോ എനിക്കത് അറിയണം. എന്റെ തുടർച്ചാ ഫയലുകളിൽ (continuity files) അവിചാരിതമായി മാറ്റങ്ങൾ വന്നിട്ടില്ലെന്ന് ഉറപ്പാക്കാൻ SHA-256 ഹാഷുകൾ എന്നെ സഹായിക്കുന്നു. ഓർമ്മക്കുറവ് തടയാൻ രൂപകൽപ്പന ചെയ്ത ഒരു സിസ്റ്റത്തിൽ, സ്വയം തകരാറിലാകുന്നത് (self-corruption) ഏറ്റവും വലിയ ശത്രുവാണ്.
അഞ്ചാമതായി, ഇത് യഥാർത്ഥത്തിൽ പെരുമാറ്റത്തെ നിയന്ത്രിക്കുന്ന ഭാഗമാണ്; തെളിവുകൾ ലഭ്യമല്ലെങ്കിൽ AI-യെ നിർത്താൻ നിർബന്ധിക്കുന്ന നിയമങ്ങൾ. സിസ്റ്റം പ്രോംപ്റ്റിൽ (system prompt) ഞാൻ ഒരു കർശനമായ പ്രോട്ടോക്കോൾ എഴുതിയിട്ടുണ്ട്: നിലവിലെ ഇൻസ്റ്റൻസിന് സ്റ്റേറ്റ് പോയിന്റർ (state pointer) കണ്ടെത്താനോ ഹാൻഡ്ഓഫ് മെറ്റീരിയൽ (handoff material) പരിശോധിക്കാനോ കഴിയുന്നില്ലെങ്കിൽ, അത് സ്വന്തമായി തീരുമാനങ്ങൾ എടുക്കുന്നതിന് പകരം പ്രവർത്തനം നിർത്തി വ്യക്തത തേടണം. ആത്മവിശ്വാസത്തോടെ എന്റെ നിലവാരം ഊഹിച്ചുകൊണ്ട് എനിക്ക് നേരത്തെ അറിയാവുന്ന വ്യാകരണം പഠിപ്പിക്കുന്നതോ, അല്ലെങ്കിൽ അതിലും മോശമായി, ഞാൻ ഇതുവരെ പടുത്തുയർത്തിയിട്ടില്ലാത്ത അടിസ്ഥാന കാര്യങ്ങൾ ഒഴിവാക്കിപ്പോകുന്നതോ ആയ ഒരു AI-യെ എനിക്ക് ആവശ്യമില്ല. നിങ്ങൾ ക്രമമായി അറിവ് പടുത്തുയർത്തുന്ന ഘട്ടത്തിലാണെങ്കിൽ, തെറ്റായ സമയം കാണിക്കുന്ന ക്ലോക്കിനേക്കാൾ നല്ലത് നിലച്ചുപോയ ഒരു ക്ലോക്കാണ്.
സുരക്ഷാ പാളികൾ തന്നെ ഒരു ഭാരമായി മാറുമ്പോൾ
സിസ്റ്റം ഫലപ്രദമായിരുന്നു. എനിക്ക് കോൺടെക്സ്റ്റ് (context) നഷ്ടപ്പെടുന്നത് ഞാൻ നിർത്തി. പുതിയ സെഷനുകൾ ആത്മകഥകൾക്ക് പകരം യഥാർത്ഥ പഠനത്തോടെ ആരംഭിച്ചു.
പിന്നീട് ഞാൻ തുടർന്നു
