ஏன் AI சூழல் சுருக்கம் (Context Compression) உங்கள் அறிவுறுத்தல்களை அமைதியாகப் புறக்கணிக்கிறது

Large Language Models (LLMs) உடனான உரையாடல்கள் நீlengும் போது, டோக்கன் வரம்புகளை (token limits) நிர்வகிக்கவும், செயல்திறன் தடைகளைத் தவிர்க்கவும் டெவலப்பர்கள் "context compression" அல்லது சுருக்க முறையை அதிகம் நம்பியிருக்கிறார்கள். இருப்பினும், இந்த மேம்படுத்தலில் உள்ள ஒரு முக்கியமான குறைபாட்டைப் புதிய ஆராய்ச்சி வெளிப்படுத்துகிறது: இடத்தைச் சேமிக்க AI அமைப்புகள் உரையாடல் வரலாற்றைச் சுருக்கும்போது, அவை தங்கள் நடத்தையை வழிநடத்த வேண்டிய விதிகளைத் துரிதமாகத் தூக்கி எறிந்துவிடுகின்றன.

அமர்வு கட்டுப்பாடுகளின் (Session Constraints) பலவீனம்

ஒரு AI அமைப்பு சுருக்கத்திற்கு உள்ளாகும் போது, அதன் முதன்மை நோக்கம் பணியின் தொடர்ச்சியைப் பாதுகாப்பதே ஆகும்—அதாவது இலக்கு, தற்போதைய நிலை மற்றும் தேவையான அடுத்தடுத்த படிகளைத் தக்கவைத்தல். இது உரையாடலின் "என்ன" (what) என்பதைப் பாதுகாத்தாலும், அது "எப்படி" (how) என்பதைப் பல நேரங்களில் தியாகம் செய்துவிடுகிறது.

Penn State ஆராய்ச்சியாளர்கள், இந்தச் செயல்பாட்டில் "session constraints" (அமர்வு கட்டுப்பாடுகள்) தான் முதலில் பாதிக்கப்படுபவை என்பதைக் கண்டறிந்துள்ளனர். இவை பயனரால் விதிக்கப்படும் தற்காலிக விதிகள், உதாரணமாக "உங்கள் பதில்களில் எனது பெயரைப் பயன்படுத்த வேண்டாம்" அல்லது "எந்த மாற்றங்களைச் செய்வதற்கு முன்பும் என்னிடம் உறுதிப்படுத்திக் கொள்ளவும்." இந்த அறிவுறுத்தல்கள் முக்கிய பணி அல்லது நிரந்தர சிஸ்டம் பிராம்ப்ட்டின் (system prompt) ஒரு பகுதியாக இல்லாததால், சுருக்க அல்காரிதம்கள் (compression algorithms) இவற்றைத் இரண்டாம் நிலைத் தகவல்களாகக் கருதி, அதிகத் தொடர்புடைய தரவுகளுக்கு இடமளிப்பதற்காக அவற்றை நீக்கிவிடுகின்றன.

COMPINT கண்டுபிடிப்புகள்: 17% உயிர்வாழும் விகிதம்

இந்தச் சிதைவை அளவிட, ஆராய்ச்சியாளர்கள் COMPINT மதிப்பீட்டுத் தொகுப்பை உருவாக்கினர். அதன் முடிவுகள் அதிர்ச்சியளிக்கின்றன: சராசரியாக, சேர்க்கப்பட்ட அமர்வு கட்டுப்பாடுகளில் 17 சதவீதம் மட்டுமே சுருக்கச் செயல்பாட்டில் தப்பிப்பிழைக்கின்றன.

விதிகளுக்குக் கீழ்ப்படிவதில் ஏற்பட்டுள்ள குறிப்பிடத்தக்க வீழ்ச்சியை இந்த ஆய்வு சுட்டிக்காட்டுகிறது. ஒரு ஏஜென்ட் (agent) முழுமையான, சுருக்கப்படாத சூழலை அணுகும்போது, கீழ்ப்படிதல் விகிதங்கள் பொதுவாக 59% முதல் 71% வரை இருக்கும். சுருக்கம் செய்யப்பட்டவுடன், கீழ்ப்படிதல் விகிதம் கடுமையாகக் குறைகிறது, பெரும்பாலும் எந்தக் கட்டுப்பாடும் வழங்கப்படாத சூழலுக்கு இணையான நிலைக்குத் தள்ளப்படுகிறது.

இது வெறும் உரையாடல் நுணுக்கங்களைப் பற்றிய விஷயம் மட்டுமல்ல; இது ஒரு பெரிய பாதுகாப்பு மற்றும் நம்பகத்தன்மை அபாயமாகும். Agentic workflows-இல், "அனுமதியின்றி குறியீட்டை (code) இயக்க வேண்டாம்" போன்ற ஒரு கட்டுப்பாடு இழக்கப்படுவது, அங்கீகரிக்கப்படாத கருவி அழைப்புகள் (tool calls), தரவு கசிவுகள் அல்லது காலண்டர் அல்லது மின்னஞ்சல் போன்ற வெளிப்புற அமைப்புகளில் சரிபார்க்கப்படாத மாற்றங்களுக்கு வழிவகுக்கலாம்.

Qwen3.5-9B மூலம் ஒரு இலகுரகத் தீர்வு

பெரிய AI ஆய்வகங்களால் பயன்படுத்தப்படும் சிக்கலான சுருக்க தர்க்கத்தை (compression logic) முழுமையாக மாற்றியமைப்பதற்குப் பதிலாக, ஆராய்ச்சியாளர்கள் ஒரு "plug-and-play" கட்டமைப்புத் தீர்வை முன்மொழிகிறார்கள். அவர்கள் ஒரு சிறப்புப் பிரித்தெடுக்கும் கருவியாக (specialized extractor) செயல்படும் வகையில் Qwen3.5-9B மாதிரியை அடிப்படையாகக் கொண்ட ஒரு சிறிய கூடுதல் தொகுதியை (add-on module) உருவாக்கினர்.

இந்தத் தொகுதி பின்வருமாறு செயல்படுகிறது:

  1. அமர்வு கட்டுப்பாடுகளைக் கண்டறிந்து தனிமைப்படுத்த, ஒவ்வொரு பயனர் உள்ளீட்டையும் நிகழ்நேரத்தில் (real-time) ஸ்கேன் செய்தல்.
  2. இந்த விதிகளின் பிரத்யேகமான, சுதந்திரமான பட்டியலைப் பராமரித்தல்.
  3. முக்கிய அமைப்பு சுருக்கத்தைச் செய்யும்போது இந்தச் சுருக்கப்பட்ட பட்டியலைச் சுருக்கத்துடன் (summary) இணைத்தல்.

இந்த அணுகுமுறையின் முடிவுகள் மிகவும் பயனுள்ளதாக உள்ளன. பல்வேறு சோதனைச் சூழல்களில், இந்த பிரித்தெடுப்பான் (extractor) 90 சதவீதத்திற்கும் அதிகமான தக்கவைப்பு விகிதத்தை (retention) எட்டியது; இதில் ஏஜென்ட் பாதைகளுக்கான (agent trajectories) 95.6% மற்றும் பலமுறை உரையாடல்களுக்கான (multi-turn chats) 90.3% வெற்றி விகிதம் அடங்கும். இந்த முறை முதன்மை மாதிரியை மீண்டும் பயிற்றுவிக்கத் தேவையில்லை மற்றும் தற்போதுள்ள சுருக்கக் கட்டமைப்பில் எந்த மாற்றமும் தேவையில்லை என்பதால், இது மிகவும் நம்பகமான நீண்ட-சூழல் (long-context) AI தொடர்புகளை நோக்கிய ஒரு அளவிடக்கூடிய (scalable) பாதையை வழங்குகிறது.

முக்கியக் குறிப்புகள்

  • கட்டுப்பாடுகள் நீக்கப்படுதல் (Constraint Erasure): சூழல் சுருக்கம் (Context compression) நடத்தை விதிகளை விடப் பணி இலக்குகளுக்கே முன்னுரிமை அளிக்கிறது, இதனால் பயனர் விதித்த பெரும்பாலான "அமர்வு கட்டுப்பாடுகள்" சுருக்கத்தின் போது இழக்கப்படுகின்றன.
  • பாதுகாப்பு அபாயங்கள் (Security Risks): மனிதத் தலையீடு (human-in-the-loop) சரிபார்ப்பு போன்ற அறிவுறுத்தல்கள் இழக்கப்படுவது, அங்கீகரிக்கப்படாத ஏஜென்ட் செயல்பாடுகள் மற்றும் பாதுகாப்பிற்குப் பாதிப்பை ஏற்படுத்தக்கூடும்.
  • தொகுப்புத் தீர்வுகள் (Modular Fixes): கட்டுப்பாடுகளைத் தனித்தனியாகக் கண்காணிக்க Qwen3.5-9B போன்ற ஒரு சிறிய, சிறப்பு மாதிரியைப் பயன்படுத்துவதன் மூலம் அறிவுறுத்தல்களைத் தக்கவைக்கும் விகிதத்தை 90%-க்கும் மேல் மீட்டெடுக்க முடியும்.