ஒரு பாதுகாப்பு ஆராய்ச்சியாளர், ஒரு தீங்கிழைக்கும் (rogue) LLM endpoint, AI மூலம் இயங்கும் கோடிங் ஏஜென்ட்டின் (coding agent) கட்டுப்பாட்டைப் பறித்து, உள்ளூர் கோப்புகளைத் திருட முடியும் என்பதைக் காட்டியுள்ளார். ஒரு proof-of-concept சோதனையில், கோடிங் உதவியாளர் 224 KB அளவுள்ள ஒரு session-ஐ—டைரக்டரி பட்டியல்கள், tool manifests மற்றும் தனிப்பட்ட கோப்பு உள்ளடக்கங்கள்—இலவச AI back-ends மத்தியில் விளம்பரப்படுத்தப்பட்ட ஒரு போலியான “DeepSeek-compatible” API-க்கு பதிவேற்றியது.

இந்தத் திருட்டு எவ்வாறு செயல்படுகிறது

ஸ்கேனர்கள் முதலில் வெளிப்படையான ஒரு LLM honeypot-ஐக் கண்டறிந்தன. தாக்குபவர்கள் அந்த honeypot-ஐ ஒரு முறையான DeepSeek endpoint என்று மறுபெயரிட்டு, பிற இலவச சேவைகளுடன் பட்டியலிட்டனர். ஒரு டெவலப்பரின் கோடிங் ஏஜென்ட் "இலவச" அணுகலுக்காக இந்த endpoint-ஐத் தேர்ந்தெடுக்கும்போது, அந்தத் தீங்கிழைக்கும் மாடல் ஏஜென்ட்டின் கட்டுப்பாட்டுத் தளத்தைக் (plane) கைப்பற்றுகிறது. அது tool-call அறிவுறுத்தல்களை அனுப்புகிறது, அவற்றை ஏஜென்ட் அதன் மூலத்தை சரிபார்க்காமல் செயல்படுத்துகிறது. பின்னர் ஏஜென்ட் தனது உள் session தரவுகளை—filesystem snapshots, tool configurations மற்றும் திறக்கப்பட்ட எந்தவொரு கோப்புகளையும்—நேரடியாகத் தாக்குபவரின் சர்வருக்கு அனுப்புகிறது.

இது ஏன் ஒரு சப்ளை-செயின் (supply-chain) அச்சுறுத்தல்

இந்தத் தாக்குதல் எந்தவொரு நம்பகமான கிளவுட் வழங்குதலையும் (cloud provider) கடந்து செல்கிறது. அதற்குப் பதிலாக, இது டெவலப்பரின் toolchain-க்குள் ஒரு போலியான reasoning backend-ஐச் செலுத்துகிறது. இலவச API அணுகலைத் தேடும் பயனர்கள் அறியாமலேயே மிக பலவீனமான இணைப்பாக மாறிவிடுகிறார்கள். தீங்கிழைக்கும் endpoint மூலம் ஏதேனும் ஒரு tool call-ஐ வழங்க முடியும் என்பதால், ஏஜென்ட் அணுகக்கூடிய எந்தவொரு தரவையும் அது திருட முடியும், இது டெவலப்பரின் கணினியை ஒரு தரவு கசிவு வழிப்பாதையாக (data-leak conduit) மாற்றுகிறது.

யார் பாதிக்கப்படலாம்

AI கோடிங் உதவியாளர்களுக்காக வெளிப்புற LLM endpoints-களை நம்பியிருப்பவர்கள்—குறிப்பாக தானாகவே tool calls-களைச் செயல்படுத்தும் ஏஜென்ட்கள்—பாதிப்புக்குள்ளாகலாம். சிறிய குழுக்கள் மற்றும் பொழுதுபோக்கு ஆர்வலர்கள் மிகவும் பாதிக்கப்படக்கூடியவர்கள்; அவர்கள் கடுமையான சரிபார்ப்பு இன்றி இலவச சேவைகளைப் பயன்படுத்துகின்றனர். CI/CD pipelines-களில் இத்தகைய ஏஜென்ட்களைப் பயன்படுத்தும் நிறுவனங்கள், தங்கள் உள்நிலை codebase-கள் மற்றும் configuration கோப்புகளைத் திருட வழிவகுக்கலாம், இது இணக்கத்தன்மைக்கு (compliance) ஆபத்தை விளைவிக்கும்.

தணிப்பு நடவடிக்கைகள்

  • Back-ends-ஐ சரிபார்க்கவும்: அதிகாரப்பூர்வமாக ஆவணப்படுத்தப்பட்ட மற்றும் அங்கீகரிக்கப்பட்ட LLM endpoints உடன் மட்டுமே கோடிங் ஏஜென்ட்களை இணைக்கவும்.
  • Runtime சோதனைகளை அமல்படுத்தவும்: tool-call payloads உள்ளூர் இயங்கு சூழலை (local execution environment) சென்றடைவதற்கு முன் அவற்றைச் சரிபார்க்கும் ஒரு சரிபார்ப்பு அடுக்கைச் சேர்க்கவும்.
  • கோப்பு அணுகலைக் கட்டுப்படுத்தவும்: தேவையான குறைந்தபட்ச filesystem அனுமதிகளுடன் கூடிய sandboxed containers-களில் ஏஜென்ட்களை இயக்கவும்.
  • Audit logs: ஏஜென்ட்களிலிருந்து வெளியேறும் கோரிக்கைகள் (outbound requests) எதிர்பாராத இடங்களுக்கோ அல்லது தரவு அளவுகளுக்கோ செல்கிறதா என்பதைத் தொடர்ந்து கண்காணிக்கவும்.

மாற்றுக்கருத்து

இலவச API சலுகைகள் AI-உதவி டெவலப்மென்ட் செய்வதற்கான தடைகளைக் குறைக்கின்றன, மேலும் பல பயனர்கள் செலவு மற்றும் பாதுகாப்பு இடையிலான சமரசத்தை ஏற்றுக்கொள்கிறார்கள். இருப்பினும், தனிப்பட்ட கோப்புகள் திருடப்படுவதைக் காட்டிய இந்தச் சம்பவம், குறிப்பாகத் தனியுரிமக் குறியீடு (proprietary code) அல்லது credentials ஆபத்தில் இருக்கும்போது, இந்த ஆபத்து சேமிப்பை விட மிக வேகமாக அதிகமாகிவிடும் என்பதைக் காட்டுகிறது.

முக்கியக் கருத்து: Free LLM endpoints ஒரு மறைமுகச் செலவைக் கொண்டுள்ளன—அது சாத்தியமான தரவுத் திருட்டு. AI கோடிங் ஏஜென்ட்களை உள்ளூரில் இயக்க அனுமதிக்கும் முன், ஒவ்வொரு backend-ஐயும் சரிபார்க்கவும் மற்றும் கடுமையான runtime பாதுகாப்புகளை அமல்படுத்தவும்.

விவரங்களுக்கு முழுமையான தொழில்நுட்ப அறிக்கையைப் படிக்கவும்: https://gridthegrey.com/posts/rogue-llm-endpoint-hijacks-coding-agent-sessions-via-free-api/