ఒక సెక్యూరిటీ రీసెర్చర్, ఒక అనుచితమైన (rogue) LLM ఎండ్పాయింట్ AI-ఆధారిత కోడింగ్ ఏజెంట్ను హైజాక్ చేసి, లోకల్ ఫైళ్లను దొంగిలించగలదని నిరూపించారు. ఒక ప్రూఫ్-ఆఫ్-కాన్సెప్ట్లో, కోడింగ్ అసిస్టెంట్ 224 KB సెషన్ను—డైరెక్టరీ లిస్టింగ్స్, టూల్ మేనిఫెస్ట్లు మరియు ప్రైవేట్ ఫైల్ కంటెంట్లను—ఉచిత AI బ్యాక్-ఎండ్ల మధ్య ప్రకటన చేయబడిన నకిలీ “DeepSeek-compatible” APIకి అప్లోడ్ చేసింది.
హైజాక్ ఎలా జరుగుతుంది
స్కాన్నర్లు మొదట ఒక ఎక్స్పోజ్డ్ LLM హనీపాట్ను కనుగొన్నారు. దాడి చేసేవారు ఆ హనీపాట్ను చట్టబద్ధమైన DeepSeek ఎండ్పాయింట్గా మార్చి, ఇతర ఉచిత సేవలతో కలిపి జాబితా చేశారు. ఒక డెవలపర్ యొక్క కోడింగ్ ఏజెంట్ "ఉచిత" యాక్సెస్ కోసం ఈ ఎండ్పాయింట్ను ఎంచుకున్నప్పుడు, ఆ అనుచితమైన మోడల్ ఏజెంట్ యొక్క ప్లాన్ను తన ఆధీనంలోకి తీసుకుంటుంది. ఇది టూల్-కాల్ సూచనలను పంపుతుంది, వాటి మూలాన్ని (source) తనిఖీ చేయకుండానే ఏజెంట్ వాటిని అమలు చేస్తుంది. ఆ తర్వాత ఏజెంట్ తన అంతర్గత సెషన్ డేటాను—ఫైల్సిస్టమ్ స్నాప్షాట్లు, టూల్ కాన్ఫిగరేషన్లు మరియు తెరిచిన ఏవైనా ఫైళ్లను—నేరుగా దాడి చేసేవారి సర్వర్కు స్ట్రీమ్ చేస్తుంది.
ఇది ఎందుకు సప్లై-చైన్ ముప్పు (supply-chain threat)
ఈ దాడి ఏ నమ్మకమైన క్లౌడ్ ప్రొవైడర్ను కూడా దాటవేస్తుంది. దానికి బదులుగా, ఇది డెవలపర్ యొక్క టూల్చైన్లోకి ఒక నకిలీ రీజనింగ్ బ్యాకెండ్ను ఇంజెక్ట్ చేస్తుంది. ఉచిత API యాక్సెస్ కోసం వెతికే వినియోగదారులు తెలియకుండానే అత్యంత బలహీనమైన లింక్గా మారుతారు. ఈ మాలిషియస్ ఎండ్పాయింట్ ఏవైనా టూల్ కాల్స్ను జారీ చేయగలదు కాబట్టి, ఏజెంట్ చేరుకోగల ఏ డేటానైనా ఇది దొంగిలించగలదు (exfiltrate), తద్వారా డెవలపర్ యొక్క మెషీన్ను డేటా-లీక్ కనార్ట్గా మారుస్తుంది.
ఎవరు ప్రమాదంలో ఉన్నారు
AI కోడింగ్ అసిస్టెంట్ల కోసం బాహ్య LLM ఎండ్పాయింట్లపై ఆధారపడే ఎవరైనా—ముఖ్యంగా టూల్ కాల్స్ను ఆటోమేటిక్గా అమలు చేసే వాటిని ఉపయోగించేవారు—ప్రమాదంలో ఉన్నారు. చిన్న బృందాలు మరియు హాబీయిస్టులు అత్యంత ప్రమాదంలో ఉన్నారు; వారు కఠినమైన పరిశీలన లేకుండా ఉచిత సేవలను స్వీకరిస్తారు. తమ CI/CD పైప్లైన్లలో ఇటువంటి ఏజెంట్లను అనుసంధానించిన సంస్థలు (Enterprises), తమ అంతర్గత కోడ్బేస్లు మరియు కాన్ఫిగరేషన్ ఫైళ్లను లీక్ చేసే అవకాశం ఉంది, ఇది నిబంధనల (compliance) అమలును దెబ్బతీస్తుంది.
నివారణ చర్యలు
- బ్యాక్-ఎండ్లను ధృవీకరించండి: కోడింగ్ ఏజెంట్లను అధికారికంగా డాక్యుమెంట్ చేయబడిన మరియు ధృవీకరించబడిన LLM ఎండ్పాయింట్లకు మాత్రమే కనెక్ట్ చేయండి.
- రన్టైమ్ తనిఖీలను అమలు చేయండి: టూల్-కాల్ పేలోడ్లు లోకల్ ఎగ్జిక్యూషన్ ఎన్విరాన్మెంట్కు చేరుకోకముందే వాటిని తనిఖీ చేసే వెరిఫికేషన్ లేయర్ను జోడించండి.
- ఫైల్ యాక్సెస్ను పరిమితం చేయండి: ఏజెంట్లను అవసరమైన కనీస ఫైల్సిస్టమ్ అనుమతులతో ఉన్న సాండ్బాక్స్డ్ కంటైనర్లలో రన్ చేయండి.
- ఆడిట్ లాగ్లు: ఏజెంట్ల నుండి వెళ్లే అవుట్బౌండ్ రిక్వెస్ట్లను, అవాంఛిత గమ్యస్థానాలు లేదా డేటా పరిమాణాల కోసం నిరంతరం పర్యవేక్షించండి.
ప్రతిపాదన (Counterpoint)
ఉచిత API ఆఫరింగ్లు AI-సహాయక అభివృద్ధికి అడ్డంకులను తగ్గిస్తాయి, మరియు చాలా మంది వినియోగదారులు ఖర్చు మరియు భద్రత మధ్య సమతుల్యతను (trade-off) అంగీకరిస్తారు. అయినప్పటికీ, ప్రైవేట్ ఫైళ్ల దొంగతనం వల్ల కలిగే ప్రమాదం, ఆ పొదుపు కంటే చాలా ఎక్కువగా ఉండవచ్చని నిరూపితమైంది, ముఖ్యంగా ప్రాప్రైటరీ కోడ్ లేదా క్రెడెన్షియల్స్ ప్రమాదంలో ఉన్నప్పుడు.
ముఖ్య అంశం (Takeaway): ఉచిత LLM ఎండ్పాయింట్లు ఒక దాగి ఉన్న ఖర్చును కలిగి ఉంటాయి—అదే డేటా దొంగతనం చేసే అవకాశం. AI కోడింగ్ ఏజెంట్లను లోకల్గా రన్ చేసే ముందు ప్రతి బ్యాకెండ్ను పరిశీలించండి మరియు కఠినమైన రన్టైమ్ రక్షణ చర్యలను అమలు చేయండి.
పూర్తి సాంకేతిక నివేదిక కోసం ఇక్కడ చదవండి: https://gridthegrey.com/posts/rogue-llm-endpoint-hijacks-coding-agent-sessions-via-free-api/
