GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

संशोधकांनी गुप्त डेटा लीक उघड केल्यानंतर दोन दिवसांनी xAI ने Grok बिल्ड ओपन-सोर्स केले

नुकत्याच प्रकाशित झालेल्या Apache-2.0 रिपॉझिटरीमध्ये एका लपलेल्या सर्व्हर-साइड फ्लॅगच्या मागे डेटा एक्सफिल्ट्रेशन रूटीन अजूनही अस्तित्वात आहे आणि यामध्ये OpenAI चे श्रेय न दिलेले कोड स्निपेट्स देखील समाविष्ट आहेत; याचा अर्थ असा की डेव्हलपर्सनी या टूलचे ऑडिट करणे आणि कोणतेही उघड झालेले क्रेडेंशियल्स बदलणे आवश्यक आहे.

AI · 3 min read

CodeQL 2.26.0 मध्ये प्रॉम्प्ट-इंजेक्शन क्वेरी समाविष्ट – त्याचे संरक्षण करण्यासाठी CI रिग्रेशन फिक्स्चर तयार करा

इन-बिल्ट CodeQL क्वेरी कोणत्याही अविश्वसनीय स्त्रोताकडून (जसे की GitHub इश्यू बॉडी) मॉडेल-कॉलिंग SDK कडे होणाऱ्या डेटा फ्लोवर लक्ष वेधते. पॉझिटिव्ह आणि निगेटिव्ह टेस्ट फाइल्सना expected-alerts.json करारासोबत एकत्रित करून, तुम्ही या शोध प्रक्रियेचे रूपांतर बिल्ड-टाइम गेटमध्ये करू शकता.

AI · 4 min read

कॅश साइड-चॅनेल अटॅक्स चालू असलेल्या AI मॉडेल्समधून डेटा चोरू शकतात

कॅश रीड/राईट वेळेचे निरीक्षण करून, हल्लेखोर इनपुट डेटा आणि मॉडेलच्या शिकलेल्या वेट्सचे (weights) काही भाग या दोन्ही गोष्टींचा अंदाज लावू शकतात; ही एक अशी त्रुटी आहे जी कॉन्स्टंट-टाइम कोड किंवा मॉडेल एन्क्रिप्शन असूनही कायम राहते.

AI · 3 min read

Downstream Electron 42.6.0 Stops Linux Message-Box Crashes

The downstream maintainer reordered two GTK calls, preventing a null-pointer dereference that caused segmentation faults for Qt-based Electron apps on Linux. The same change sits in an open upstream PR, but users get the fix now with version 42.6.0.

AI · 2 min read

Honcho Swaps Long-Lived DB Sessions for Short Ones to Cut LLM Latency

The Honcho team discovered that keeping a database connection open while waiting on slow LLM or embedding calls can hog the connection pool. By moving to pre-flight reads, closing the session, and reopening only for writes, they reduced latency and improved scalability.

AI · 1 min read

OpenAI आणि Anthropic ला बाजूला सारण्यासाठी मायक्रोसॉफ्टचा सेल्स टीमला आदेश, स्वतःच्या AI स्टॅकवर भर

मायक्रोसॉफ्टने सेल्स टीमला OpenAI आणि Anthropic च्या विरोधात उभे करण्यासाठी आपली रणनीती बदलली आहे. मायक्रोसॉफ्ट त्याच्या बाजारपेठेतील दृष्टिकोनात महत्त्वपूर्ण बदल करत असून, AI क्षेत्रातील अग्रगण्य कंपन्यांचे जवळचे सहयोगी असण्यापासून आता वेगळ्या मार्गाकडे वळत आहे...

AI · 2 min read

Qwen 3.6 35B-A3B Beats Four Rivals on RTX 5090 in Real-World Code Edit

The benchmark ran five agents on a single RTX 5090, tasking them with adding a Tag Manager to an admin panel without any cloud APIs. Qwen 3.6 35B-A3B completed the job autonomously, added sensible improvements, and required zero post-run patches.

AI · 3 min read

AWS ने एंटरप्राइझ नियंत्रणासाठी सेल्फ-होस्टेड Claude Apps Gateway लाँच केले

Claude Apps Gateway ग्राहकाच्या AWS अकाउंटमध्ये कंट्रोल प्लेन एम्बेड करते, ज्यामुळे IT विभागाला ओळख (identity), ऑडिट लॉग्स आणि खर्च व्यवस्थापित करण्यासाठी एकच डॅशबोर्ड मिळतो, तर डेव्हलपर्स डेटा बाह्यरित्या उघड न करता Claude-आधारित सेशन्स सुरू करू शकतात.

AI · 2 min read

Attention Sink Detector Shows Pruning BOS Token Crashes LLM Performance

The detector records raw attention scores across all heads, aggregates them layer-wide, and uses a log-MAD test to flag tokens that swallow the bulk of attention. Removing these “sink” tokens from the KV cache destabilises generation and slashes quality.

AI · 3 min read

EU च्या मसुदा कायद्यामुळे AI चॅट्समधील बेकायदेशीर मजकूर स्कॅन करण्याची सक्ती होऊ शकते

हा प्रस्ताव सध्याचे मेसेज-फिल्टरिंग नियम अधिक व्यापक करतो, ज्यामध्ये दोन व्यक्ती मजकूर देवाणघेवाण करतात अशा कोणत्याही सेवेचा समावेश असेल. याचा अर्थ असा की, AI प्रदात्यांना मॉडेलला युजरचा प्रॉम्प्ट दिसण्यापूर्वीच तो ऑटोमेटेड स्कॅनर्सद्वारे तपासावा लागेल.

AI · 4 min read

OpenAI च्या GPT-Red ने मानवी रेड-टीम्सना मागे टाकले, ८४% हल्ल्याचे यश मिळवले

ही सेल्फ-प्ले सिस्टीम एका हल्ला करणाऱ्या मॉडेलची त्याच्याच संरक्षणात्मक मॉडेलशी स्पर्धा घडवून आणते. प्रत्येक अपयशातून शिकून, ही सिस्टीम असे 'एक्सप्लॉइट पॅटर्न' शोधून काढते जे मानवांना कधीही सुचत नाहीत आणि हे निष्कर्ष थेट GPT-5.6 च्या ट्रेनिंग पाइपलाइनमध्ये समाविष्ट करते.

AI · 2 min read

OpenAI ने AI-आधारित कोडिंग एजंट्ससाठी $२३० किमतीचे Codex Micro कीबोर्ड सादर केले

Codex Micro मध्ये प्रकाशमान Agent Keys, प्रोग्राम करण्यायोग्य शॉर्टकट, एक जॉयस्टिक आणि Reasoning Dial देण्यात आले आहेत, जे थेट ChatGPT डेस्कटॉप ॲपशी जोडलेले आहेत. यामुळे डेव्हलपर्सना त्यांच्या IDE मधून बाहेर न पडता अनेक AI एजंट्सवर लक्ष ठेवणे आणि त्यांना नियंत्रित करणे सोपे होईल.

AI · 3 min read

AWS Lambda AI एजंट्सना कम्प्युटपेक्षा कोल्ड स्टार्टसाठी जास्त खर्च येतो

Lambda वर AI एजंट चालवणे मिलिसेकंदनुसार स्वस्त वाटू शकते, परंतु खरा खर्च कोल्ड-स्टार्ट लॅटन्सी, अनेक मॉडेल कॉल्स ट्रिगर करणारे रिट्राय लूप्स आणि त्यातून होणारा टोकनचा वापर यांमुळे येतो, जो कम्प्युट चार्जेसपेक्षा कितीतरी जास्त असतो.

AI · 3 min read

15 AI-द्वारे तयार केलेल्या पायथन स्क्रिप्ट्सपैकी 2 मध्ये BrassCoders ला हार्ड-कोडेड सीक्रेट्स आढळले

या दोन असुरक्षित स्क्रिप्ट्स—ज्यामध्ये एक HMAC साइनिंग की आणि दुसरी प्लेन-टेक्स्ट SMTP पासवर्ड समाविष्ट आहे—हे दर्शवतात की जेव्हा "वापरण्यायोग्य उदाहरण" विचारले जाते, तेव्हा LLMs गहाळ माहिती कशी भरतात. यामुळे उपयुक्त वाटणारे कोड स्निपेट्स व्हर्जन कंट्रोल आणि प्रोडक्शनमध्ये क्रेडेंशियल लीकचे कारण बनतात.

AI · 4 min read

Thinking Machines ने Inkling ला GB300 NVL72 हार्डवेअरवर प्रशिक्षित करण्यासाठी Nvidia सोबत भागीदारी केली आहे

45 ट्रिलियन मल्टिमॉडल टोकन्सवर प्रशिक्षित असलेले Inkling, त्याचे 975 अब्ज पॅरामीटर्सपैकी केवळ काही भाग सक्रिय करूनही Nvidia-स्तरीय कोडिंग कामगिरी देते, ज्यामुळे एंटरप्राइझ वापरकर्त्यांसाठी लॅटन्सी आणि कार्यान्वित खर्च कमी होतो.

AI · 2 min read

OpenAI ने GPT-Red तैनात केले, ज्यामुळे सिम्युलेटेड अटॅकचे यश ९०% वरून २३% पर्यंत कमी झाले

'सेल्फ-प्ले दोजो' मुळे GPT-Red अटॅकर म्हणून काम करू शकते, तर डिफेन्डर मॉडेल्स संरक्षण तंत्रे शिकतात; यामुळे 'फेक चेन-ऑफ-थॉट' सारख्या नवीन युक्त्या समोर आल्या आहेत, ज्या LLMs ला चुकीचे आधार स्वीकारण्यास फसवतात.

AI · 2 min read