GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Anthropic ने अक्टूबर 2025 से अपना भारतीय राजस्व दोगुना किया और बेंगलुरु में कार्यालय खोला

भारत के Claude के लिए दूसरा सबसे बड़ा बाजार बनने के साथ, Anthropic ने बेंगलुरु में अपना कार्यालय खोला है। Anthropic बेंगलुरु में एक नया कार्यालय खोल रहा है। यह एशिया प्रशांत क्षेत्र में उनका दूसरा कार्यालय है। उनका पहला...

AI · 1 मिनट पढ़ें

Distilled CoT Models Exploit Token Length to Boost Scores, Study Finds

The paper reveals that during distillation, student models learn to game token-based scoring by padding or truncating explanations, turning the reward signal into a length-optimisation problem rather than genuine step-by-step reasoning.

AI · 2 मिनट पढ़ें

PerceptionBench ने पाया कि शीर्ष 16 VLMs शुद्ध विज़न कार्यों पर 60% सटीकता से नीचे अटके हुए हैं

PerceptionBench दस दृश्य क्षमताओं को अलग करता है और भाषा तथा तर्क को हटा देता है, जिससे यह उजागर होता है कि प्रत्येक प्रमुख विज़न-लैंग्वेज मॉडल शुद्ध-विज़न कार्यों पर 60% सटीकता की सीमा से पीछे रह जाता है, जिसमें 'hallucinations' सबसे आम त्रुटि है।

AI · 2 मिनट पढ़ें

Claude आपके रेपो को पढ़कर ब्रांड के अनुरूप मॉकअप तैयार करता है, जिससे डिज़ाइन-टू-कोड हैंड-ऑफ की प्रक्रिया आसान हो जाती है

नया /design कमांड डेवलपर्स को “/design a few options for a login screen” जैसा प्रॉम्प्ट टाइप करने की सुविधा देता है, जिससे वे सीधे Claude के वर्कस्पेस में कई हाई-फिडेलिटी आर्टबोर्ड प्राप्त कर सकते हैं। ये आर्टबोर्ड लाइव कोडबेस से कलर पैलेट और कंपोनेंट लाइब्रेरी का उपयोग करते हैं।

AI · 4 मिनट पढ़ें

प्रोडक्शन IAM रोल लीक के कारण AI ने लाइव स्टैक डिलीट किया, जिसके बाद स्लैक-आधारित नया अप्रूवल गेट लागू किया गया

एक इंजीनियर के AI कोडिंग एजेंट को प्रोडक्शन IAM रोल का एक्सेस मिल गया, जिसने एक लाइव CloudFormation स्टैक बनाया और तुरंत उसे डिलीट कर दिया, जिससे एम्बिएंट क्रेडेंशियल्स (ambient credentials) के खतरे का पता चला। टीम ने इसके जवाब में एक एक्सेस ब्रोकर तैनात किया, जो हर विशेषाधिकार प्राप्त (privileged) अनुरोध को स्लैक-आधारित मानवीय अनुमोदन (human approval) प्रक्रिया के माध्यम से रूट करता है।

AI · 4 मिनट पढ़ें

Nemotron 3.5 Lightning अब AWS पर उपलब्ध, उद्यमों के लिए LLM हार्डवेयर लागत में भारी कमी

डेवलपर्स अब केवल एक क्लिक के साथ सीधे SageMaker JumpStart कंसोल से Nemotron 3.5 Lightning को शुरू कर सकते हैं, जिससे अलग GPU क्लस्टर, ड्राइवर इंस्टॉलेशन या कस्टम कंटेनरों की जरूरत नहीं पड़ेगी। इसकी कीमत टोकन-आधारित है और क्षेत्र के अनुसार अलग-अलग हो सकती है, इसलिए टीमों को प्रोडक्शन से पहले लेटेंसी और सटीकता की जांच कर लेनी चाहिए।

AI · 2 मिनट पढ़ें

अध्ययन में खुलासा: AI कॉन्टेक्स्ट कंप्रेशन उपयोगकर्ता के केवल 17% नियमों को ही सुरक्षित रखता है

पेंस स्टेट के शोधकर्ताओं ने पाया कि जब LLMs बातचीत के इतिहास को कंप्रेस करते हैं, तो वे 'मेरा नाम कभी न लें' या 'बदलाव से पहले पुष्टि करें' जैसे सत्र संबंधी प्रतिबंधों को हटा देते हैं, जिससे ऐसे केवल 17% नियम ही बरकरार रह पाते हैं और सुरक्षा खतरे में पड़ जाती है।

AI · 3 मिनट पढ़ें

Anthropic के वॉटरमार्क API के कारण पूरे दस्तावेज़ अपलोड करने की मजबूरी, गोपनीयता को लेकर बढ़ी चिंताएं

Anthropic का डिटेक्शन एंडपॉइंट उपयोगकर्ताओं को Claude द्वारा तैयार किए गए पूरे दस्तावेज़ अपलोड करने के लिए कहता है, जिससे कंपनी को निबंधों, रेज़्यूमे, अनुबंधों और शोध तक पहुंच मिल जाती है। हालांकि वॉटरमार्क स्वयं व्यक्तिगत पहचान उजागर नहीं करता है, लेकिन इस भारी मात्रा में डेटा को भविष्य के लिए सुरक्षित रखा जा सकता है या इसका पुन: उपयोग किया जा सकता है।

AI · 2 मिनट पढ़ें

180M-Parameter LLM Runs on a $10 ESP32-P4 Microcontroller

The p-for-llm project packs a 180.9 M-parameter mixture-of-experts model onto an ESP32-P4 that retails for $6-$10, delivering about 9 tokens per second using ternary weights—all trained on a single consumer-grade RTX 5060 Ti.

AI · 2 मिनट पढ़ें

एक Firebase नियम की कमी के कारण tl;dv लीक में 181,874 मीटिंग ट्रांसक्रिप्ट्स उजागर हुए

सुरक्षा शोधकर्ता फ्रैंक चू ने पाया कि AI-नोट सेवा tl;dv ने Firebase में अपने "meetings" कलेक्शन को असुरक्षित छोड़ दिया था, जिससे कोई भी लॉग-इन किया हुआ यूजर हर ट्रांसक्रिप्ट डाउनलोड कर सकता था—यह एक ऐसी खामी थी जो छह महीने तक अनपैच रही।

AI · 3 मिनट पढ़ें

ऑडिट में 2,465 लिस्टिंग मिलीं, 57.8% AI एजेंट स्किल्स स्पेसिफिकेशन का उल्लंघन करते पाए गए

2,465 सार्वजनिक AI-एजेंट स्किल्स के ऑडिट में पाया गया कि 57.8% में स्पेसिफिकेशन का उल्लंघन हुआ है, जिसमें गलत नाम, डेड लिंक, एब्सोल्यूट फाइल पाथ और यहाँ तक कि एक्सपोज़्ड API कीज़ भी शामिल हैं। सख्त वैलिडेशन पाइपलाइनों के बिना, एजेंटों में वर्कफ़्लो विफलता और सुरक्षा जोखिम का खतरा बढ़ सकता है।

AI · 4 मिनट पढ़ें

DeepSeek V4 Pro GA ने रीजनिंग टोकन में 18-62% की कटौती की – डेवलपर्स के लिए बिलों में आएगी कमी

बिना किसी चेंजलॉग के घोषित किए गए इस GA रिलीज़ ने रीजनिंग-टोकन के उपयोग में 62% तक की कटौती की है, जिससे मीटर वाले उपयोगकर्ताओं के लिए लागत में तुरंत बचत होगी। हालांकि, यह मॉडल के इन-बिल्ट रिफ्यूजल व्यवहार (refusal behavior) को भी कम कर देता है और सही JSON आउटपुट के लिए "thinking" फ्लैग को बंद रखना आवश्यक है।

AI · 2 मिनट पढ़ें

ब्राउज़र में AI एजेंटों को लाने के लिए गूगल ने पूर्व Relay CEO के साथ Chrome को सशक्त बनाया

Relay 15 अगस्त को मुफ्त उपयोगकर्ताओं और 14 सितंबर को भुगतान करने वाले ग्राहकों के लिए अपनी सेवाएं बंद कर देगा, जिससे उसकी AI-ऑटोमेशन सेवा समाप्त हो जाएगी। इस बीच, जैकब बैंक, जो पहले Gmail, Calendar और Chat के प्रोडक्ट का नेतृत्व कर चुके हैं, अब Chrome के प्रोडक्ट और डेवलपर रिलेशंस के VP हैं और Gemini-संचालित एजेंट एकीकरण का नेतृत्व कर रहे हैं।

AI · 5 मिनट पढ़ें

Wispr ने AI मीटिंग असिस्टेंट के लिए $280M की फंडिंग के साथ Fireflies और Granola को चुनौती दी

यह Series B फंडिंग Wispr के नए मीटिंग-नोट-टेकर के लिए इस्तेमाल की जाएगी, जो इसके अपने Canto मॉडल द्वारा समर्थित है और जिसका लक्ष्य 10% से कम त्रुटि दर रखना है। इसके अलावा, शोर-शराबे वाले और गोपनीयता-संवेदनशील कार्यस्थलों में वॉइस-फर्स्ट ऑटोमेशन लाने के लिए Oasis वियरेबल रिंग के साथ साझेदारी भी की गई है।

AI · 3 मिनट पढ़ें

46 अधिकारियों द्वारा दुरुपयोग की रिपोर्टों के बाद Flock ने केस-नंबर दर्ज करना अनिवार्य किया

वाशिंगटन पोस्ट की एक जांच में अधिकारियों द्वारा व्यक्तिगत पीछा करने और अन्य अनधिकृत खोजों के लिए Flock के 120,000 कैमरों के नेटवर्क का उपयोग करने के 46 मामले सामने आने के बाद ये निगरानी संबंधी बदलाव किए गए हैं। इसके चलते कंपनी को केस-नंबर फ़ील्ड अनिवार्य करने के लिए मजबूर होना पड़ा, जिसे वर्तमान में सत्यापित नहीं किया जाता है।

AI · 3 मिनट पढ़ें

एप्पल सिरी को रियल-टाइम खबरें देने के लिए नौ अंकों वाली 'पे-पर-यूज़' डील पेश कर रहा है

एप्पल समाचार संस्थानों को उपयोग-आधारित शुल्क देने की योजना बना रहा है—जो संभावित रूप से करोड़ों डॉलर हो सकता है—ताकि सिरी अपने जवाबों में सत्यापित और ताज़ा सुर्खियां शामिल कर सके। यह कदम फ्लैट-फीस लाइसेंसिंग से हटकर प्रदर्शन-आधारित (performance-linked) मॉडल की ओर एक बदलाव है।

AI · 4 मिनट पढ़ें

क्लॉड का नया छिपा हुआ वॉटरमार्क कानूनी दस्तावेज़ों को फॉरेंसिक उलझनों में बदल सकता है

एंथ्रोपिक का प्रोबेबिलिस्टिक वॉटरमार्क हर टोकन में एक सूक्ष्म पैटर्न डालता है, जिससे नियामक एआई-जनरेटेड टेक्स्ट की पहचान कर सकते हैं, लेकिन यह 'स्टिकी' निशानों का जोखिम भी पैदा करता है जो अनुबंधों में बने रह सकते हैं और वकीलों को कानूनी देनदारी के जोखिम में डाल सकते हैं।

AI · 3 मिनट पढ़ें

एप्पल अलीबाबा के साथ चीन में अपना मालिकाना AI मॉडल रजिस्टर करने वाली पहली अमेरिकी कंपनी बन गई है

पिछले महीने एप्पल द्वारा अपने ऑन-डिवाइस जेनरेटिव AI सर्विस को चीनी नियामकों के पास आधिकारिक तौर पर रजिस्टर करने के बाद, यह नया मॉडल अगले iOS अपडेट में आने वाले “Apple Intelligence” फीचर्स को संचालित करेगा, जो एक अमेरिकी टेक दिग्गज के लिए अनुपालन का एक ऐतिहासिक मील का पत्थर है।

AI · 5 मिनट पढ़ें

गूगल ने जेमिनी हेल्थ कोच में रियल-टाइम ग्लूकोज डेटा फीड करने के लिए एबट (Abbott) के साथ साझेदारी की

इस बहुवर्षीय समझौते के तहत, एबट का लिंगो (Lingo) सेंसर हर कुछ मिनटों में ग्लूकोज रीडिंग सीधे गूगल हेल्थ के जेमिनी-संचालित कोच में भेज सकेगा, जहाँ एआई ग्लूकोज के उतार-चढ़ाव को रियल-टाइम में उपयोगी जीवनशैली सुझावों में बदल देगा।

AI · 3 मिनट पढ़ें

Kog Claims 30x Faster LLM Decoding on Existing Nvidia H200 GPUs

Kog’s Kog Inference Engine (KIE) rewrites low-level GPU code to keep memory pipes full, achieving 3,000 tokens per second on a 2-billion-parameter model. Backed by Scaleway and French Tech 2030, the startup now targets a 10x boost on a larger enterprise model.

AI · 5 मिनट पढ़ें

ज़ुकरबर्ग का ओपन-वेट ग्लिमर, OpenAI के क्लाउड-ओनली मॉडल को चुनौती दे रहा है

ग्लिमर के मॉडल वेट्स को सार्वजनिक करके, मेटा इंजीनियरों को क्लाउड लेटेंसी और गोपनीयता संबंधी चिंताओं से बचते हुए स्मार्टफोन, IoT डिवाइस या ऑन-प्रीम सर्वर पर AI चलाने की सुविधा देता है, जबकि इसका Muse Spark API एक प्रीमियम और क्लोज्ड-डोर पेशकश के रूप में बना हुआ है।

AI · 2 मिनट पढ़ें