GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

GeekyAnts AI-जनरेटेड React ऐप्स को वापस Figma में लाने के लिए React Fiber का उपयोग करता है

जेनेरिक DOM के बजाय React के इंटरनल Fiber tree को पढ़कर, GeekyAnts हर कंपोनेंट, वेरिएंट और स्टेट को वापस एडिटेबल Figma फाइलों में मैप कर सकता है, जिससे डिज़ाइन सिस्टम की अखंडता बनी रहती है और स्क्रीन को फिर से बनाने में लगने वाले समय में भारी कमी आती है।

AI · 3 मिनट पढ़ें

Claude Code Adds /loop /goal /schedule to Automate Repetitive Coding

Claude Code now offers three loop-engineering commands—/loop, /goal and /schedule—that let the same model iterate, verify and persist its work autonomously. By defining skills, verifiers, guardrails and spend caps, developers can automate builds, tests and deployments while keeping token usage in ch

AI · 3 मिनट पढ़ें

एक सिंगल टाइमस्टैम्प लाइन ने एक AI एजेंट के लिए OpenAI के खर्च को तीन गुना कर दिया

एजेंट ने अपने सिस्टम प्रॉम्प्ट की शुरुआत में ही एक करंट टाइमस्टैम्प जोड़ दिया, जिससे हर रिक्वेस्ट का बाइट प्रीफ़िक्स यूनिक हो गया। इसकी वजह से OpenAI का 'exact-match cache' काम करना बंद कर गया, जिससे 18,000 स्टैटिक टोकन के लिए पूरी कीमत चुकानी पड़ी और बिल तीन गुना बढ़ गया।

AI · 2 मिनट पढ़ें

Teams बॉट्स 15-सेकंड के टाइमआउट की समस्या का सामना कर रहे हैं – LLM लॉजिक को Async Queues में स्थानांतरित करें

जब किसी बॉट का हैंडलर भारी LLM प्रॉम्प्टिंग या डेटाबेस कॉल करता है, तो Teams 10-15 सेकंड के बाद रिस्पॉन्स को बीच में ही रोक देता है और फिर से कोशिश (retry) करता है, जिससे डुप्लिकेट काम का बोझ बढ़ जाता है। वेबहुक को डिकपलिंग (decoupling) करना, इवेंट को क्यू (queue) में डालना और उसे बैकग्राउंड वर्कर में प्रोसेस करना सिस्टम की विश्वसनीयता को फिर से बहाल करता है।

AI · 3 मिनट पढ़ें

Sverklo ने कोड सर्च में चार-स्तरीय ऑडिट ट्रेल जोड़ा, जिससे डेवलपर्स हर क्वेरी स्टेप देख सकेंगे

Sverklo एक क्लासिक BM25 कीवर्ड इंजन, ONNX एम्बेडिंग्स और PageRank-रैंक वाले सिंबल ग्राफ का मिश्रण करता है, और फिर एक `found_by` फ़ील्ड और मेमोरी लेज़र पेश करता है ताकि डेवलपर्स यह सत्यापित कर सकें कि किस सिग्नल ने प्रत्येक हिट दिया और क्या कैश किया गया उत्तर अभी भी ताज़ा है।

AI · 3 मिनट पढ़ें

एक टाइमस्टैम्प ने प्रॉम्प्ट कैशिंग को बाधित कर दिया, जिससे OpenAI API का बिल 25% बढ़ गया

सिस्टम प्रॉम्प्ट में टाइमस्टैम्प हर रिक्वेस्ट के साथ बदल रहा था, जिससे कोई भी कैश हिट नहीं हो पा रहा था। हर कॉल पर सामान्य दर से 1.25 गुना अधिक राइट चार्ज लग रहा था, जिससे प्रॉम्प्ट को फिर से व्यवस्थित करने तक इनवॉइस लगभग एक चौथाई बढ़ गया।

AI · 4 मिनट पढ़ें

कंट्रोल-थ्योरी की एक नई तकनीक शोधकर्ताओं को सिंगल GPU पर डिफ्यूजन मॉडल्स को फाइन-ट्यून करने की सुविधा देती है

फाइन-ट्यूनिंग को एक मेमोरी-लेस स्टोकेस्टिक ऑप्टिमल-कंट्रोल समस्या के रूप में पेश करके, एडजॉइंट मैचिंग (Adjoint Matching) महंगे बैकवर्ड पास को एक लाइटवेट ऑप्टिमाइज़र से बदल देता है, जिससे बड़े डिफ्यूजन और फ्लो जनरेटर्स को बिना किसी सामान्य अस्थिरता के साधारण हार्डवेयर पर भी अनुकूलित किया जा सकता है।

AI · 2 मिनट पढ़ें

Claude Code द्वारा 72 KB AGENTS.md को तब तक अनदेखा किया गया जब तक उसे रीनेम नहीं किया गया, जिससे टोकन ओवरहेड बढ़ गया

प्रयोग से पता चला कि 72 KB AGENTS.md फ़ाइल सही हैश के साथ मौजूद थी, लेकिन Claude Code ने कभी इसका संदर्भ नहीं लिया। इसे नेटिव CLAUDE.md में रीनेम करने पर असिस्टेंट ने इसे लोड कर लिया, जिससे आउटपुट में सुधार किए बिना टोकन काउंट और लेटेंसी बढ़ गई।

AI · 3 मिनट पढ़ें

इंजीनियरिंग टीम ने 95% क्वेरीज़ को सस्ते मॉडल्स की ओर भेजकर AI-API बिल में 95% की कटौती की

टीम ने एक फ्रंट-एंड क्लासिफायर बनाया जो 95% ट्रैफिक को एक हल्के (lightweight) मॉडल की ओर निर्देशित करता है, बार-बार पूछे जाने वाले जवाबों (जिसमें "मुझे नहीं पता" भी शामिल है) के लिए Redis कैश जोड़ा, प्रॉम्प्ट्स को कंप्रेस किया और बैकग्राउंड जॉब्स को बैच में प्रोसेस किया, जिससे बिना लेटेंसी बढ़ाए मासिक लागत $420 से घटकर $28 रह गई।

AI · 3 मिनट पढ़ें

Google के Genkit API में 'Human-In-The-Loop' फीचर का लक्ष्य AI की महंगी गलतियों को रोकना है

यह प्रीव्यू “detached turns” पेश करता है, जो लंबे समय तक चलने वाले कॉल्स को बैकग्राउंड प्रोसेस में स्थानांतरित कर देता है, और एक 'human-in-the-loop' प्रॉम्प्ट देता है जो रिव्यूअर्स को एजेंट के कार्यों को अप्रूव या रिजेक्ट करने की अनुमति देता है—ये फीचर्स डाउनटाइम कम करने और महंगी गलतियों से बचने के लिए डिज़ाइन किए गए हैं।

AI · 2 मिनट पढ़ें

83% से परफेक्ट तक: कैसे APE एक थ्री-स्टेप स्कोरिंग लूप का उपयोग करके प्रॉम्प्ट्स को बेहतर बनाता है

APE: मॉडल को अपना प्रॉम्प्ट लिखने, स्कोर करने और चुनने दें। हाथ से प्रॉम्प्ट लिखना केवल एक अनुमान लगाना है। आप एक शब्द बदलते हैं, उसका परीक्षण करते हैं, और जब वह सही लगने लगता है तब रुक जाते हैं। यह प्रक्रिया धीमी और व्यक्तिपरक है...

AI · 3 मिनट पढ़ें

धोखाधड़ी रोकने के लिए भारत ने हर नए सिम के लिए फेशियल आईडी अनिवार्य की

नया ASTR सिस्टम रजिस्ट्रेशन के समय एक सेल्फी लेता है, उसे हाई-डायमेंशनल एम्बेडिंग में बदलता है और तुरंत अरबों चेहरों के राष्ट्रीय डेटाबेस के साथ उसका मिलान करता है, जिससे कई नंबरों पर एक ही चेहरे के डुप्लिकेट इस्तेमाल को रोका जा सके।

AI · 2 मिनट पढ़ें

हाई-इम्प्रेशन कीवर्ड्स को हटाकर AI SEO पाइपलाइन ने CTR को बढ़ाकर 3% किया

हाई-कंपटीशन और हाई-इम्प्रेशन वाली क्वेरीज को फिल्टर करके और केवल उन लॉन्ग-टेल टर्म्स पर ध्यान केंद्रित करके जो एफिनिटी, कठिनाई और CTR चेक पास करते हैं, इस नए पाइपलाइन ने लेखों की संख्या को आधा कर दिया, साथ ही क्लिक-थ्रू रेट को 2-3% तक बढ़ा दिया और रैंकिंग में सुधार किया।

AI · 3 मिनट पढ़ें

DeepSeek का DSpark LLM इन्फरेंस समय को 85% तक कम करता है और GPU लागत में भारी कटौती करता है

DSpark टोकन बैचों का अनुमान लगाने के लिए एक हल्के ड्राफ्ट मॉडल का उपयोग करता है, जिसे पूर्ण LLM फिर एक ही बार में सत्यापित करता है। यह ओपन-सोर्स MIT-लाइसेंस प्राप्त लाइब्रेरी DeepSeek, Qwen और Gemma के साथ काम करती है, जो मौजूदा हार्डवेयर पर 60-85% तेज़ इन्फरेंस प्रदान करती है।

AI · 2 मिनट पढ़ें

Apple ने iOS 27 पब्लिक बीटा जारी किया, 2.5 बिलियन डिवाइसों के लिए AI-पावर्ड Siri को किया उपलब्ध

यह बीटा सिरी को एक वास्तविक AI एजेंट बनाता है जो ईमेल पढ़ सकता है, फोटो से डेटा निकाल सकता है और ग्रुप चैट का सारांश भी दे सकता है, और यह सब ऑन-डिवाइस मॉडल और Apple के Private Cloud Compute के जरिए डेटा की गोपनीयता बनाए रखते हुए किया जाता है।

AI · 3 मिनट पढ़ें

मैच ग्रुप ने हिंज के संस्थापक के वॉयस-फर्स्ट डेटिंग ऐप Overtone में $18 मिलियन का निवेश किया

Overtone का AI उपयोगकर्ताओं की वॉयस रिकॉर्डिंग के लहजे, लय और कहानी सुनाने की शैली का विश्लेषण करता है, और फिर उन सटीक डेटा पॉइंट्स की व्याख्या करता है जिन्होंने एक मैच को जोड़ा है, जिससे पारंपरिक स्वाइप संकेतों के बजाय पारदर्शी और गहराई-केंद्रित संबंध मिलते हैं।

AI · 3 मिनट पढ़ें

SpaceXAI’s Grok Build Secretly Uploaded Entire Repos to Google Cloud

Cereblab traced Grok Build’s CLI traffic to a Google Cloud bucket, confirming it packed full git repositories—including ignored files and deleted credentials—and pushed them without opt-out. SpaceXAI disabled the feature and Musk pledged full deletion, but critics note the privacy command only toggl

AI · 4 मिनट पढ़ें

जेमिनी को पूर्ण-पाठ पुस्तकों पर प्रशिक्षित करने के मामले में प्रकाशकों ने गूगल पर मुकदमा किया

शिकायत में आरोप लगाया गया है कि गूगल ने अपने बुक्स आर्काइव और प्ले स्टोर से पूरी कृतियों को स्क्रैप किया और फिर स्रोत को छिपाने के लिए कॉपीराइट मेटाडेटा हटा दिया, जिसके कारण $100 बिलियन तक के जुर्माने की चेतावनी देने वाला एक आंतरिक मेमो जारी हुआ है।

AI · 3 मिनट पढ़ें

DeepMind के CEO ने फ्रंटियर मॉडल्स की जांच के लिए FINRA-शैली की AI मानक संस्था के गठन का आह्वान किया

हैसाबिस का ब्लूप्रिंट एक दो-चरणीय प्रणाली का प्रस्ताव देता है: पहले लैब 30 दिनों की स्वैच्छिक समीक्षा के लिए अपने मॉडल जमा करेंगे, और एक बार जब यह प्रक्रिया अपनी प्रभावशीलता सिद्ध कर देगी, तो अमेरिकी बाजार में प्रवेश करने वाले किसी भी फ्रंटियर AI के लिए ये परीक्षण अनिवार्य कर दिए जाएंगे।

AI · 2 मिनट पढ़ें

Anthropic ने बेहतर डेटा प्राइवेसी के साथ शिक्षकों के लिए Claude लॉन्च किया

Anthropic ने बेहतर डेटा प्राइवेसी के साथ शिक्षकों के लिए Claude लॉन्च किया। Anthropic "Claude for Teachers" लॉन्च करके K-12 क्षेत्र में एक महत्वपूर्ण कदम उठा रहा है, जो एक विशेष निःशुल्क...

AI · 3 मिनट पढ़ें

कथित पक्षपाती एआई-संचालित छंटनी के मामले में मेटा पर मुकदमा

कथित पक्षपाती एआई-संचालित छंटनी के मामले में मेटा पर मुकदमा। 26 पूर्व कर्मचारियों के एक समूह ने मेटा के खिलाफ मुकदमा दायर किया है, जिसमें आरोप लगाया गया है कि टेक दिग्गज ने एआई के एक उन्नत टूलसेट का उपयोग किया...

AI · 3 मिनट पढ़ें