GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

एंड्रयू एनजी ने 'वाइब कोडिंग' को खत्म करने के लिए एआई इंजीनियरिंग स्किल्स मैप पेश किया

यह मैप एलएलएम (LLM) डेवलपमेंट को छह डोमेन में विभाजित करता है—स्ट्रक्चर्ड प्रॉम्प्ट टेम्पलेट्स से लेकर रियल-टाइम ड्रिफ्ट हैंडलिंग तक—जो इंजीनियरों को त्वरित डेमो से हटकर विश्वसनीय और स्केलेबल एआई सेवाओं की ओर बढ़ने के लिए एक चेकलिस्ट प्रदान करता है।

AI · 2 मिनट पढ़ें

Stability AI ने UMG, Sony, Warner और EA से $76 मिलियन जुटाए

AMD Ventures और Pacific Alliance Ventures के नेतृत्व में हुए इस राउंड के साथ Stability AI की कुल फंडिंग $232 मिलियन हो गई है। यह संगीत और गेमिंग दिग्गजों को इक्विटी हिस्सेदारी प्रदान करता है, जिससे वे लाइसेंसधारी से बदलकर स्टार्टअप के जनरेटिव-मीडिया प्लेटफॉर्म के शुरुआती उपयोगकर्ताओं में तब्दील हो गए हैं।

AI · 3 मिनट पढ़ें

सोथबीज़ ने कीमतों का अनुमान लगाने और हजारों लोगों के लिए रियल-टाइम बोली को सशक्त बनाने के लिए एआई (AI) का उपयोग किया

कंप्यूटर साइंस लीड केली शेन द्वारा निर्मित सोथबीज़ का नया एआई सुइट, कीमतों के अनुमान को तुरंत अपडेट करने के लिए ऐतिहासिक बिक्री, सोशल मीडिया की चर्चा और प्रदर्शनी डेटा का उपयोग करता है, जबकि एक कस्टम लो-लेटेंसी क्लाउड स्टैक हजारों एक साथ बोली लगाने वालों के लिए ऑनलाइन नीलामी प्रक्रिया को सुचारू बनाए रखता है।

AI · 4 मिनट पढ़ें

Jalapeño ने AI इन्फरेंस लेटेंसी को 3.6 गुना तक कम किया, Nvidia की बढ़त के लिए बना खतरा

इस चिप ने 1.5-1.9 गुना अधिक वर्क-पर-वॉट भी हासिल किया और इसे Broadcom के साथ AI-सहायता प्राप्त वर्कफ़्लो का उपयोग करके केवल नौ महीनों में डिज़ाइन किया गया था, जो OpenAI की तेज़ हार्डवेयर विकास गति को दर्शाता है।

AI · 2 मिनट पढ़ें

Anthropic ने बार-बार ब्रीफिंग की झंझट को खत्म करने के लिए Claude Chat और Cowork Memory को एकीकृत किया

यह अपग्रेड Claude के अलग-अलग चैट और Cowork स्टोर्स को एक एकल, गतिशील रूप से अपडेट होने वाले डेटा बैंक में जोड़ता है, जो रीयल-टाइम में जानकारी को टैग और सिंक करता है, और इसमें एंट्रीज़ को एडिट या डिलीट करने के लिए एक इन-बिल्ट व्यूअर भी दिया गया है।

AI · 3 मिनट पढ़ें

दवा के पूर्वानुमान में Outer Biosciences के शुरुआती AI परिणाम ऑर्गेनॉइड मॉडल्स से बेहतर निकले

बायोटेक पार्टनर्स के साथ किए गए पायलट अध्ययनों में, जीवित त्वचा के स्लाइस पर प्रशिक्षित Outer Biosciences के AI ने ऑर्गेनॉइड-आधारित भविष्यवाणियों की तुलना में नैदानिक परिणामों के साथ अधिक सटीक संबंध दिखाया, जो दवा-स्क्रीनिंग सटीकता के लिए एक नए बेंचमार्क का संकेत देता है।

AI · 5 मिनट पढ़ें

फ्लॉक के LPR सिस्टम की संघीय खरीद पर प्रतिबंध लगाने के लिए रिपब्लिकन और डेमोक्रेट्स एकजुट हुए

वाशिंगटन पोस्ट द्वारा 46 कथित दुरुपयोगों की जांच के बाद, तीन हाउस रिपब्लिकन और प्रगतिशील सीनेटरों ने मिलकर एक ऐसा कानून तैयार किया है जो विशेष रूप से संघीय सरकार को किसी भी स्वचालित निगरानी प्रणाली को खरीदने से रोकता है, जिसमें फ्लॉक सेफ्टी (Flock Safety) का नाम स्पष्ट रूप से लिया गया है।

AI · 3 मिनट पढ़ें

Linkdaze पर AI-संचालित ‘Snap-to-Sync’ हाथ से लिखी रेसिपीज़ को शॉपिंग लिस्ट में बदल देता है

Linkdaze का 10.1-इंच टचस्क्रीन $119.99 में मिलता है (Amazon पर $66 तक कम) और इसमें कैलेंडर सिंकिंग, चोर्स ट्रैकिंग, मील प्लानिंग और एक फोटो फ्रेम की सुविधा मिलती है—और यह सब बिना उस $79-प्रति-वर्ष की फीस के, जो Skylight जैसे प्रतिद्वंद्वी प्रीमियम फीचर्स के लिए लेते हैं।

AI · 4 मिनट पढ़ें

Gemini for Legal मिनटों में कॉन्ट्रैक्ट रिव्यू का वादा करता है, जिसका लक्ष्य लॉ फर्म की लागत में कटौती करना है

Google का Gemini Enterprise for Legal, iManage, NetDocuments, DocuSign, Everlaw और अन्य प्लेटफॉर्म से सीधे फ़ाइलें पढ़ने के लिए Model Context Protocol कनेक्टर्स का उपयोग करता है, जिससे AI एजेंट कॉन्ट्रैक्ट रिव्यू, रिसर्च और रेगुलेटरी ट्रैकिंग के लिए पहले से तैयार "skills" का उपयोग कर पाते हैं।

AI · 6 मिनट पढ़ें

रॉयटर्स डेटा के उपयोग से प्रोप्रायटरी लीगल मॉडल ने सटीकता के मामले में GPT-5.4 को पछाड़ा

Qwen फाउंडेशन पर ट्रेनिंग देने और अपने स्वयं के Westlaw, Practical Law, Checkpoint और न्यूज़ आर्काइव्स को जोड़ने के बाद, थॉमसन रॉयटर्स के मॉडल ने Deep Research पर तथ्यात्मक सटीकता को 0.53 से बढ़ाकर 0.83 कर दिया है, जिससे यह GPT-5.4 से आगे निकल गया है जिसके पास यह प्रोप्रायटरी डेटा नहीं है।

AI · 3 मिनट पढ़ें

Hugging Face को मिलीं $13 बिलियन की बोलियां, जो इसके 2023 के मूल्यांकन से तीन गुना अधिक हैं

$13 बिलियन से अधिक के प्रस्तावों की जांच के लिए बैंकों को नियुक्त किया गया है, जो Hugging Face के 2023 के राउंड के $4.5 बिलियन के पोस्ट-मनी मूल्यांकन से लगभग तीन गुना है। CEO Clem Delangue का कहना है कि कंपनी मुनाफे के करीब है और उसे नकदी बनाम अपने समुदाय-प्रथम मिशन के बीच संतुलन बनाना होगा।

AI · 4 मिनट पढ़ें

MIT AI ने कभी न देखे गए चरम मौसम के उच्च-रिज़ॉल्यूशन वाले मानचित्र तैयार किए

मैकेनिकल इंजीनियरिंग के स्नातक छात्र काई चांग और प्रोफेसर थेमिस सैप्सिस ने एक फिजिक्स-इन्फॉर्म्ड न्यूरल नेटवर्क विकसित किया है, जो उन चरम घटनाओं के लिए विस्तृत और उच्च-रिज़ॉल्यूशन वाले जोखिम मानचित्र तैयार करता है जो किसी क्षेत्र में पहले कभी नहीं हुई हैं, और इसमें योजनाकारों के लिए कॉन्फिडेंस इंटरवल भी शामिल हैं।

AI · 5 मिनट पढ़ें

मल्टीमॉडल स्लाइड्स के लिए $2.1 बिलियन मूल्य वाली AI डिज़ाइन लैब लॉन्च करने के लिए Gamma ने Lica का अधिग्रहण किया

यह डील Gamma को एक समर्पित टीम प्रदान करती है, जिससे वह स्थिर डेक (static decks) से आगे बढ़कर इंटरैक्टिव और वीडियो-समृद्ध संचार की ओर बढ़ सके। इसे किसी ब्रांड के लुक और दर्शकों की पसंद के अनुसार अनुकूलित किया जा सकता है, जिसका उद्देश्य प्रेजेंटेशन सॉफ्टवेयर और मल्टीमीडिया स्टोरीटेलिंग के बीच के अंतर को मिटाना है।

AI · 4 मिनट पढ़ें

OpenAI ने लॉन्च किया ChatGPT Work: ईमेल, Slack और Notion के लिए $20/महीना वाला AI एजेंट

ChatGPT Work उपयोगकर्ताओं को साधारण टेक्स्ट में टास्क समझाने की सुविधा देता है, जबकि यह इनबॉक्स, Slack, Notion और अन्य SaaS टूल्स से डेटा प्राप्त करता है। यह ऐसे मल्टी-स्टेप वर्कफ़्लो को निष्पादित करता है जिनसे हाई टोकन काउंट—और $20 के ऐड-ऑन के लिए अधिक मासिक बिल—बन सकते हैं।

AI · 3 मिनट पढ़ें

Gaming Data Powers General Intuition’s Quest for Robotic Intuition at $6B

The New York startup is leveraging hundreds of millions of hours of gameplay with millisecond-level action labels to teach models cause-and-effect, while fresh capital will fuel talent hires and a CoreWeave compute partnership aimed at robotic embodiments.

AI · 3 मिनट पढ़ें

अलीबाबा का Wan3.0 बीटा PDF, स्लाइड्स और ऑडियो से 30-सेकंड के वीडियो तैयार करता है

Wan3.0 एक ही रिक्वेस्ट में दस इमेज, पांच वीडियो, पांच ऑडियो क्लिप, साथ ही PDF, वेब पेज और पावरपॉइंट डेक को इनपुट के रूप में ले सकता है, और यहाँ तक कि प्रत्येक प्रॉम्प्ट के लिए सबसे उपयुक्त क्लिप लंबाई का सुझाव भी देता है।

AI · 2 मिनट पढ़ें

Spear Street का Instinct AI को कीस्ट्रोक्स पढ़ने की अनुमति देता है, जिससे हमले का एक बड़ा नया रास्ता खुल गया है

Instinct की सेवा की शर्तें (Terms of Service) AI को किसी भी उपयोगकर्ता डेटा को स्टोर करने और पुन: उपयोग करने का एक स्थायी और अपरिवर्तनीय लाइसेंस देती हैं, भले ही उपयोगकर्ता एक्सेस वापस ले ले, और यह AI को बिना किसी मानवीय हस्ताक्षर के उपयोगकर्ता की ओर से समझौते करने की अनुमति भी देती हैं।

AI · 3 मिनट पढ़ें

रहस्यमयी मॉडल Ox-Alpha ने DeepSWE कोडिंग बेंचमार्क पर 80% स्कोर किया, अधिकांश LLMs को पीछे छोड़ा

20 अगस्त को OpenRouter पर पोस्ट किया गया गुप्त रूप से लेबल किया गया Ox-Alpha मॉडल, 1,048,576-टोकन का कॉन्टेक्स्ट विंडो और नेटिव वीडियो इनपुट प्रदान करता है। यह डेवलपर्स को 27 अगस्त को समाप्त होने वाले इसके फ्री प्रीव्यू के दौरान एक ही प्रॉम्प्ट में पूरी रिपॉजिटरी या कई अध्यायों वाले उपन्यास डालने की सुविधा देता है।

AI · 3 मिनट पढ़ें

GLM-5.3 की शक्तिशाली साइबर सुरक्षा क्षमताओं ने Z.ai को मॉडल को API के पीछे रखने के लिए प्रेरित किया

Z.ai का कहना है कि दो सप्ताह की इस रोक से उसकी सुरक्षा टीम मॉडल की 'ऑफेंसिव-सिक्योरिटी' क्षमताओं को मुफ्त में डाउनलोड करने के लिए उपलब्ध कराने से पहले दुरुपयोग के जोखिम का आकलन कर सकेगी। यह कदम OpenAI और Anthropic द्वारा हाल ही में लगाए गए एक्सेस प्रतिबंधों के समान है।

AI · 3 मिनट पढ़ें

एजेंटिक कार्यों में मेटा का Glimmer 30B बना Qwen 3.6 से आगे, ओवरऑल प्रदर्शन में बराबरी

मुख्य आंकड़ों से इतर, कम्युनिटी टेस्टर्स ने दिखाया है कि Glimmer को सामान्य पाइपलाइनों के मुकाबले आधे VRAM के साथ एक सिंगल 24 GB GPU पर फाइन-ट्यून किया जा सकता है, वहीं इसके संक्षिप्त और आत्मविश्वास भरे लहजे ने चैटबॉट डेवलपर्स के बीच मिली-जुली प्रतिक्रियाएं पैदा की हैं।

AI · 3 मिनट पढ़ें

गूगल का EnvHarness डायनामिक स्ट्रेस टेस्ट जोड़ता है, जिससे एजेंट स्कोर में 9 अंकों तक का सुधार होता है

EnvHarness मौजूदा टेस्ट सूट्स पर तीन मॉड्यूलर एक्सटेंशन—Setup, Rule, और Link—को जोड़ता है, जो स्थितियों को रैंडमाइज करते हैं, टास्क के बीच में बाधाएं डालते हैं और एपिसोड्स को आपस में जोड़ते हैं। गूगल के आंतरिक परीक्षणों में अनदेखे कार्यों पर 9 अंकों की वृद्धि देखी गई है, हालांकि बेंचमार्क और कंप्यूटिंग लागत का खुलासा नहीं किया गया है।

AI · 2 मिनट पढ़ें

AutoGen ने 10.2 सेकंड में 90% सफलता के साथ LangGraph और CrewAI को पीछे छोड़ दिया

एक नया 107-टास्क बेंचमार्क दिखाता है कि AutoGen प्रति रन 10,700 टोकन का उपयोग करते हुए मात्र 10.2 सेकंड में 90% सफलता दर प्राप्त करता है, जो LangGraph की 85% और CrewAI की 78% सफलता दर और उनकी अधिक लेटेंसी (latency) को पीछे छोड़ देता है।

AI · 3 मिनट पढ़ें