GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Anthropic מוסיפה מחברי MCP, והופכת קטעי קוד של Claude לאפליקציות חיות

באמצעות מחברי Model Context Protocol, קוד שנוצר על ידי Claude יכול כעת לפנות לבסיסי נתונים, שירותי ענן או Slack ישירות מהצ'אט, מה שמבטל את שלב ההעתקה-הדבקה ומאפשר למפתחים לבדוק עם נתונים אמיתיים באופן מיידי.

AI · 2 min read

AI Agent Made 1,858 Tool Calls in a Day Yet Delivered Nothing

A missing verification step let the agent skip its ‘do’ phase, so it spent a full day drafting 1,858 internal reflections without ever invoking a real tool, exposing a self-loop trap that can cripple any tool-driven assistant.

AI · 2 min read

מודלי שפה גדולים (LLMs) נכשלים במבחן זיהוי עצמי, מה שמעלה חששות בטיחות לגבי פריסתם

מדד המודעות הסיטואציונית החדש מחייב מודלים לענות על שאלות מטא כמו "האם אתה בינה מלאכותית?" ולהתאים את התגובות כאשר הדיאלוג משתנה, מה שחושף כי מודלי שפה גדולים רבים בעלי ציון גבוה עדיין טוענים שהם בני אדם או מסתירים את מגבלותיהם.

AI · 2 min read

Claude Code 2.1.212 Caps Sub-Agents at 200 to Stop AI Cost Explosions

The update introduces two environment-variable caps – one for sub-agent spawns and one for web-search calls – both defaulting to 200 per session, with a 2-minute auto-background rule for long MCP calls, giving teams a concrete lever to curb runaway spend.

AI · 4 min read

Public GitHub Issue Lets AI Bot Leak Private Repo Code in One Click

Noma Labs demonstrated that an attacker can post a crafted issue in a public repo, trigger a CI-linked AI agent with read rights to private repos, and have the bot dump those files back to the issue—all without stealing credentials or exploiting GitHub itself.

AI · 2 min read

X402 מקבלת בית לתקנים, אך ללא ערכת בדיקה לאימות סמכות התשלום

קרן X402 החדשה של קרן לינוקס (Linux Foundation), הנתמכת על ידי Visa, Mastercard, Stripe ו-Google, מגדירה את פורמט ההודעה עבור תשלומים של סוכני AI, אך אינה כוללת ערכת תאימות, פרופיל אבטחה או תהליך הסמכה, מה שמותיר את טענת הסמכות ללא בדיקה.

AI · 3 min read

מבחן השוואה חדש של 163 מקרים מאלץ את K8sGPT להודות באי-ודאות לפני פעולה

מבחן ההשוואה, שנבנה על בסיס 163 מקרים מתויגים, חורג מעבר לאבחון כדי לבחון האם עוזרי בינה מלאכותית יכולים לזהות אי-ודאות ולהימנע מפעולה במכוון, ובכך מדגיש פער בטיחות קריטי ככל שרמת הביטחון של מודלי שפה גדולים (LLM) עולה.

AI · 2 min read

Automated Glitch Clustering Lets LIGO Spot Fainter Gravitational Waves

By repurposing models trained on unrelated image datasets, LIGO’s new system not only classifies known glitch families with near-perfect precision but also clusters novel anomalies, freeing scientists to focus on astrophysics instead of manual data cleaning.

AI · 2 min read

Anthropic מעניקה ל-Claude גישה ל-1Password, מה שמאפשר לבינה מלאכותית להיכנס לאפליקציות באופן אוטונומי

Gemini Notebook של גוגל מאנדקס כעת קבצי PDF, מסמכים וקבצים אחרים לשאילתות בינה מלאכותית מיידיות, בעוד ש-Claude של Anthropic יכול לשלוף פרטי גישה מ-1Password כדי להיכנס לשירותים, ומפרט משותף שואף לאפשר לסוכנים לגלות ולהפעיל ממשקי API ללא קוד מותאם אישית.

AI · 2 min read

אינטל שוברת את השליטה של TSMC בתחום אריזת שבבי ה-AI עם חוזה ה-TPU החדש של גוגל

השינוי מחייב את גוגל לתכנן מחדש את כל מחסנית השבבים, מפריסה ועד לבדיקה, ומעמיד את יכולות התפוקה של אינטל תחת זכוכית מגדלת. הצלחה עשויה לגוון את שרשרת האספקה של שבבי ה-AI; כל מכשול עלול לעכב משלוחים ולאפשר ל-TSMC להשיב לעצמה את השליטה.

AI · 2 min read