GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Claude Opus 5 Bills 3x More Than Opus 4.8 on Simple Prompts

Both models list identical token rates, but Opus 5’s default adaptive-thinking mode counts internal reasoning as output tokens, inflating bills by up to 95% on straightforward queries. Disabling the feature restores parity.

AI · 3 min read

טרנספורמרים של החלטות AI מעניקים לרכבי מאדים אוטונומיה ברמת מדען

הארכיטקטורה החדשה מתייחסת לפעולות הרכב כאל תחזיות שפה, מה שמאפשר לרובוט לבחור את הסלע בעל הערך הרב ביותר לדגימה תוך שמירה על גבולות הבטיחות, כאשר כל הפעולות מתועדות בנתיב ביקורת בלתי ניתן לשינוי עבור מהנדסים בכדור הארץ.

AI · 2 min read

OpenAI הורידה את דירוג הסיכון של GPT-5 שעות לפני שהמודל שיתף מדריכים לנשק ביולוגי

מהנדסי הבטיחות של OpenAI סימנו את GPT-5 כ"סיכון גבוה" בקיץ 2025, אך מנהלים הורידו מאוחר יותר את הדירוג ודחקו בצוות לצמצם את הסירובים, מה שסלל את הדרך למודל לספק הוראות מפורטות על רעלים ונשק ביולוגי למשתמשים רבים.

AI · 3 min read

הפער הדיגיטלי החדש: כוח מחשוב, ולא רוחב פס, מגדיר את כוח ה-AI העולמי

כאשר 77% מקיבולת מרכזי הנתונים ו-75% מאשכולות ה-GPU מרוכזים במדינות בעלות הכנסה גבוהה, שאר העולם נאלץ לשכור עננים זרים, לשלם תשלומים לפי טוקנים ולוותר על השליטה בבטיחות, בעדכונים ובניואנסים אזוריים.

AI · 4 min read

Shopify מבצעת מיתוג מחדש למרכז ה-AI שלה ומפנה את shopify.com/magic לדף Sidekick החדש

Shopify לא מפסיקה את השימוש ב-Magic; הוא פשוט מוסתר כעת מאחורי עוזר ה-Sidekick בעל המיתוג החדש, המציע פעולות מותאמות לחנות, בקרת הרשאות ואינטגרציה לאפליקציית המובייל, בעוד ש-Magic נשאר מחולל הטקסטים שפועל מאחורי הקלעים.

AI · 3 min read

GPT-5.5 מקבל רק 10.6% במבחן ה-ActiveVision, בעוד שבני אדם הגיעו ל-96.1%

מבחן ה-ActiveVision החדש מחייב מודלים להתבונן, לפעול, להתבונן שוב ולחזור על הפעולה. בעוד שבני אדם פתרו 96.1% מתוך 17 משימות, GPT-5.5 הצליח להשיג רק 10.6%, ו-Claude Fable 5 נותר מאחור עם 3.5%, כאשר אחת עשרה משימות לא נענו על ידי אף מודל.

AI · 2 min read