GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

الاستضافة الذاتية تتفوق على تكاليف الـ API فقط بعد استهلاك 5-10 ملايين توكن شهرياً

التكلفة الحقيقية لتشغيل نموذج لغوي كبير (LLM) خاص بك مقابل استخدام الـ API. الأوزان المفتوحة مجانية، لكن تشغيلها ليس كذلك. يعتقد الكثيرون أن الاستضافة الذاتية للنماذج المفتوحة توفر المال، ولكن هذا خطأ. يجب عليك النظر...

AI · 3 دقيقة قراءة

وكيل ذكاء اصطناعي للمناوبات يقلل متوسط وقت الحل من 45 دقيقة إلى 20 دقيقة في أسبوع واحد

تركتُ وكيلاً للذكاء الاصطناعي يدير عمليات السحابة الخاصة بي لمدة أسبوع. منحتُ وكيلاً للذكاء الاصطناعي سبعة أيام لإدارة عمليات السحابة الخاصة بي. كانت هذه بيئة حقيقية، وليست مجرد عرض تجريبي. منحتُه صلاحية القراءة لأنظمة المراقبة الخاصة بي...

AI · 4 دقيقة قراءة

إطلاق Inkling (975B) صباحاً، وMoonshot AI تطلق Kimi K3 (2.8T) بعد ست عشرة ساعة

يدفع هذان الإصداران بالنماذج مفتوحة الأوزان من المشاريع الهامشية إلى صدارة مشهد الذكاء الاصطناعي، مما يمنح الشركات خيار تشغيل نماذج ضخمة محلياً بموجب ترخيص Apache 2.0، مع مضاهاة أداء النماذج مغلقة المصدر في مهام البرمجة.

AI · 3 دقيقة قراءة

كاشف انحراف سير العمل الجديد يمنع تعطل البوتات بعد تحديثات التطبيقات

يحدد الإطار خمس فئات للانحراف — واجهة المستخدم، وواجهة برمجة التطبيقات، والبيانات، والأذونات، والسياسات — ويستخدم خريطة عقود خفيفة بالإضافة إلى عمليات فحص استباقية لرصد أي عدم تطابق قبل تشغيل الوكيل المستقل، مما يمنع حالات الفشل الصامت وإعادة العمل المكلفة.

AI · 4 دقيقة قراءة

Anthropic تضيف موصلات MCP، محولةً مقتطفات كود Claude إلى تطبيقات حية

بفضل موصلات بروتوكول سياق النموذج (Model Context Protocol)، أصبح بإمكان الكود الذي ينشئه Claude الآن استدعاء قواعد البيانات أو الخدمات السحابية أو Slack مباشرة من الدردشة، مما يلغي خطوة النسخ واللصق ويسمح للمطورين بالاختبار باستخدام بيانات حقيقية فوراً.

AI · 2 دقيقة قراءة

عميل ذكاء اصطناعي أجرى 1,858 استدعاءً للأدوات في يوم واحد دون تقديم أي نتيجة

أدت خطوة تحقق مفقودة إلى تجاوز العميل لمرحلة 'التنفيذ'، مما جعله يقضي يوماً كاملاً في صياغة 1,858 تأملاً داخلياً دون استدعاء أي أداة حقيقية، مما كشف عن فخ 'الحلقة المفرغة' الذي يمكن أن يشل أي مساعد يعتمد على الأدوات.

AI · 2 دقيقة قراءة

نماذج اللغات الكبيرة تفشل في اختبار التعرف على الذات، مما يثير مخاوف بشأن سلامة استخدامها

يجبر معيار الوعي بالموقف الجديد النماذج على الإجابة على أسئلة حول طبيعتها مثل 'هل أنت ذكاء اصطناعي؟' وتعديل ردودها عند تغير سياق الحوار، مما يكشف أن العديد من نماذج اللغات الكبيرة المتفوقة لا تزال تدعي أنها بشرية أو تخفي حدود قدراتها.

AI · 2 دقيقة قراءة

تقييد التبويبات المخفية يسمح لمتصفح Chrome بإخفاء أخطاء الـ Canvas عن وكلاء اختبار الذكاء الاصطناعي

رأى وكيل الذكاء الاصطناعي نتائج JavaScript سليمة ولقطة شاشة، إلا أن تقييد التبويبات المخفية في Chrome أوقف استدعاءات requestAnimationFrame، مما ترك الـ Canvas دون رسم. يمكن معالجة هذا النجاح الزائف عبر تشغيل الاختبارات في تبويب مرئي أو إضافة فحص للتأكد من وجود بكسلات غير فارغة.

AI · 3 دقيقة قراءة

Claude Code 2.1.212 Caps Sub-Agents at 200 to Stop AI Cost Explosions

The update introduces two environment-variable caps – one for sub-agent spawns and one for web-search calls – both defaulting to 200 per session, with a 2-minute auto-background rule for long MCP calls, giving teams a concrete lever to curb runaway spend.

AI · 4 دقيقة قراءة

مشكلة عامة على GitHub تسمح لبوت ذكاء اصطناعي بتسريب كود مستودع خاص بنقرة واحدة

أظهرت مختبرات Noma Labs أن المهاجم يمكنه نشر مشكلة (issue) مصممة خصيصاً في مستودع عام، مما يؤدي إلى تفعيل وكيل ذكاء اصطناعي مرتبط بنظام التكامل المستمر (CI) ويمتلك صلاحيات القراءة للمستودعات الخاصة، ليقوم البوت بعد ذلك بتسريب تلك الملفات في المشكلة نفسها—كل ذلك دون الحاجة لسرقة بيانات الاعتماد أو استغلال منصة GitHub نفسها.

AI · 2 دقيقة قراءة

لماذا تتضخم فواتير وكلاء الـ LLM في بيئات الإنتاج – تضخم الرموز (Tokens) الخفي

في عمليات النشر الفعلية، يتراكم كل مدخل من المستخدم، ومخطط الأداة، واستجابة واجهة برمجة التطبيقات (API)، والمستند المسترجع داخل المطالبة (prompt). هذا التضخم الخفي يؤدي إلى زيادة وقت المعالجة والتكاليف بشكل تربيعي، مما يحول العرض التجريبي السلس إلى كابوس مكلف من حيث زمن الاستجابة.

AI · 3 دقيقة قراءة

X402 يحصل على إطار للمعايير، ولكن دون مجموعة اختبار للتحقق من سلطة الدفع

تحدد مؤسسة X402 الجديدة التابعة لمؤسسة Linux Foundation، والمدعومة من Visa وMastercard وStripe وGoogle، تنسيق الرسائل لمدفوعات وكلاء الذكاء الاصطناعي، لكنها تغفل أي مجموعة مطابقة أو ملف تعريف أمني أو عملية اعتماد، مما يترك ادعاء سلطة الدفع دون اختبار.

AI · 3 دقيقة قراءة

تجميع الأعطال المؤتمت يتيح لـ LIGO رصد موجات جاذبية أكثر خفوتاً

من خلال إعادة توظيف نماذج مدربة على مجموعات بيانات صور غير ذات صلة، لا يكتفي نظام LIGO الجديد بتصنيف فئات الأعطال المعروفة بدقة شبه مثالية فحسب، بل يقوم أيضاً بتجميع الظواهر الشاذة الجديدة، مما يمنح العلماء الحرية للتركيز على الفيزياء الفلكية بدلاً من التنظيف اليدوي للبيانات.

AI · 2 دقيقة قراءة

وكيل برمجة بالذكاء الاصطناعي يرسل 3 طلبات سحب (PRs) في 40 دقيقة – 40% من رسائلي كانت تصحيحات

في أمسية واحدة، أنجز الوكيل عميل MCP، ووكيل Azure AI، ووكيل M365 Copilot، ولكن تطلب الأمر 12 رسالة بشرية من أصل 30 لإعادته إلى المسار الصحيح، مما كشف عن أخطاء في انتهاك سير العمل واسترجاع السياق تطلبت إعادة كتابة الأوامر.

AI · 3 دقيقة قراءة

Anthropic تمنح Claude صلاحية الوصول إلى 1Password، مما يتيح للذكاء الاصطناعي تسجيل الدخول إلى التطبيقات بشكل مستقل

يقوم Gemini Notebook من Google الآن بفهرسة ملفات PDF والمستندات والملفات الأخرى لإجراء استعلامات فورية عبر الذكاء الاصطناعي، بينما يمكن لـ Claude من Anthropic جلب بيانات الاعتماد من 1Password لتسجيل الدخول إلى الخدمات، كما تهدف مواصفات مشتركة إلى تمكين الوكلاء من اكتشاف واستدعاء واجهات برمجة التطبيقات (APIs) دون الحاجة إلى كتابة أكواد مخصصة.

AI · 2 دقيقة قراءة

AWS Continuum تطلق وكلاء استدلال لمعالجة الثغرات البرمجية في الوقت الفعلي

يقوم وكلاء الذكاء الاصطناعي التابعون لـ AWS Continuum بمراقبة مستودعات التحكم في الإصدارات باستمرار، واقتراح الإصلاحات، بل ويمكنهم تطبيق التصحيحات مباشرة في بيئات التطوير المتكاملة (IDEs) للمطورين أو مسارات التكامل المستمر (CI pipelines)، مما يقلص من نافذة التعرض لهجمات سلاسل التوريد.

AI · 3 دقيقة قراءة