GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

شرکت‌های فناوری پزشکی می‌توانند با دنبال کردن این دستورالعمل ۹ مرحله‌ای QMS، همین امروز هوش مصنوعی مولد را پیاده‌سازی کنند

این دستورالعمل شما را در مراحل تعریف کاربرد مورد نظر، ترسیم جریان‌های کاری، اعمال تحلیل ریسک ISO 14971، ساخت مسیرهای انتقال داده‌های پاک و ایجاد فرآیند بازبینی با حضور انسان راهنمایی می‌کند تا بتوانید از سرعت هوش مصنوعی بهره‌مند شوید، بدون اینکه ایمنی بیمار یا تاییدیه های نظارتی به خطر بیفتد.

AI · 3 min read

شرکت‌های هوش مصنوعی با ترکیب مدل‌های پیش‌بینی‌کننده، متن‌های مولد و ربات‌های معاملاتی، میلیاردها دلار هدر می‌دهند

یک گزارش جدید صنعتی هشدار می‌دهد که شرکت‌های سرمایه‌گذاری با برخورد با هوش مصنوعی به عنوان یک ابزار واحد — از طریق استفاده از مدل‌های پیش‌بینی برای ساخت سبد سهام یا سپردن هدایت معاملات به خلاصه‌های مدل‌های زبانی بزرگ — میلیاردها دلار را تلف می‌کنند که این امر منجر به قیمت‌گذاری نادرست ریسک، معاملات بیش از حد و نقض قوانین نظارتی می‌شود.

AI · 4 min read

کلاود اپوس ۵، متا موز اسپارک ۱.۱ و جمینای در صدر رتبه‌بندی مدل‌های زبانی بزرگ (LLM) سال ۲۰۲۶ قرار دارند

این بنچمارک حجم کاری یکسانی را روی ۲۰ مدل مختلف اجرا کرد که نشان داد رویکرد «مسیریابی تخصصی» می‌تواند هزینه‌های هوش مصنوعی و میزان تأخیر را به شدت کاهش دهد، در حالی که استفاده پیش‌فرض از یک مدل پرچم‌دار اغلب منجر به افزایش هزینه‌ها و دفعات تلاش مجدد می‌شود.

AI · 3 min read

x402 به عامل‌های هوش مصنوعی اجازه می‌دهد با پرداخت‌های خرد درون‌زنجیره‌ای، هزینه APIها را در چند ثانیه پرداخت کنند

پروتکل x402 وضعیت HTTP 402 را به یک محرک تجارت زنده تبدیل می‌کند که به عامل‌ها اجازه می‌دهد قیمت را از طریق JSON بخوانند، یک تراکنش بلاک‌چین را امضا کنند و داده‌ها را دریافت کنند؛ تمام این مراحل در یک چرخه درخواست واحد انجام می‌شود و نیاز به کلیدهای API یا اشتراک را حذف می‌کند.

AI · 3 min read

حجم کاری هوش مصنوعی تا سال ۲۰۲۶ به ۱۰۰۰ تراوات‌ساعت نیاز خواهد داشت – افزایش چشمگیر نیروگاه‌های پیک‌سایی فسیلی

تا سال ۲۰۲۶، مراکز داده مبتنی بر هوش مصنوعی حدود ۱۰۰۰ تراوات‌ساعت انرژی مصرف خواهند کرد – که معادل مجموع تقاضای سالانه ژاپن و آلمان است؛ موضوعی که مایکروسافت، گوگل و آمازون را به سمت انرژی هسته‌ای سوق می‌دهد، در حالی که رقبا برای حفظ پایداری محیط‌زیستی و کاهش هزینه‌ها، به دنبال سایت‌های ارزان برق‌آبی و زمین‌گرمایی هستند.

AI · 3 min read

سرور متن‌باز MCP از نوع AgenticX با آسیب‌پذیری تزریق دستور با امتیاز ۹.۸ CVSS مواجه شد

یک پژوهشگر امنیتی با اسکن ۵,۹۱۱ فایل منبع در میان ۲۴ سرور MCP سطح متوسط، یک باگ تزریق دستور در محیط ایزوله (sandbox) در AgenticX کشف کرد که به مهاجم اجازه می‌دهد دستورات دلخواه شل را به کانتینر داکر تزریق کند؛ این آسیب‌پذیری امتیاز ۹.۸ CVSS را دریافت کرده است.

AI · 3 min read

BYD HyWorldVLA Hits 90.59 PDMS on NAVSIM v1

BYD HyWorldVLA Hits 90.59 PDMS on NAVSIM v1 BYD enters the autonomous driving foundation model market. Their new model, HyWorldVLA, scored 90.59 PDMS on the NAVSIM v1 benchmark. T…

AI · 3 min read

روش پیاده‌سازی هوش مصنوعی در تولید الکترونیک

روش پیاده‌سازی هوش مصنوعی در تولید الکترونیک. از ساخت مدل‌های هوش مصنوعی بدون دلیل دست بردارید. با یک مشکل در فرآیند تولید شروع کنید. یک پروژه هوش مصنوعی موفق، یک مسئله خاص را حل می‌کند. برای مثال...

AI · 3 min read

داشبوردهای عامل هوش مصنوعی شکست‌های خاموش را نادیده می‌گیرند: مدل سیگنال سه‌لایه شکاف‌ها را آشکار می‌کند

اکثر ابزارهای نظارتی تنها زمانی وضعیت سبز نشان می‌دهند که فریم‌ورک گزارش موفقیت دهد، اما پلودهای خالی، فراخوانی‌های بیش از حد ابزار یا از دست رفتن انتقال‌ها همچنان می‌توانند سرویس‌های پایین‌دستی را مختل کرده و باعث از دست رفتن درآمد شوند.

AI · 3 min read

زیمنس با استقرار هوش مصنوعی لبه در ۱۰,۰۰۰ کارخانه، زمان توقف را تا ۵۰ درصد کاهش می‌دهد

پلتفرم هوش مصنوعی در محل زیمنس، نه تنها توقف‌های برنامه‌ریزی‌نشده را به نصف کاهش می‌دهد، بلکه ترافیک داده‌های ارسالی (upstream) را نیز حدود ۹۵ درصد کاهش می‌دهد و در مناطقی که پهنای باند ناپایدار است، مزیتی آشکار برای کارخانه‌ها ایجاد می‌کند.

AI · 4 min read

مدل GPT-5.6 Sol شرکت OpenAI با استفاده از Custom Responses API به امتیاز ۳۸.۳٪ در آزمون ARC-AGI-3 دست یافت

نرخ موفقیت ۳۸.۳ درصدی OpenAI هنگام ارزیابی با ابزار رسمی ARC-AGI-3 به ۷.۸ درصد کاهش می‌یابد، که نشان می‌دهد برتری آن ناشی از دو ترفند در زمان استنتاج (inference-time) — یعنی «استدلال حفظ‌شده» و «فشرده‌سازی متن» — است که در API اختصاصی Responses آن گنجانده شده است.

AI · 4 min read

Tunix گوگل بهره‌وری TPU را در یادگیری تقویت‌شده عامل‌محور از کمتر از ۱۰٪ به نزدیکی ظرفیت کامل می‌رساند

Tunix با انتقال تعاملات محیطی به CPUها/GPGPUهای ارزان‌قیمت و تغذیه یک بافر با توان عملیاتی بالا، اجازه می‌دهد یک یادگیرنده TPU اختصاصی به‌طور مداوم اجرا شود و استفاده معمول کمتر از ۱۰ درصدی از TPU در یادگیری تقویت‌شده عامل‌محور را به اشغال تقریباً ۱۰۰ درصدی تبدیل می‌کند.

AI · 3 min read

گوگل دریافت تنها ۲۱٪ از وظایف در میان ۱۵ میلیون تعامل با هوش مصنوعی به‌طور کامل خودکار می‌شوند

گوگل اعلام کرد که هوش مصنوعی تنها ۲۱٪ از وظایف را پوشش می‌دهد. گوگل ۱۵ میلیون تعامل با ابزارهای هوش مصنوعی خود را مورد مطالعه قرار داده است. نتایج نشان‌دهنده شکافی عظیم بین میزان به‌کارگیری هوش مصنوعی و میزان انجام کار توسط آن است. داده‌ها: • جم...

AI · 3 min read

باگ «به‌روزرسانی گم‌شده» به یک عامل اجازه می‌دهد چهار عامل دیگر را به‌طور بی‌صدا بازنویسی کند

در آزمایشی با پنج عامل همزمان، چهار عملیات نوشتن به‌طور بی‌صدا ناپدید شدند که هزینه توکن‌های آن‌ها معادل همان کارِ از دست رفته بود. افزودن مکانیزم compare-and-set تمام مشارکت‌ها را بازیابی کرد، اما مصرف توکن را از ۵ به ۹ واحد افزایش داد.

AI · 4 min read

جهش امتیازهای SWE-Bench به ۷۲.۷٪ پس از محدود شدن آزمون به ۵۰۰ مورد منتخب

امتیاز ۷۲.۷ درصدی SWE-Bench در سال ۲۰۲۵ از مجموعه‌ای محدود و بازبینی‌شده توسط انسان شامل ۵۰۰ مورد به‌دست آمده است، در حالی که رقم ۱.۹۶ درصدی در سال ۲۰۲۳ بر اساس کل کاتالوگ ۲,۲۹۴ موردی بود. این جهش چشمگیر، ناشی از تغییر در ساختار آزمون است و نه یک پیشرفت ناگهانی در هوش مصنوعی.

AI · 3 min read