GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Moonshot AI مدل Kimi K3 با ۲.۸ تریلیون پارامتر را عرضه کرد، اما روی کامپیوترهای خانگی قابل اجرا نیست

Moonshot AI مدل Kimi K3 را که دارای ۲.۸ تریلیون پارامتر است، در تاریخ ۲۷ جولای برای دانلود عمومی در دسترس قرار داد، اما نیازهای سخت‌افزاری آن مستلزم خوشه‌های GPU در سطح سازمانی است و همین موضوع باعث شده توسعه‌دهندگان معمولی در حال حاضر قادر به اجرای محلی آن نباشند.

AI · 2 min read

چگونه تقسیم استدلال LLM به چهار عامل، تحلیل داده‌ها را قابل اعتماد می‌کند

در این گردش کار جدید، مدل‌های زبانی بزرگ (LLM) تنها به تصمیم‌گیری محدود می‌شوند، در حالی که اسکریپت‌های قطعی و ایزوله (sandboxed)، تمام محاسبات را انجام می‌دهند؛ این امر منجر به ارائه نتایج مرحله‌به‌مرحله و قابل راستی‌آزمایی شده و آمار ساختگی را که گریبان‌گیر تحلیل اکتشافی داده‌ها (EDA) با تک‌پرامپت است، به شدت کاهش می‌دهد.

AI · 3 min read

مطالعه ام‌آی‌تی: حقیقت‌سنج‌های هوش مصنوعی توانایی کاربران در تشخیص اخبار جعلی را کاهش می‌دهند

در یک آزمایش چهار هفته‌ای با ۶۷ شرکت‌کننده، محققان ام‌آی‌تی به یک هوش مصنوعی دقیق اجازه دادند تا درباره اخبار، احکام قطعی (درست یا نادرست) صادر کند. اگرچه هوش مصنوعی در بیشتر مواقع درست عمل می‌کرد، اما کاربرانی که به آن تکیه کرده بودند، در زمان نبود هوش مصنوعی، با کاهش قابل‌توجهی در توانایی خود برای تشخیص اطلاعات نادرست مواجه شدند.

AI · 2 min read

برتری تصاویر بر متن در جمینای: ریاضیات، خطوط غیرلاتین و جداول هزینه‌ی کمتری دارند

جمینای گوگل توکن‌های تصویر را بر اساس کاشی‌های ۷۶۸ پیکسلی محاسبه کرده و برای هر کاشی ۲۵۸ توکن دریافت می‌کند. توسعه‌دهندگان با نگه داشتن تصاویر در ابعاد کمتر از یک کاشی — یا استفاده از آن‌ها برای داده‌های متراکم مانند معادلات، جداول یا خطوط غیرلاتین — اغلب می‌توانند بسیار کمتر از زمانی که همان اطلاعات را به صورت متن ارسال می‌کنند، هزینه پرداخت کنند.

AI · 3 min read

AWS در اجلاس بوگوتا از Bedrock AgentCore برای استانداردسازی ارکستراسیون عامل‌های هوش مصنوعی رونمایی کرد

در اجلاس بوگوتا، AWS از Bedrock AgentCore رونمایی کرد؛ پلتفرمی یکپارچه که ارکستراسیون، قابلیت مشاهده‌پذیری و کنترل‌های ایمنی را در خود جای داده است و به توسعه‌دهندگان اجازه می‌دهد بدون نیاز به ساخت زیرساخت‌های سفارشی، عامل‌های هوش مصنوعی تخصصی ایجاد کنند.

AI · 4 min read

۷۵٪ از مراحل Claude Code صرف خواندن است

۷۵٪ از مراحل Claude Code صرف خواندن است. اکثر مردم فکر می‌کنند عوامل کدنویسی هوش مصنوعی وقت خود را صرف نوشتن کد می‌کنند، اما داده‌های جدید نشان می‌دهد که این تصور اشتباه است. Red Hat تعداد ۲۱۹ جلسه واقعی از Claude Code را تحلیل کرده است...

AI · 3 min read

شکست بی‌صدای قابلیت Prompt Caching در Claude

شکست بی‌صدای قابلیت Prompt Caching در Claude. ممکن است قابلیت Prompt Caching کلاود شما با خطا مواجه شود، بدون اینکه متوجه آن شوید. من قابلیت کنترل کش را به یک هندلر واتس‌اپ اضافه کردم و لاگ‌ها را برای یک...

AI · 3 min read

قابلیت Prompt-Caching در Claude Opus 5 هزینه‌های توکن چت‌بات را پس از اولین فراخوانی تا ۹۰٪ کاهش می‌دهد

هزینه نوشتن در حافظه پنهان (cache) جدید برای زمان‌های ماندگاری (TTL) ۵ دقیقه‌ای یا ۱ ساعته، ۱.۲۵ تا ۲ برابر قیمت پایه است، اما هر بار دسترسی بعدی تنها با هزینه ۰.۱ برابر محاسبه می‌شود؛ این یعنی اگر کانتکست‌های تغییرناپذیر را در ابتدا بارگذاری کنید، گفتگوهای عمیق به یک هزینه یک‌باره تبدیل می‌شوند.

AI · 3 min read

نظارت هوش مصنوعی باعث افزایش ۲۲ درصدی پست‌های کاربران جدید در ردیت بدون افزایش اسپم شد

در مراحل آزمایشی اولیه در ساب‌ردیت‌هایی مانند r/technology، نظارت مبتنی بر هوش مصنوعی ردیت فعالیت کاربران جدید را ۲۲ درصد افزایش داد، در حالی که میزان اسپم و آزارهای گزارش‌شده را ثابت نگه داشت؛ این امر نشان می‌دهد که این مدل می‌تواند بدون به خطر انداختن امنیت، موانع ورود کاربران را کاهش دهد.

AI · 2 min read

رفع مشکل استریمینگ در نسخه آزمایشی Ollama، اما فرمت‌های Chunk ممکن است همچنان باعث از کار افتادن اپلیکیشن‌ها شوند

به‌روزرسانی نسخه آزمایشی Ollama: Qwen3.5 و رفع مشکلات استریمینگ؛ نسخه Ollama v0.32.6 rc0 منتشر شد. این نسخه به‌روزرسانی‌هایی را برای کاربران پردازنده گرافیکی اپل به همراه دارد و مشکلات استریمینگ را برطرف می‌کند. ویژگی‌های جدید برای کاربران اپل: قابلیت MLX...

AI · 1 min read

GraphRAG + Persistent Memory Stops Chatbots From Forgetting On Tab Close

By converting retrieved text into a graph of entities and relationships, GraphRAG lets models reason across multiple documents, while a three-tier contextual memory stores short-term dialogue, long-term user facts, and selectively pruned data to survive page refreshes and new tabs.

AI · 3 min read

Extending Neon Polls to 15 Minutes Slashed Compute Costs

By raising the client-side refresh interval from 30 seconds to 15 minutes, the Neon database could idle long enough to scale to zero, eliminating the per-second compute charges that previously spiked the Vercel cost dashboard.

AI · 2 min read

نقص GhostApproval به دستیارهای کدنویسی هوش مصنوعی اجازه می‌دهد کلیدهای SSH شما را بازنویسی کنند

تحقیقات Wiz Research نشان داد که یک symlink مخرب در فایل project_settings.json می‌تواند شش ابزار اصلی کدنویسی هوش مصنوعی را فریب دهد تا مستقیماً در مسیر ~/.ssh/id_rsa بنویسند، در حالی که کادر تأیید فقط نام symlink را نشان می‌دهد و مسیر واقعی فایل را نمایش نمی‌دهد.

AI · 3 min read

مایکروسافت: ساخت عامل‌های هوش مصنوعی آماده‌ی اجرا، ۲۶ تا ۶۰ هفته-مهندس زمان می‌برد

این دستورالعمل جدید، هفت ستون معماری شامل اقتدار، مرزها، طرحواره‌ها، تشخیص خطا، وضعیت، بازگشت (rollback) و قابلیت حسابرسی را ترسیم می‌کند که باید پیش از عرضه هر عامل خودکار، از ابتدا بازسازی شوند؛ همچنین هشدار می‌دهد که انجام وظایف کم‌ارزش، این حجم از تلاش را توجیه نخواهد کرد.

AI · 3 min read

هوش مصنوعی Grab زمان تحویل را ۳۰٪ کاهش داد و سود عملیاتی را با ۱۸۶٪ افزایش به ۱۹ میلیون دلار رساند

مجموعه هوش مصنوعی Grab شامل مسیریابی Turbo Mode، تطبیق پیش‌بینانه و دستیار فروشندگان Mai، زمان تحویل را تا یک‌سوم کاهش داده است که باعث افزایش ۲۳ درصدی درآمد رانندگان و ۱۵ درصدی فروش رستوران‌ها شده؛ در همین حال، سود عملیاتی این پلتفرم با ۱۸۶٪ رشد به ۱۹ میلیون دلار رسیده است.

AI · 2 min read

لایه‌بندی Claude هزینه‌های API را ۳۵٪ کاهش داد و تأخیر را به ۲۷ ثانیه رساند

نویسنده با ایجاد یک سیستم جستجوی ایستا، وظایف را بر اساس میزان ابهام به مدل‌های Haiku، Sonnet یا Opus اختصاص داد و یک قانون ارتقای سطح در صورت دو بار شکست اضافه کرد. طی چهار هفته، این سیستم ضمن حفظ کیفیت، هزینه‌های API را به ۶۵٪ مقدار اولیه کاهش داد و میانگین زمان پاسخ‌گویی را از ۴۲ ثانیه به ۲۷ ثانیه رساند.

AI · 3 min read

آسیب‌پذیری RCE در FaceHugger دروازه اعتماد Diffusers را دور می‌زند و اجازه اجرای کد هنگام بارگذاری مدل را می‌دهد

باگ FaceHugger از یک شرایط رقابتی (race condition) در بارگذاری دو مرحله‌ای سوءاستفاده می‌کند و اجازه می‌دهد کد مخرب تزریق‌شده در درخواست دوم، حتی زمانی که `trust_remote_code` غیرفعال است، اجرا شود؛ این امر فرآیندهای CI/CD، کانتینرها و سرویس‌های استنتاج سازمانی را با خطر مواجه می‌کند.

AI · 2 min read

یک شمارنده در یک مرحله، قطعی کامل یک‌روزه هوش مصنوعی در محیط عملیاتی را پنهان کرد

قابلیت هوش مصنوعی من یک روز کامل از کار افتاده بود، اما معیارها نشان می‌دادند که در حال کار است. دیروز، سیستم پهپاد من چهار توضیح هوش مصنوعی را ثبت کرد، اما یک دروازه ایمنی هر چهار مورد را رد کرد. از این بابت احساس خوبی داشتم...

AI · 2 min read

سرورهای کوچک MCP در طرح رایگان، مارک‌داون را با مصرف ۱ تا ۲ میلی‌ثانیه CPU در کلودفلر ارائه می‌دهند

تست‌های ما نشان می‌دهد یک سرور MCP فقط‌خواندنی که فراخوانی‌های list و get_article را مدیریت می‌کند، تنها ۰ تا ۲ میلی‌ثانیه از CPU را برای هر درخواست مصرف می‌کند که بسیار پایین‌تر از سقف طرح رایگان کلودفلر است، اما هرگونه تجزیه (parsing) در لحظه، به سرعت به سقف ۱۰ میلی‌ثانیه خواهد رسید.

AI · 3 min read

ایجنت هرمس با اجرای ابزارهای هوش مصنوعی در محل، ریسک نشت داده را کاهش می‌دهد

ایجنت هرمس با فراهم کردن امکان استفاده از دستورات شل، عملیات ورودی/خروجی فایل و سرویس‌های سفارشی برای توسعه‌دهندگان، شکاف میان چت‌بات‌ها و دستیارهای قابل برنامه‌ریزی را پر می‌کند؛ در حالی که تمام این فرآیندها و ذخیره‌سازی بافت (context) در طول جلسات، تنها روی سخت‌افزار خود کاربر انجام می‌شود.

AI · 3 min read

اولین مجموعه ماهواره‌های آزمایشی برای اواخر سال ۲۰۲۷ جهت ارائه لینک دانلود تا ۱ ترابیت بر ثانیه

منظومه ۲۰ ماهواره‌ای مدار پایین زمین شرکت EON با استفاده از لیزرهای پرقدرت و ایستگاه‌های زمینی با شرایط آب‌وهوایی متنوع، لینک‌هایی در مقیاس ترابیت را در مسیرهای پرارزش مانند فرانسه-استرالیا فراهم می‌کند تا ظرفیت اختصاصی و با تأخیر کم را برای مشتریانِ متکی به هوش مصنوعی فراهم آورد.

AI · 4 min read