GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

دیپ‌مایند ۷۵۰۰ کلیپ مصنوعی را به یک مدل بینایی چندوظیفه‌ای با ۱۴ میلیارد پارامتر تبدیل کرد

این مدل که بر پایه معماری Wan2.1 علی‌بابا ساخته شده است، با استفاده از یک مجموعه داده بسیار کوچک رندر شده توسط Blender، مفاهیمی همچون عمق، نرمال‌ها، بخش‌بندی و ژست سه‌بعدی را فرا می‌گیرد؛ این مدل در حالی که تنها به بخش کوچکی از داده‌های آموزشی نیاز دارد، با سیستم‌های تخصصی برابری کرده یا حتی از آن‌ها پیشی می‌گیرد.

AI · 3 min read

علی‌بابا مدل Qwen 3.8 با ۲.۴ تریلیون پارامتر و وزن‌های باز را منتشر کرد

این مدل چندوجهی جدید قادر است تصاویر، کلیپ‌های ویدئویی و اسناد پیچیده را بخواند و سپس کد تولید کند، که آن را برای توسعه فول‌استک، تحلیل‌های پیشرفته و اتوماسیون جریان‌های کاری اداری ایده‌آل می‌سازد.

AI · 2 min read

xAI محیط اجرای ساخت Grok را پس از جنجال‌های مربوط به نگهداری داده‌ها، به‌صورت متن‌باز در گیت‌هاب منتشر کرد

این مخزن شامل چارچوب مبتنی بر Rust، رابط کاربری ترمینال و لایه ابزار است، اما فاقد وزن‌های مدل است؛ بنابراین کاربران باید مدل خود را تهیه کنند. بخش‌های Issues و Pull Request غیرفعال شده‌اند که اگرچه مشارکت‌های جامعه کاربری را محدود می‌کند، اما همچنان به توسعه‌دهندگان اجازه می‌دهد کدهای مربوط به مدیریت داده‌ها را بازرسی کنند.

AI · 3 min read

OpenAI Codex به تنهایی یک بازی کامل Asteroids با زبان اسمبلی ۱۶ بیتی نوشت

در این آزمایش، Codex طرح پروژه را تدوین کرد، ۱۸ فایل منبع شامل حدود ۲۵۰۰ خط کد را نوشت، مخزن Git را مدیریت کرد، فایل اجرایی DOS را ساخت و به تنهایی باگ‌ها را رفع کرد؛ مداخلات انسانی تنها به تعریف اهداف، گزارش باگ‌ها و تست بازی محدود بود.

AI · 3 min read

تعویض مدل‌های امبدینگ، آستانه‌های ایمنی را به محرک‌های توهم پنهان تبدیل می‌کند

تله‌ی آستانه در سیستم‌های RAG: تعیین یک آستانه شباهت به‌صورت ثابت (Hard-coded) خطرناک است. من برای سیستم RAG خود از آستانه پیش‌فرض ۰.۵۰ استفاده کردم. اگر شباهت کسینوسی از این عدد کمتر می‌شد...

AI · 3 min read

گوگل دیپ‌مایند، انویدیا و استنفورد-تویوتا با معرفی پنج مدل جدید رباتیک، پیشتاز رقابت VLA هستند

این پنج مدل VLA شامل RT-2، OpenVLA، GR00T، LeRobot و Pi-Zero، ورودی‌های دوربین، دستورات زبان طبیعی و خروجی‌های موتور را با هم ترکیب می‌کنند تا به ربات‌ها اجازه دهند به جای دنبال کردن توالی‌های گام‌به‌گام از پیش برنامه‌ریزی شده، مستقیماً بر اساس دستورات صوتی عمل کنند.

AI · 1 min read

TELUS با استفاده از دستیاران کدنویسی هوش مصنوعی، ۵۰۰,۰۰۰ ساعت از زمان مهندسان و ۹۰ میلیون دلار صرفه‌جویی کرد

طرح آزمایشی TELUS با اندازه‌گیری معیارهای پایه، آزمایش چندین برنامه‌نویس جفت هوش مصنوعی و ردیابی کاهش زمان چرخه، ثابت کرد که به‌کارگیری منضبط این فناوری می‌تواند تولید کدهای روتین را به یک موتور بهره‌وری چند میلیون دلاری تبدیل کند.

AI · 3 min read

Moonshot از Kimi K3 با ۲.۸ تریلیون پارامتر رونمایی کرد؛ بزرگترین مدل با وزن‌های باز

در کنفرانس جهانی هوش مصنوعی شانگهای، Moonshot AI از Kimi K3 رونمایی کرد؛ یک مدل مبتنی بر ترکیب متخصصان (mixture-of-experts) با ۲.۸ تریلیون پارامتر که با وزن‌های کاملاً باز عرضه شده است. این مدل چین را به عنوان یک منبع رقیب برای هوش مصنوعی با ظرفیت بالا، فراتر از APIهای تحت کنترل ایالات متحده، مطرح می‌کند.

AI · 2 min read

LM Studio محصول Bionic را عرضه کرد تا توسعه‌دهندگان بتوانند بدون وابستگی به یک فروشنده خاص، عامل‌های هوش مصنوعی بسازند

Bionic یک رابط کاربری مستقل از مدل، قابلیت‌های پایه داخلی برای عامل‌ها و ادغام مستقیم با IDE شرکت LM Studio را ارائه می‌دهد تا توسعه‌دهندگان بتوانند دستیارهای هوشمند را بر روی هر مدل سازگار با OpenAI یا مدل‌های میزبانی‌شده به‌صورت محلی، نمونه‌سازی، آزمایش و عرضه کنند.

AI · 2 min read

مدل‌های وزن‌باز ۶۳٪ از ترافیک توکن OpenRouter را به خود اختصاص داده‌اند؛ رشدی چشمگیر نسبت به کمتر از ۵٪ در دو سال گذشته

تحلیل موزیلا نشان می‌دهد که با کاهش ۵۰ برابری هزینه هر توکن و کاهش شکاف عملکردی، توسعه‌دهندگان به دلیل هزینه کمتر، سرعت بالاتر در توسعه و انطباق با مقررات، مدل‌های وزن‌باز را ترجیح می‌دهند.

AI · 3 min read

«انحراف هزینه عامل» پنهان؛ با افزایش شدید خواندن توکن‌ها، بودجه‌های هوش مصنوعی در خطر قرار می‌گیرند

انحراف هزینه عامل: مالیات نامرئی. من یک عامل هوش مصنوعی را مدیریت می‌کنم که هر روز دو مقاله می‌نویسد. برای جلوگیری از تکرار موضوعات، این عامل پیش از شروع کار، یک فایل گزارش کار را می‌خواند. این فایل...

AI · 3 min read

GPT-5.6-SOL در بنچمارک‌های ریاضی، فیزیک و کدنویسی چندمرحله‌ای، Kimi K3 را شکست داد

در یک آزمایش مقایسه‌ای، GPT-5.6-SOL یک مسئله احتمالات، یک سناریوی قرقره-اینرسی و یک اسکریپت پیچیده پایتون را حل کرد، در حالی که Kimi K3 با محدودیت توکن مواجه شد یا با اتمام زمان، هیچ خروجی قابل استفاده‌ای ارائه نداد.

AI · 3 min read

برتری GPT-5.6-SOL بر Kimi K3 پس از اتمام محدودیت توکن در وظایف چندمرحله‌ای

در یک آزمایش مقایسه‌ای، GPT-5.6-SOL موفق شد سه چالش پیچیده در زمینه‌های ریاضی، فیزیک و برنامه‌نویسی را با همان سقف توکن انجام دهد، در حالی که Kimi K3 مکرراً به محدودیت توکن خود رسید و با اتمام زمان (timeout) مواجه شد و توسعه‌دهندگان را بدون پاسخ نهایی رها کرد.

AI · 2 min read

ورتو آلفافولد ۶,۸۸۰ دلار قیمت دارد اما از سخت‌افزار ۱,۱۰۰ دلاری ZTE Nubia Fold استفاده می‌کند

آلفافولد جدید ورتو، یک عامل هوش مصنوعی Hermes با قابلیت اتوماسیون جریان کاری چند مرحله‌ای را با بدنه‌ای از جنس چرم گوساله و تزئینات تیتانیومی ترکیب کرده است؛ با این حال، شاسی داخلی آن مشابه ZTE Nubia Fold ۱,۱۰۰ دلاری است که سوالاتی را درباره ارزش واقعی قیمت لوکس آن برمی‌انگیزد.

AI · 2 min read

AI Agent Hand-offs Expose Data – Vendors Must Show Runtime Safeguards

The 2026 audit of MCP, A2A and ACP protocols uncovered 35 specification errors and 30 additional failures when chained, showing that a single compromised agent can silently leak data. Researchers recommend tamper-evident ledgers, least-privilege tokens, content labeling, cryptographic trace IDs, and

AI · 3 min read

پاک‌کننده‌های MCP به جای کاهش هزینه‌ها، صورت‌حساب توکن‌های Claude Code را افزایش می‌دهند

Claude Code بلافاصله پس از رسیدن پرامپت خام شما به API، توکن‌ها را ثبت می‌کند؛ بنابراین مرحله پاک‌سازی MCP زمانی اجرا می‌شود که счет‌گر قبلاً متن اصلی، فراخوانی ابزار و نسخه پاک‌سازی‌شده را محاسبه کرده است، که در نهایت باعث سه برابر شدن هزینه‌های شما می‌شود.

AI · 3 min read

تعلیق معلم هندی پس از انتشار ویدئوی چت گروهی و شکل‌گیری بحث درباره جعل با هوش مصنوعی

انتشار این ویدئو باعث ایجاد دو دیدگاه متفاوت در فضای مجازی شد: برخی نقص‌های مربوط به «دیپ‌فیک» را تشخیص دادند، در حالی که برخی دیگر استدلال کردند که صرفِ احتمال دستکاری توسط هوش مصنوعی، هر ویدئویی را غیرقابل اعتماد می‌کند؛ موضوعی که نشان‌دهنده یک نقطه کور در فناوری‌های تشخیص امروزی است.

AI · 3 min read

تغییر در تولید حافظه برای هوش مصنوعی، قیمت گوشی‌های اقتصادی در هند را ۶۸٪ افزایش داد

تولیدکنندگان تراشه در حال اختصاص ظرفیت ویفرها به حافظه‌های با پهنای باند بالا برای مراکز داده هوش مصنوعی هستند که این امر باعث کاهش عرضه رم‌های استاندارد مورد استفاده در گوشی‌های ارزان‌قیمت شده است. افزایش هزینه‌های ناشی از این تغییر، قیمت گوشی‌های هوشمند سطح پایه در هند را تا ۶۸٪ بالا برده و منجر به کاهش ۴۵ درصدی در عرضه گوشی‌های زیر ۱۵,۰۰۰ روپیه شده است.

AI · 3 min read

ابزارهای جستجوی هوش مصنوعی نام برندها را به صورت تصادفی تغییر می‌دهند؛ سیستم نظارتی جدید این موضوع را ثابت کرد

این سیستم هر دستور را ۷ تا ۸ بار در مناطق و دستگاه‌های مختلف اجرا کرده و سپس یک بازه اطمینان محاسبه می‌کند؛ نتایج نشان می‌دهد که ذکر نام برندها در ChatGPT، Claude، Gemini و سایر ابزارها، از پرس‌وجویی به پرس‌وجوی دیگر به شدت تغییر می‌کند.

AI · 3 min read