GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

গুগল এবং অ্যানথ্রোপিক সতর্ক করেছে যে ReAct এজেন্টরা ক্লাউড বাজেট শেষ করে দিতে পারে

ReAct লুপ একটি মডেলকে তার নিজস্ব পদক্ষেপ বেছে নেওয়ার সুযোগ দেয়, কিন্তু প্রতিটি Thought-Action-Observation চক্র অতিরিক্ত ইনফারেন্স চার্জ যোগ করে, যা ল্যাটেন্সি বাড়িয়ে দেয় এবং একটি মাত্র ভুল পাঠ পুরো কাজটিকে ব্যর্থ করে দেওয়ার ঝুঁকি বাড়িয়ে দেয়।

AI · 3 min read

গুগল সোয়ার্ম এজেন্ট প্যাটার্নকে সবচেয়ে শক্তিশালী কিন্তু সবচেয়ে ব্যয়বহুল এআই ডিজাইন হিসেবে চিহ্নিত করেছে

সোয়ার্ম একটি একক তত্ত্বাবধায়কের পরিবর্তে সমমর্যাদার এজেন্টদের একটি সমতল নেটওয়ার্ক ব্যবহার করে যারা ক্রমাগত একে অপরকে মূল্যায়ন করে, তবে প্রতিটি আদান-প্রদান একটি আলাদা মডেল কল ট্রিগার করে, যা কম্পিউটিং খরচ এবং ল্যাটেন্সি নাটকীয়ভাবে বাড়িয়ে দেয়।

AI · 3 min read

ক্লাসিক RAG-এর তুলনায় এজেন্টিক রিট্রিভাল কুয়েরি খরচ ৮২ গুণ পর্যন্ত কমিয়ে দেয়

এজেন্ট কুয়েরিগুলো পুনরায় লেখে, সার্চ প্রয়োজন কি না তা সিদ্ধান্ত নেয়, জটিল প্রশ্নগুলোকে উপ-ধাপে বিভক্ত করে এবং প্রমাণ দুর্বল হলে নিজেই নিজেকে সংশোধন করে নেয়; এটি প্রতিটি দাবির জন্য উদ্ধৃতি প্রদান করে এবং টোকেন ব্যবহার নাটকীয়ভাবে কমিয়ে দেয়।

AI · 3 min read

টিকটক মার্কিন নির্মাতাদের জন্য পরীক্ষামূলকভাবে এআই ডিপফেক ডিটেক্টর চালু করেছে

Jumio-র মাধ্যমে একটি জটিল সেলফি এবং আইডি যাচাইকরণ প্রক্রিয়া সম্পন্ন করার পর, এই ঐচ্ছিক পরিষেবাটি মার্কিন নির্মাতাদের একটি ছোট গোষ্ঠীকে এমন একটি ড্যাশবোর্ড প্রদান করে, যেখানে এআই তাদের যাচাইকৃত মুখমণ্ডলের বৈশিষ্ট্যের সাথে মিল রয়েছে বলে চিহ্নিত করা যেকোনো ভিডিও বা ছবি তালিকাভুক্ত করা হয়।

AI · 1 min read

নতুন COS API ব্রাউজারদের বিভিন্ন সাইটের মধ্যে ৩৩ জিবি এআই মডেল শেয়ার করার সুযোগ দিচ্ছে

URL লুকআপের পরিবর্তে কন্টেন্ট-অ্যাড্রেসড হ্যাশ ব্যবহারের মাধ্যমে, COS API যেকোনো সাইটকে এমন একটি ফাইল অনুরোধ করার সুযোগ দেয় যার SHA-256 এটি আগে থেকেই জানে। এর ফলে ব্রাউজারগুলো পুনরায় ডাউনলোড না করেই একই ৩৩ জিবি এআই মডেল একাধিক অরিজিন থেকে সরবরাহ করতে পারে।

AI · 2 min read

আপনার ইভ্যালুয়েশন হারনেস মডেলের ত্রুটিগুলো নকল করতে পারে—দুটি বাগ 'Malformed' লেবেলের আড়ালে লুকিয়ে ছিল

আপনার মডেলের আগেই আপনার হারনেস আপনাকে মিথ্যা বলবে। আপনার ইভ্যালুয়েশন স্কোরবোর্ড জানিয়েছিল যে উভয় ইঞ্জিনই ব্যর্থ হয়েছে। Llama3.2 ৬টি কেসের মধ্যে ৫টিতে ব্যর্থ হয়েছে। Anthropic Sonnet ৬টি কেসের ৬টিই ব্যর্থ হয়েছে...

AI · 2 min read

লিনিয়ার-স্কেল ট্রান্সফরমার প্রোটিন মডেলের মেমরি ব্যবহার কোয়াড্র্যাটিক থেকে লিনিয়ারে কমিয়ে এনেছে

নতুন এই আর্কিটেকচারটি হাজার হাজার অ্যামিনো অ্যাসিডের সম্পূর্ণ চেইনকে একটি মাত্র পাসে প্রসেস করতে সক্ষম, যা দীর্ঘপাল্লার মিথস্ক্রিয়া বজায় রাখার পাশাপাশি বিশাল সিকোয়েন্স কর্পোরা ব্যবহারের মাধ্যমে ট্রেনিং প্রক্রিয়াকে আরও দ্রুত ও সাশ্রয়ী করে তোলে।

AI · 2 min read

Bedrock-এ AI কলগুলোর স্বয়ংক্রিয় বিলিংয়ের জন্য AWS x402 ‘AgentCore Payments’ চালু করেছে

নতুন x402 প্রোটোকল প্রতিটি HTTP রিকোয়েস্টে একটি পেমেন্ট টোকেন অন্তর্ভুক্ত করে, যা AI এজেন্টদের ডেটা, কম্পিউট বা API কলের জন্য স্বয়ংক্রিয়ভাবে ফি কেটে নিতে সাহায্য করে। AWS-এর Bedrock ইন্টিগ্রেশন, যার নাম AgentCore Payments, নির্বিঘ্ন মেশিন কমার্সের জন্য বিল্ট-ইন ওয়ালেট এবং ব্যয়ের সীমা যোগ করেছে।

AI · 3 min read

ক্রোম-এর WebMCP রিঅ্যাক্ট অ্যাপগুলোকে সরাসরি এআই এজেন্টদের কাছে টাইপড টুলস প্রকাশ করার সুবিধা দেয়

WebMCP ভঙ্গুর DOM-scraping-এর পরিবর্তে টাইপড টুল কলের একটি ম্যানিফেস্ট ব্যবহার করে যা রিঅ্যাক্ট কম্পোনেন্টগুলো মাউন্ট করার সময় রেজিস্টার করে, যা ক্রোম ১৪৯+ ভার্সনে এআই এজেন্টদের জন্য তাৎক্ষণিক এবং লেআউট-নিরপেক্ষ ইন্টারঅ্যাকশন প্রদান করে।

AI · 3 min read

৫৫ মিলিয়ন ডলারের ফান্ডিং রাউন্ডের পর Carebricks এজেন্টরা ল্যাব অর্ডার এবং কেয়ার প্ল্যান স্বয়ংক্রিয় করবে

Sequoia, Felicis, Optum Ventures এবং Y Combinator-এর সহায়তায়, Bunkerhill তাদের Carebricks এজেন্টগুলোর পাইলট রোলআউট করার পরিকল্পনা করছে—এটি এমন একটি সফটওয়্যার যা EHR ডেটা সংগ্রহ করতে পারে, ল্যাব অর্ডার করতে পারে এবং কেয়ার প্ল্যান আপডেট করতে পারে—যার লক্ষ্য হলো চিকিৎসকদের রুটিন সমন্বয়মূলক কাজ থেকে মুক্তি দেওয়া।

AI · 2 min read

ট্রেনিং ডেটা ৪০% কমিয়ে SEED ALFWorld স্কোর বাড়িয়ে ৯১.৮ করেছে

SEED ফ্রেমওয়ার্ক একটি পোস্ট-এপিসোড পাস যুক্ত করে যেখানে এজেন্ট তার নিজস্ব ট্রান্সক্রিপ্ট পড়ে, প্রাকৃতিক ভাষায় শিক্ষা গ্রহণ করে এবং সেগুলোকে পলিসি আপডেটে রূপান্তরিত করে—যা বিরল রিওয়ার্ড সিগন্যালগুলোকে একটি সমৃদ্ধ ও পুনরায় ব্যবহারযোগ্য ট্রেনিং সিগন্যালে পরিণত করে।

AI · 4 min read

Google Gemma-4 31B AWS Inferentia-তে টোকেন ম্যাচিংয়ে সফল হলেও দিচ্ছে অর্থহীন উত্তর

Inferentia2 INF2.24xlarge ঠিক একইভাবে CPU রেফারেন্সের টোকেন স্ট্রিমটি পুনরুৎপাদন করেছে, কিন্তু উভয় ক্ষেত্রেই চ্যাট টেমপ্লেট এবং টার্ন মার্কার বিহীন একটি ত্রুটিপূর্ণ প্রম্পট দেওয়া হয়েছিল, যার ফলে Gemma-4 অর্থহীন কথার এক অন্তহীন চক্রে পড়ে যায়। হার্ডওয়্যারটি কেবল রেফারেন্স কোডের একটি ত্রুটিকেই প্রতিফলিত করেছে।

AI · 3 min read

Solo Researcher Cuts LLM Agent Bill 31% to $651 by Logging Every Token

By adding a PostgreSQL logging layer that captured model name, token count, task type, and per-call cost, the researcher identified that raw SEC search results were inflating prompts. Summarizing those results and routing simple checks to a cheaper model drove the 31% savings and nudged accuracy up

AI · 3 min read

Upper90 জেনারেল কম্পিউটে ৪০০ মিলিয়ন ডলার বিনিয়োগ করছে, শুধুমাত্র ইনফারেন্স-ভিত্তিক চিপের ওপর বাজি ধরছে

এই ঋণের জামানত হিসেবে SambaNova-র SN50 ইনফারেন্স চিপ ব্যবহার করা হয়েছে, যা একটি অনন্য সম্পদ শ্রেণী; এটি প্রথাগত GPU ফার্মের তুলনায় ১৬ গুণ পর্যন্ত দ্রুত টোকেন প্রসেসিং, কম বিদ্যুৎ খরচ এবং সহজতর কুলিং ব্যবস্থার প্রতিশ্রুতি দেয়।

AI · 3 min read

লিনাস টরভাল্ডস সমালোচকদের একটি বিকল্প দিয়েছেন: লিনাক্স ফর্ক করুন অথবা এআই গ্রহণ করুন

টরভাল্ডস মেইলিং লিস্টে জানিয়েছেন যে, নতুন Sashiko রিভিউয়ারের মতো এআই (AI) টুলের বিরোধী যে কেউ চাইলে সহজেই কার্নেলটি ফর্ক করতে পারেন। এর মাধ্যমে তিনি তাঁর এই মতবাদকেই জোরালো করেছেন যে, প্রযুক্তিগত শ্রেষ্ঠত্ব যেকোনো আদর্শিক বাধার চেয়ে বড়।

AI · 2 min read

AA-Briefcase বেঞ্চমার্কে Moonshot-এর Kimi K3, GPT-5.6-কে হারিয়ে ১,৫২৭ স্কোর করেছে (বনাম ১,৪৯৫)

Moonshot AI-এর Kimi K3, একটি ২.৮ ট্রিলিয়ন প্যারামিটারের ওপেন-ওয়েট মডেল, বাস্তবধর্মী AA-Briefcase বেঞ্চমার্কে GPT-5.6-কে ছাড়িয়ে গেছে। এটি এখন API-এর মাধ্যমে পাওয়া যাচ্ছে এবং এর ওয়েটস ২৭ জুলাই জনসমক্ষে প্রকাশের কথা রয়েছে।

AI · 2 min read

Claude Code, Cursor 2.0 এবং OpenAI Codex IDE-গুলোকে ফুল-স্ট্যাক কন্ট্রোল রুমে পরিণত করছে

সর্বশেষ সংস্করণগুলোতে টাস্ক অর্কেস্ট্রেশন, অ্যাপ্রুভাল ওয়ার্কফ্লো, টেস্টিং রিগস এবং UI-সচেতন ব্রাউজিংয়ের সুবিধা যুক্ত করা হয়েছে, যার ফলে একটি মাত্র কনসোল থেকেই AI টিকিট নির্বাচন করা, স্বয়ংক্রিয় এজেন্ট চালানো, মানুষের অনুমোদন নেওয়া এবং ভিজ্যুয়াল প্রিভিউ রিলিজ করার মতো কাজগুলো করতে পারে।

AI · 3 min read

মিশিগান ভ্যালিডেশনে এপিকের সেপসিস অ্যালার্ট দুই-তৃতীয়াংশ কেস শনাক্ত করতে ব্যর্থ হয়েছে

সেই সেপসিস মডেল যা ডাক্তারকে প্রেডিক্ট করতে শিখেছিল; ২০২১ সালে, মিশিগান মেডিসিন এপিক সেপসিস মডেলটি পরীক্ষা করেছে। তারা ৩৮,৪৫৫টি হাসপাতালে ভর্তির ঘটনা পর্যালোচনা করেছে। এপিক দাবি করেছিল যে এর নির্ভুলতা ছিল উচ্চ...

AI · 4 min read

iPhone 17 Pro Max-এ ১১ টোকেন/সেকেন্ড গতিতে চলছে 1-Bit Bonsai 27B, মডেলের আকার কমেছে ১৪ গুণ

PrismML-এর Bonsai 27B একটি ৫৪.৭ GB ফুল-প্রিসিশন মডেল থেকে কমিয়ে মাত্র ৩.৯ GB-এর একটি 1-bit ফাইলে রূপান্তরিত হয়েছে, যা এর ৮৯.৫% গুণমান বজায় রেখে একটি ফ্ল্যাগশিপ আইফোনে ব্যবহার করা সম্ভব। এই দাবিটি অ্যাপলের MLX স্ট্যাকের ওপর ভিত্তি করে করা হয়েছে এবং এটি প্রতি সেকেন্ডে প্রায় ১১টি টোকেন প্রদান করে, তবে মেমরি, তাপ এবং ব্যাটারির ওপর এর প্রভাব এখনও পরিমাপ করা হয়নি।

AI · 3 min read

OpenAI-এর GPT-Red GPT-5.6-এর ব্যর্থতা ছয় গুণ কমিয়ে দিয়েছে, কিন্তু ছোট দলগুলোর জন্য কোনো ফ্রি টুল নেই

OpenAI-এর অভ্যন্তরীণ GPT-Red মডেলটি GPT-5.6 Sol লাইনের ব্যর্থতা ছয় গুণ কমিয়ে এনেছে, তবে গবেষণা পত্রে শুধুমাত্র তাত্ত্বিক ধারণা দেওয়া হয়েছে—কোনো ডাউনলোডযোগ্য হারনেস (harness) দেওয়া হয়নি—ফলে ছোট দলগুলোকে তাদের নিজস্ব ডিটারমিনিস্টিক টেস্ট তৈরি করে নিতে হচ্ছে।

AI · 4 min read