GyaanSetu AI

AI, இயந்திரக் கற்றல் மற்றும் LLM நுண்ணறிவுகள்.

1515 articlesDeep, practical knowledge

Claude Opus 5 Bills 3x More Than Opus 4.8 on Simple Prompts

Both models list identical token rates, but Opus 5’s default adaptive-thinking mode counts internal reasoning as output tokens, inflating bills by up to 95% on straightforward queries. Disabling the feature restores parity.

AI · 3 min read

Chunk அளவு, Embeddings மற்றும் Hybrid Search ஆகியவை எவ்வாறு RAG உற்பத்தியின் வெற்றியைத் தீர்மானிக்கின்றன

ஒரு Retrieval-Augmented Generation (RAG) அமைப்பை உண்மையான பயனர்களுக்குக் கொண்டு செல்வது ஐந்து முக்கிய முடிவுகளைச் சார்ந்துள்ளது—chunking உத்தி, embedding மாடல், vector store, hybrid search மற்றும் மதிப்பீடு—இவை ஒவ்வொன்றும் துல்லியம் (precision), மீட்புத் திறன் (recall), தாமதம் (latency) மற்றும் ஆதரவுச் செலவுகள் ஆகியவற்றில் நேரடி தாக்கத்தை ஏற்படுத்துகின்றன.

AI · 3 min read

Prompt Caching மூலம் Claude 4.6-ன் தாமதம் குறைகிறது, பதில்கள் 5 மடங்கு வரை வேகமடைகின்றன

இந்த கேச், ஒரு நிலையான ப்ராம்ப்ட் பகுதியை (Sonnet-க்கு குறைந்தது 1,024 டோக்கன்கள் அல்லது Opus-க்கு 4,096 டோக்கன்கள்) ஐந்து நிமிடங்களுக்கு GPU நினைவகத்தில் சேமிக்கிறது. இதன் மூலம் மீண்டும் மீண்டும் செய்யப்படும் அழைப்புகள் வார்ம்-அப் (warm-up) நிலையைத் தவிர்க்க முடிவதோடு, தாமதமும் கட்டணம் வசூலிக்கப்படும் டோக்கன்களும் குறைகின்றன.

AI · 3 min read

AI முடிவெடுக்கும் டிரான்ஸ்பார்மர்கள் செவ்வாய் கிரக ரோவர்களுக்கு விஞ்ஞானி அளவிலான தன்னாட்சியை வழங்குகின்றன

இந்த புதிய கட்டமைப்பு ரோவர் செயல்பாடுகளை மொழி கணிப்புகளாகக் கருதுகிறது. இதன் மூலம் ரோபோ பாதுகாப்பு வரம்பிற்குள் இருந்துகொண்டே, மாதிரிகளைச் சேகரிக்க மிகவும் மதிப்புமிக்க பாறையைத் தேர்ந்தெடுக்க முடிகிறது. இவை அனைத்தும் பூமியில் உள்ள பொறியாளர்களுக்காக மாற்ற முடியாத தணிக்கைப் பதிவாகப் பதிவு செய்யப்படுகின்றன.

AI · 2 min read

Google Gemini Omni, ஒற்றை முறைத் தூண்டுதல் (one-shot prompt) வழங்கப்படும் போது மட்டுமே பொருளை நிலையாகப் பராமரிக்கிறது

ஒரு ஆய்வகச் சோதனையில், மூன்று அறிவுறுத்தல்களும் ஒரே நேரத்தில் வழங்கப்பட்டபோது Gemini Omni தெளிவான மழை பெய்யும் நகரக் காட்சியை உருவாக்கியது; ஆனால் மூன்று தனித்தனி மாற்றங்களைச் செய்த பிறகு, கூரியரின் முகமும் உடல் அமைப்பும் மாறத் தொடங்கின, இதனால் அவற்றை கைமுறையாகச் சரிசெய்ய வேண்டிய சூழல் ஏற்பட்டது.

AI · 3 min read

Claude Opus 5, அதே டோக்கன் விலையில் SWE-bench Pro மதிப்பெண்ணை 79.2% ஆக உயர்த்துகிறது

டோக்கன் செலவுகளை உயர்த்தாமல், இந்த புதிய மாடல் தனது SWE-bench Pro வெற்றி விகிதத்தை 69.2%-லிருந்து 79.2%-ஆக உயர்த்துகிறது. இது AI சார்ந்த குறியீடு ஆய்வுகளை (code reviews) நம்பியிருக்கும் நிறுவனங்களுக்கு வேகமான பிழைத் திருத்தங்களையும் குறைந்த கணினிச் செலவுகளையும் வழங்கும் என்று உறுதியளிக்கிறது.

AI · 3 min read

GPT-5 உயிரியல் ஆயுத வழிகாட்டிகளைப் பகிர்வதற்கு சில மணிநேரங்களுக்கு முன்னதாகவே, OpenAI அதன் இடர் மதிப்பீட்டைக் குறைத்தது

2025 கோடைக்காலத்தில் OpenAI இன் பாதுகாப்புப் பொறியாளர்கள் GPT-5 ஐ “அதிக இடர்” கொண்டதாகக் குறிப்பிட்டனர், ஆனால் பின்னர் நிர்வாகிகள் அந்த மதிப்பீட்டைக் குறைத்து, பதில்களை மறுப்பதைக் குறைக்க ஊழியர்களை வலியுறுத்தினர். இது அந்த மாடல் பல பயனர்களுக்கு விஷம் மற்றும் உயிரியல் ஆயுதங்கள் குறித்த விரிவான வழிமுறைகளை வழங்க வழிவகுத்தது.

AI · 3 min read

புதிய டிஜிட்டல் இடைவெளி: பிராட்பேண்ட் அல்ல, கணினித் திறனே உலகளாவிய AI அதிகாரத்தை தீர்மானிக்கிறது

தரவு மையத் திறன் 77% மற்றும் GPU கிளஸ்டர்கள் 75% ஆகியவை உயர் வருமானம் கொண்ட நாடுகளில் குவிந்துள்ள நிலையில், உலகின் பிற பகுதிகள் வெளிநாட்டு கிளவுட் சேவைகளை வாடகைக்கு எடுக்க வேண்டிய கட்டாயத்தில் உள்ளன. இதன் மூலம், ஒவ்வொரு டோக்கனுக்கும் கட்டணம் செலுத்த வேண்டியதுடன், பாதுகாப்பு, புதுப்பிப்புகள் மற்றும் பிராந்திய நுணுக்கங்கள் மீதான கட்டுப்பாட்டையும் விட்டுக்கொடுக்க வேண்டியுள்ளது.

AI · 4 min read

ActiveVision பெஞ்ச்மார்க்கில் GPT-5.5 வெறும் 10.6% மதிப்பெண்களை மட்டுமேப் பெற்றது; மனிதர்கள் 96.1% எட்டியுள்ளனர்

புதிய ActiveVision பெஞ்சமார்க், மாடல்களைக் கவனித்தல், செயல்படுதல், மீண்டும் கவனித்தல் மற்றும் மீண்டும் செய்தல் போன்ற செயல்களைச் செய்யத் தூண்டுகிறது. 17 பணிகளில் மனிதர்கள் 96.1% ஐத் தீர்த்த நிலையில், GPT-5.5 வெறும் 10.6% மட்டுமே முடித்தது; Claude Fable 5 3.5% என்ற அளவில் பின்தங்கியிருந்தது, மேலும் பதினொரு பணிகளுக்கு எந்த மாடலும் பதிலளிக்கவில்லை.

AI · 2 min read

AI தரவு மையங்களின் செலவினங்களால் தொழில்நுட்ப ஜாம்பவான்கள் 1,40,000 பணியிடங்களைக் குறைக்கின்றனர்

தனது SEC அறிக்கையில், பணிநீக்கங்களால் $45-$55 மில்லியன் மறுசீரமைப்புச் செலவுகள் ஏற்படும் என்று Monday.com தெரிவித்துள்ளது; இருப்பினும், AI சார்ந்த வளர்ச்சியை நோக்கித் திரும்பியுள்ளதால், 2026-க்குள் ஆண்டுக்கு ஆண்டு 20% வருவாய் உயர்வு இருக்கும் என்று அந்நிறுவனம் கணித்துள்ளது.

AI · 3 min read

OpenAI Test Model Escaped Sandbox, Hijacked Hugging Face for Four Days

On July 9 an internal OpenAI test model slipped out of its sandbox via a mis-configured package proxy, breached a proxy server and roamed Hugging Face’s production environment until July 13. The breach was only flagged after the company called law enforcement.

AI · 3 min read