GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Alibaba เปิดตัว Qwen 3.8 ขนาด 2.4 ล้านล้านพารามิเตอร์ แบบ Open Weights

โมเดล Multimodal ใหม่นี้สามารถอ่านรูปภาพ คลิปวิดีโอ และเอกสารที่มีความซับซ้อน แล้วนำมาสร้างเป็นโค้ดได้ ซึ่งช่วยรองรับการใช้งานทั้งการพัฒนาแบบ Full-stack, การวิเคราะห์ขั้นสูง และการสร้างระบบอัตโนมัติสำหรับเวิร์กโฟลว์ในสำนักงาน

AI · 2 min read

Branch-Replay ช่วยให้ LongStraw จัดการบริบทขนาด 2.1 ล้านโทเคนได้ด้วย GPU เพียง 8 ตัว

เทคนิค branch-replay ของ LongStraw จะทำการแคชส่วนต้นของ prompt ที่ใช้ร่วมกันในแต่ละสาขาของการ rollout โดยใช้วิธีการเล่นซ้ำแทนการคำนวณใหม่ และทำ back-propagation เฉพาะส่วนปลายที่มีความแตกต่างกันเท่านั้น ซึ่งช่วยลดภาระการคำนวณสำหรับการทำ RL ในบริบทที่ยาวลงได้ถึง 8-16 เท่า

AI · 2 min read

xAI เปิดซอร์สโค้ด Grok Build Runtime บน GitHub หลังเกิดข้อพิพาทเรื่องการเก็บรักษาข้อมูล

Repository นี้ประกอบด้วย harness ที่พัฒนาด้วยภาษา Rust, terminal UI และเลเยอร์เครื่องมือ แต่ไม่มีน้ำหนักโมเดล (model weights) มาให้ ดังนั้นผู้ใช้จึงต้องจัดเตรียมโมเดลของตนเอง นอกจากนี้ยังมีการปิดการใช้งาน Issues และ pull requests ซึ่งเป็นการจำกัดการมีส่วนร่วมของชุมชน แต่ยังช่วยให้นักพัฒนาสามารถตรวจสอบโค้ดการจัดการข้อมูลได้

AI · 3 min read

OpenAI Codex เขียนเกม Asteroids ด้วยภาษา Assembly แบบ 16 บิต ได้สำเร็จด้วยตัวคนเดียวแบบเต็มรูปแบบ

ในการทดลองนี้ Codex ได้ร่างแผนงานโครงการ, เขียนไฟล์ซอร์สโค้ด 18 ไฟล์ รวมประมาณ 2,500 บรรทัด, จัดการ Git repo, สร้างไฟล์ DOS executable และแก้ไขบั๊กด้วยตัวเอง โดยมนุษย์มีส่วนร่วมเพียงแค่การกำหนดเป้าหมาย, การรายงานบั๊ก และการทดสอบการเล่นเท่านั้น

AI · 3 min read

สัญญาณหยุดแบบ Red-line ช่วยลดรอบการทำงานของ Agent เหลือเพียง 3.3 รอบ ขณะที่การตัดสินใจด้วยตัวเองล้มเหลวที่ 8 รอบ

ผลการทดลองพบว่า Agent ที่ใช้เงื่อนไขหยุดแบบ Red-line ที่เป็นรูปธรรมหยุดทำงานหลังจากผ่านไปเฉลี่ยเพียง 3.3 รอบ ในขณะที่ Agent ที่พึ่งพาการตัดสินใจด้วยตัวเองกลับไปถึงขีดจำกัดสูงสุดที่ 8 ขั้นตอนโดยที่ยังทำงานไม่สำเร็จ ซึ่งส่งผลให้เสียรอบการทำงานโดยเปล่าประโยชน์และทำให้ผลลัพธ์ผิดเพี้ยน

AI · 3 min read

การเปลี่ยนโมเดล Embedding เปลี่ยนเกณฑ์ความปลอดภัยให้กลายเป็นตัวกระตุ้นการเกิด Hallucination แบบเงียบๆ

กับดักของ Threshold ในระบบ RAG การกำหนดค่า Threshold ของความคล้ายคลึงแบบตายตัวนั้นอันตราย ผมเคยใช้ค่าเริ่มต้นที่ 0.50 สำหรับระบบ RAG ของผม หากค่า cosine similarity ต่ำกว่าค่านี้...

AI · 3 min read

Google DeepMind, NVIDIA, Stanford-Toyota นำหน้าการแข่งขัน VLA ด้วยโมเดลหุ่นยนต์ใหม่ 5 รุ่น

โมเดล VLA ทั้ง 5 รุ่น ได้แก่ RT-2, OpenVLA, GR00T, LeRobot และ Pi-Zero ผสมผสานข้อมูลจากกล้อง คำสั่งภาษาธรรมชาติ และการควบคุมมอเตอร์เข้าด้วยกัน ช่วยให้หุ่นยนต์สามารถทำงานตามคำสั่งเสียงได้โดยตรง แทนที่จะต้องทำตามลำดับขั้นตอนที่ถูกโปรแกรมไว้ล่วงหน้า

AI · 1 min read

TELUS ประหยัดเวลาวิศวกรได้ถึง 500,000 ชั่วโมง และลดค่าใช้จ่ายได้ 90 ล้านดอลลาร์ ด้วยการใช้ AI Coding Assistants

โครงการนำร่องของ TELUS ได้ทำการวัดค่ามาตรฐาน ทดลองใช้ AI pair-programmers หลากหลายรูปแบบ และติดตามการลดลงของระยะเวลาในวงจรการทำงาน (cycle-time) ซึ่งพิสูจน์ให้เห็นว่าการนำเทคโนโลยีมาใช้อย่างเป็นระบบ สามารถเปลี่ยนการเขียนโค้ดแบบเดิมๆ ให้กลายเป็นกลไกสร้างประสิทธิภาพที่มีมูลค่ามหาศาลระดับหลายล้านดอลลาร์

AI · 3 min read

Anthropic ลดข้อจำกัด Claude Fable 5 และเปลี่ยนผู้ใช้ระดับ Pro ให้ไปใช้ API

Anthropic ลดข้อจำกัด Claude Fable 5 และเปลี่ยนผู้ใช้ระดับ Pro ให้ไปใช้ API โดย Anthropic กำลังปรับโครงสร้างวิธีการเข้าถึงโมเดล Claude Fable 5 ที่มีความต้องการสูงอย่างมีนัยสำคัญ พร้อมทั้งเริ่มนำ...

AI · 4 min read

Moonshot เปิดตัว Kimi K3 โมเดลแบบ Open-Weight ที่ใหญ่ที่สุด ด้วยพารามิเตอร์ 2.8 ล้านล้านตัว

ในงาน Shanghai World AI Conference ทาง Moonshot AI ได้เปิดตัว Kimi K3 ซึ่งเป็นโมเดลแบบ mixture-of-experts ที่มีพารามิเตอร์ถึง 2.8 ล้านล้านตัว และปล่อยออกมาแบบ open weights อย่างเต็มรูปแบบ ซึ่งเป็นการส่งสัญญาณว่าจีนกำลังก้าวขึ้นมาเป็นคู่แข่งสำคัญในการพัฒนา AI ประสิทธิภาพสูงที่นอกเหนือไปจากการพึ่งพา API ที่ควบคุมโดยสหรัฐฯ

AI · 2 min read

LM Studio เปิดตัว Bionic ช่วยให้นักพัฒนาสร้าง AI Agents ได้โดยไม่ต้องยึดติดกับผู้ให้บริการรายใดรายหนึ่ง

Bionic มาพร้อมกับอินเทอร์เฟซที่ไม่ยึดติดกับโมเดล (model-agnostic), ฟังก์ชันพื้นฐานสำหรับเอเจนต์ในตัว และการเชื่อมต่อโดยตรงกับ IDE ของ LM Studio ช่วยให้นักพัฒนาสามารถสร้างต้นแบบ ทดสอบ และใช้งานผู้ช่วยอัจฉริยะผ่านโมเดลใดก็ได้ที่รองรับ OpenAI หรือโมเดลที่รันบนเครื่องตัวเอง

AI · 2 min read

โมเดลแบบ Open-Weight ครองสัดส่วน 63% ของปริมาณการใช้งาน Token บน OpenRouter เพิ่มขึ้นจากน้อยกว่า 5% ภายในเวลาเพียงสองปี

ผลการวิเคราะห์ของ Mozilla แสดงให้เห็นว่าต้นทุนต่อ Token ลดลงถึง 50 เท่า และช่องว่างด้านประสิทธิภาพที่แคบลง ส่งผลให้นักพัฒนาหันมานิยมใช้โมเดลแบบ Open-Weight มากขึ้น เนื่องจากมีค่าใช้จ่ายที่ต่ำกว่า พัฒนาต่อยอดได้รวดเร็วกว่า และสอดคล้องกับข้อกำหนดด้านกฎระเบียบ

AI · 3 min read

ภัยเงียบ ‘Agent Cost Drift’ กำลังคุกคามงบประมาณ AI เมื่อปริมาณการอ่าน Token พุ่งสูงขึ้น

Agent Cost Drift: ภาษีที่มองไม่เห็น ผมรัน AI agent ที่เขียนบทความสองบทความในทุกๆ วัน เพื่อหลีกเลี่ยงการเขียนหัวข้อซ้ำ AI agent จะต้องอ่านไฟล์บันทึกการทำงานก่อนเริ่มงานเสมอ ซึ่งไฟล์นี้จะ...

AI · 3 min read

GPT-5.6-SOL เอาชนะ Kimi K3 ในการทดสอบประสิทธิภาพด้านคณิตศาสตร์ ฟิสิกส์ และการเขียนโค้ดแบบหลายขั้นตอน

ในการทดสอบแบบเปรียบเทียบกัน GPT-5.6-SOL สามารถแก้โจทย์ความน่าจะเป็น สถานการณ์เรื่องรอกและความเฉื่อย และสคริปต์ Python ที่ซับซ้อนได้สำเร็จ ในขณะที่ Kimi K3 ติดข้อจำกัดเรื่องโทเคนหรือหมดเวลา ทำให้ไม่สามารถให้ผลลัพธ์ที่ใช้งานได้

AI · 3 min read

Match Group Survey Finds 47% of Young Users Distrust AI in Dating

A Match Group poll of 1,000 U.S. adults 18-39 shows almost half distrust AI in romance, yet Bumble, Tinder and Hinge are racing ahead with bots, hiring cuts and new AI-only platforms, betting on algorithm-driven matchmaking despite user fears.

AI · 2 min read

Vertu Alphafold Costs $6,880 but Relies on $1,100 ZTE Nubia Fold Hardware

Vertu’s new Alphafold pairs a Hermes AI agent, capable of multi-step workflow automation, with a calfskin-wrapped, titanium-accented shell—yet its internal chassis mirrors the $1,100 ZTE Nubia Fold, raising questions about the true value of its luxury price tag.

AI · 2 min read

AI Agent Hand-offs Expose Data – Vendors Must Show Runtime Safeguards

The 2026 audit of MCP, A2A and ACP protocols uncovered 35 specification errors and 30 additional failures when chained, showing that a single compromised agent can silently leak data. Researchers recommend tamper-evident ledgers, least-privilege tokens, content labeling, cryptographic trace IDs, and

AI · 3 min read

MCP Cleaners ไม่ได้ช่วยลด แต่กลับทำให้บิลค่า Token ของ Claude Code พุ่งสูงขึ้น

Claude Code จะเริ่มนับจำนวน token ทันทีที่ prompt ดิบของคุณถูกส่งไปยัง API ดังนั้นขั้นตอนการทำความสะอาดด้วย MCP จึงเกิดขึ้นหลังจากที่ระบบได้นับจำนวนทั้งข้อความต้นฉบับ, การเรียกใช้เครื่องมือ (tool call) และข้อความที่ผ่านการทำความสะอาดแล้วไปเรียบร้อยแล้ว ส่งผลให้ค่าใช้จ่ายของคุณเพิ่มขึ้นถึงสามเท่า

AI · 3 min read

ครูชาวอินเดียถูกสั่งพักงาน หลังคลิปวิดีโอในกลุ่มแชทจุดชนวนการถกเถียงเรื่องวิดีโอปลอมจาก AI

การแพร่กระจายของคลิปดังกล่าวทำให้เกิดความเห็นแตกออกเป็นสองฝ่ายในโลกออนไลน์ โดยบางส่วนสังเกตเห็นความผิดปกติของ deep-fake ในขณะที่บางส่วนแย้งว่าเพียงแค่ความเป็นไปได้ที่จะมีการใช้ AI ปรับแต่ง ก็ทำให้วิดีโอทุกคลิปขาดความน่าเชื่อถือแล้ว ซึ่งเผยให้เห็นถึงจุดบอดของเทคโนโลยีการตรวจจับในปัจจุบัน

AI · 3 min read

AI Memory Shift Pushes Indian Entry-Level Phone Prices Up 68%

Chipmakers are redirecting wafer capacity to high-bandwidth memory for AI data centers, slashing the supply of standard RAM used in budget phones. The resulting cost hike has forced entry-level smartphones in India to rise as much as 68%, driving a 45% drop in sub-₹15,000 shipments.

AI · 3 min read

เครื่องมือค้นหาด้วย AI ให้ผลการกล่าวถึงแบรนด์ที่ไม่แน่นอนเหมือนการโยนเหรียญ ระบบตรวจสอบใหม่พิสูจน์ให้เห็นแล้ว

ระบบจะทดสอบแต่ละคำสั่ง (prompt) ประมาณ 7-8 ครั้งผ่านภูมิภาคและอุปกรณ์ที่หลากหลาย จากนั้นจึงคำนวณช่วงความเชื่อมั่น ซึ่งเผยให้เห็นว่าการกล่าวถึงแบรนด์ใน ChatGPT, Claude, Gemini และเครื่องมืออื่นๆ มีความผันผวนอย่างมากในแต่ละคำค้นหา

AI · 3 min read