GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Moonshot AI เปิดตัว Kimi K3 โมเดลขนาด 2.8 ล้านล้านพารามิเตอร์ แต่ไม่สามารถรันบนคอมพิวเตอร์ส่วนบุคคลได้

Moonshot AI เปิดให้ดาวน์โหลด Kimi K3 ซึ่งเป็นโมเดลขนาด 2.8 ล้านล้านพารามิเตอร์ได้แบบสาธารณะเมื่อวันที่ 27 กรกฎาคม แต่ด้วยความต้องการด้านฮาร์ดแวร์ที่ต้องใช้คลัสเตอร์ GPU ระดับองค์กร ทำให้นักพัฒนาทั่วไปยังไม่สามารถรันโมเดลนี้ในเครื่องตัวเองได้ในขณะนี้

AI · 2 min read

การแบ่งการใช้เหตุผลของ LLM ออกเป็น 4 เอเจนต์ ช่วยให้การวิเคราะห์ข้อมูลมีความน่าเชื่อถือมากขึ้น

เวิร์กโฟลว์ใหม่นี้แยกบทบาทของ LLM ให้ทำหน้าที่เพียงการตัดสินใจ ในขณะที่ใช้สคริปต์แบบ sandboxed ที่มีความแน่นอนในการคำนวณทั้งหมด ซึ่งช่วยให้ได้ผลลัพธ์ที่ตรวจสอบได้ทีละขั้นตอน และช่วยลดปัญหาการสร้างสถิติปลอมที่มักเกิดขึ้นในการทำ EDA แบบใช้พรอมต์เดียว

AI · 3 min read

ผลการศึกษาจาก MIT พบว่า AI ตรวจสอบข้อเท็จจริงทำให้ผู้ใช้งานแยกแยะข่าวปลอมได้แย่ลง

ในการทดลองเป็นเวลา 4 สัปดาห์กับผู้เข้าร่วม 67 คน นักวิจัยจาก MIT ได้ให้ AI ที่มีความแม่นยำสูงทำหน้าที่ตัดสินความถูกต้องของข่าวสาร แม้ว่า AI จะตัดสินได้ถูกต้องเป็นส่วนใหญ่ แต่ผู้ใช้งานที่พึ่งพา AI กลับมีความสามารถในการแยกแยะข้อมูลที่ผิดพลาดลดลงอย่างเห็นได้ชัดเมื่อไม่มี AI คอยช่วยเหลือ

AI · 2 min read

รูปภาพคุ้มกว่าข้อความบน Gemini: คณิตศาสตร์, อักษรที่ไม่ใช่ละติน และตาราง ช่วยประหยัดค่าใช้จ่ายได้มากกว่า

Gemini ของ Google นับโทเคนรูปภาพเป็นแผ่น (tiles) ขนาด 768 พิกเซล โดยคิดค่าบริการแผ่นละ 258 โทเคน การรักษาขนาดรูปภาพให้ไม่เกินหนึ่งแผ่น หรือการใช้รูปภาพสำหรับข้อมูลที่มีความหนาแน่นสูง เช่น สมการ ตาราง หรืออักษรที่ไม่ใช่ละติน จะช่วยให้นักพัฒนาจ่ายค่าบริการน้อยกว่าการส่งข้อมูลแบบเดียวกันในรูปแบบข้อความอย่างมาก

AI · 3 min read

AWS เปิดตัว Bedrock AgentCore เพื่อสร้างมาตรฐานการทำ AI Agent Orchestration ในงาน Bogotá Summit

ในงาน Bogotá Summit ทาง AWS ได้เปิดตัว Bedrock AgentCore แพลตฟอร์มแบบรวมศูนย์ที่รวบรวมทั้งการจัดการลำดับขั้นตอน (orchestration), การตรวจสอบ (observability) และการควบคุมความปลอดภัยเข้าไว้ด้วยกัน ช่วยให้นักพัฒนาสามารถสร้าง AI Agent เฉพาะทางขึ้นมาใช้งานได้ทันที โดยไม่ต้องสร้างโครงสร้างพื้นฐานเองตั้งแต่ต้น

AI · 4 min read

Claude Code ใช้เวลาถึง 75% ไปกับการอ่าน

Claude Code ใช้เวลาถึง 75% ไปกับการอ่าน คนส่วนใหญ่คิดว่าเอเจนต์เขียนโค้ดด้วย AI ใช้เวลาส่วนใหญ่ไปกับการเขียนโค้ด แต่ข้อมูลใหม่แสดงให้เห็นว่านั่นไม่เป็นความจริง โดย Red Hat ได้วิเคราะห์เซสชันการใช้งาน Claude Code จริงจำนวน 219 ครั้ง ต...

AI · 3 min read

Versioned Checkpoints ร่วมกับ ETag Conditional Writes ช่วยหยุดปัญหาข้อมูลสูญหายใน LangGraph

หลังจากเผชิญกับปัญหาข้อมูลสถานะสูญหายอย่างเงียบๆ มานานหลายสัปดาห์ ผู้เขียนได้ทดลองใช้ทั้ง SQLite, raw object storage และระบบไฮบริดที่ทำงานผิดพลาด ก่อนจะมาพบกับวิธีใช้ versioned envelope ร่วมกับการเขียนแบบมีเงื่อนไขโดยใช้ ETag ซึ่งเป็นลูปการอัปเดตแบบ atomic ที่ช่วยป้องกันการเขียนทับพร้อมกันและช่วยกู้คืนความน่าเชื่อถือของระบบกลับมา

AI · 3 min read

Claude Prompt Caching ล้มเหลวโดยไม่แจ้งเตือน

Claude Prompt Caching ล้มเหลวโดยไม่แจ้งเตือน การทำ Prompt Caching ของ Claude ของคุณอาจกำลังล้มเหลวโดยที่คุณไม่รู้ตัว ผมได้เพิ่ม cache control เข้าไปใน WhatsApp handler และเฝ้าดู log เพื่อ...

AI · 3 min read

Claude Opus 5 Prompt-Caching ช่วยลดต้นทุน Token ของ Chatbot ลงถึง 90% หลังจากการเรียกใช้งานครั้งแรก

การเขียนแคชแบบใหม่มีค่าใช้จ่ายเป็น 1.25 เท่า หรือ 2 เท่าของราคาพื้นฐานสำหรับ TTL แบบ 5 นาที หรือ 1 ชั่วโมง แต่การเรียกใช้งานครั้งต่อๆ ไปจะถูกคิดค่าบริการเพียง 0.1 เท่าเท่านั้น ซึ่งจะช่วยเปลี่ยนการสนทนาที่ลึกซึ้งให้กลายเป็นค่าใช้จ่ายแบบจ่ายครั้งเดียว หากคุณใส่บริบทที่ไม่มีการเปลี่ยนแปลงไว้ตั้งแต่ตอนแรก

AI · 3 min read

การแก้ไขปัญหาการสตรีมมาถึง Ollama RC แล้ว แต่รูปแบบ Chunk อาจยังทำให้แอปพลิเคชันขัดข้องได้

อัปเดต Ollama RC: Qwen3.5 และการแก้ไขปัญหาการสตรีม Ollama v0.32.6 rc0 เปิดตัวแล้ว โดยมาพร้อมการอัปเดตสำหรับผู้ใช้ Apple GPU และการแก้ไขปัญหาการสตรีม ฟีเจอร์ใหม่สำหรับผู้ใช้ Apple: MLX ช่วยให้...

AI · 1 min read

GraphRAG + Persistent Memory ช่วยให้แชทบอทไม่ลืมข้อมูลเมื่อปิดแท็บ

ด้วยการแปลงข้อความที่ดึงมาให้เป็นกราฟของเอนทิตีและความสัมพันธ์ GraphRAG ช่วยให้โมเดลสามารถใช้เหตุผลเชื่อมโยงข้อมูลจากเอกสารหลายฉบับได้ ในขณะที่หน่วยความจำเชิงบริบทแบบสามระดับจะช่วยจัดเก็บทั้งบทสนทนาระยะสั้น ข้อเท็จจริงของผู้ใช้ในระยะยาว และข้อมูลที่ผ่านการคัดกรองมาอย่างดี เพื่อให้ข้อมูลยังคงอยู่แม้จะมีการรีเฟรชหน้าเว็บหรือเปิดแท็บใหม่

AI · 3 min read

My Agent Orchestrator Blew $1-2 M Worth of Opus Tokens Per Task

The orchestrator’s sub-agents inherited the parent’s settings, defaulted to the pricey Opus tier, rewrote the cache each call and ran endless loops until a reviewer approved, inflating a simple job into a multi-million-token expense.

AI · 2 min read

การขยายเวลาการดึงข้อมูลของ Neon เป็น 15 นาที ช่วยลดค่าใช้จ่ายในการประมวลผลลงอย่างมาก

ด้วยการเพิ่มช่วงเวลาการรีเฟรชฝั่งไคลเอนต์จาก 30 วินาที เป็น 15 นาที ทำให้ฐานข้อมูล Neon สามารถอยู่ในสถานะ idle ได้นานพอที่จะ scale to zero ซึ่งช่วยกำจัดค่าใช้จ่ายในการประมวลผลแบบรายวินาทีที่เคยทำให้ค่าใช้จ่ายในแดชบอร์ดของ Vercel พุ่งสูงขึ้นก่อนหน้านี้

AI · 2 min read

ช่องโหว่ GhostApproval เปิดทางให้ผู้ช่วยเขียนโค้ด AI เขียนทับ SSH Keys ของคุณได้

Wiz Research พบว่า symlink ของไฟล์ project_settings.json ที่เป็นอันตราย สามารถหลอกเครื่องมือเขียนโค้ด AI หลัก 6 ราย ให้เขียนข้อมูลลงใน ~/.ssh/id_rsa โดยตรง และหน้าต่างขออนุมัติจะแสดงเพียงแค่ชื่อของ symlink เท่านั้น ไม่ใช่เส้นทางไฟล์ที่แท้จริง

AI · 3 min read

Microsoft Says Execution-Ready AI Agents Need 26-60 Engineer-Weeks to Build

The new playbook outlines seven architectural pillars—authority, boundaries, schemas, failure detection, state, rollback, and auditability—that must be rebuilt from scratch before any autonomous agent can be shipped, warning that low-value tasks won’t justify the effort.

AI · 3 min read

AI ของ Grab ช่วยลดเวลาจัดส่งลง 30% พร้อมดันกำไรจากการดำเนินงานพุ่ง 186% แตะ 19 ล้านดอลลาร์

ชุดเครื่องมือ AI ของ Grab ทั้งการจัดเส้นทางแบบ Turbo Mode, ระบบ Predictive Matching และผู้ช่วยร้านค้า Mai ช่วยลดระยะเวลาการจัดส่งลงได้ถึงหนึ่งในสาม ซึ่งช่วยเพิ่มรายได้ของคนขับ 23% และยอดขายของร้านอาหาร 15% ในขณะที่กำไรจากการดำเนินงานของแพลตฟอร์มพุ่งสูงขึ้นถึง 186% เป็น 19 ล้านดอลลาร์

AI · 2 min read

การแบ่งระดับ Claude ช่วยลดค่าใช้จ่าย API ลง 35% และลดความหน่วงเหลือเพียง 27 วินาที

ผู้เขียนได้สร้างระบบ static lookup เพื่อจับคู่ภารกิจตามระดับความคลุมเครือเข้ากับโมเดล Haiku, Sonnet หรือ Opus พร้อมทั้งเพิ่มกฎการยกระดับเมื่อเกิดความล้มเหลวสองครั้ง (two-failure escalation rule) โดยตลอดระยะเวลา 4 สัปดาห์ ระบบสามารถรักษาคุณภาพงานไว้ได้ ในขณะที่ลดค่าใช้จ่าย API ลงเหลือเพียง 65% ของค่าใช้จ่ายเดิม และลดเวลาดำเนินการเฉลี่ยจาก 42 วินาที เหลือเพียง 27 วินาที

AI · 3 min read

FaceHugger RCE ข้ามผ่านระบบป้องกัน Trust Gate ของ Diffusers ทำให้โค้ดทำงานได้ทันทีเมื่อโหลดโมเดล

ช่องโหว่ FaceHugger อาศัยสภาวะการแข่งขัน (race condition) ในการโหลดแบบสองขั้นตอน ทำให้โค้ดอันตรายที่ถูกฉีดเข้ามาในการร้องขอครั้งที่สองสามารถทำงานได้ แม้ว่าจะปิดการใช้งาน `trust_remote_code` อยู่ก็ตาม ซึ่งทำให้งาน CI/CD, คอนเทนเนอร์ และบริการ Inference ขององค์กรตกอยู่ในความเสี่ยง

AI · 2 min read

ตัวนับที่จุดตรวจสอบเดียวปิดบังการล่มของ AI ตลอดทั้งวันในระบบ Production

ฟีเจอร์ AI ของผมใช้งานไม่ได้ไปทั้งวัน แต่ตัวชี้วัดกลับบอกว่ามันยังทำงานอยู่ เมื่อวานนี้ระบบโดรนของผมบันทึกคำอธิบายจาก AI ได้ 4 รายการ แต่ด่านความปลอดภัยกลับปฏิเสธทั้ง 4 รายการนั้น... ซึ่งผมก็รู้สึกดีกับเรื่องนี้นะ...

AI · 2 min read

ชุดดาวเทียมสาธิตชุดแรกเตรียมปล่อยปลายปี 2027 รองรับดาวน์โหลดความเร็วสูงสุดถึง 1 Tbps

กลุ่มดาวเทียมวงโคจรต่ำ (LEO) จำนวน 20 ดวงของ EON จะใช้เลเซอร์กำลังสูงและสถานีภาคพื้นดินที่รองรับสภาพอากาศที่หลากหลาย เพื่อให้บริการเชื่อมต่อในระดับเทราบิตบนเส้นทางที่มีมูลค่าสูง เช่น ฝรั่งเศส-ออสเตรเลีย โดยมีเป้าหมายเพื่อมอบความจุเครือข่ายเฉพาะทางที่มีความหน่วงต่ำให้กับกลุ่มลูกค้าที่ใช้งาน AI อย่างหนัก

AI · 4 min read