Meta ปล่อย Llama 3.2 แบบ Open Source

Meta เปิดตัว Llama 3.2 ให้สาธารณะใช้งานได้แล้ว โดยมีการเพิ่มโมเดลขนาด 7 หมื่นล้านพารามิเตอร์ คุณสามารถดึงโค้ดได้จาก GitHub หรือ Hugging Face

โมเดลนี้ได้รับการฝึกฝนด้วยชุดข้อมูลขนาด 2.5 ล้านล้านโทเคน Meta ปล่อยออกมา 3 ขนาดเพื่อให้เหมาะกับภาระงานที่แตกต่างกัน:

  • 8 B
  • 30 B
  • 70 B

ทั้งสามขนาดสามารถรันบน GPU และชิป LPU สมัยใหม่ได้ สถาปัตยกรรมแบบใหม่ช่วยลดความต้องการในการประมวลผลลง 22% ซึ่งส่งผลให้ต้นทุนต่ำลงและใช้พลังงานน้อยลง

ทำไมเรื่องนี้ถึงสำคัญสำหรับคุณ

  • ต้นทุนที่ต่ำลง – สตาร์ทอัพและนักพัฒนาสามารถรันโมเดลขนาดใหญ่ได้โดยไม่ต้องใช้บประมาณมหาศาล
  • ประสิทธิภาพที่ดีขึ้น – ผลการทดสอบ (Benchmarks) แสดงให้เห็นว่า Llama 3.2 มีประสิทธิภาพเหนือกว่าคู่แข่งแบบ open-source หลายราย ทั้งในด้านการใช้เหตุผล (reasoning) และงานด้านภาษาที่หลากหลาย (multilingual tasks)
  • อิสระในการใช้งานเชิงพาณิชย์ – ใบอนุญาต Apache 2.0 ช่วยให้คุณสามารถนำโมเดลไปใช้ในธุรกิจได้โดยไม่ต้องจ่ายค่าลิขสิทธิ์
  • ความเร็วของฮาร์ดแวร์ – โมเดลทำงานได้เร็วขึ้น 1.8 เท่า บนชิปอย่าง NVIDIA H100 และ Groq LPU

Meta กำลังทุ่มเงิน 150 ล้านดอลลาร์ลงในกองทุนเพื่อสนับสนุนโครงการที่สร้างขึ้นบน Llama 3.2 เพื่อผลักดันการพัฒนา AI ออกจากห้องแล็บที่ปิดกั้นและเข้าสู่ชุมชนนักพัฒนา

ที่มา: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb

ชุมชนแห่งการเรียนรู้เพิ่มเติม: https://t.me/GyaanSetuAi