Meta ปล่อย Llama 3.2 แบบ Open Source
Meta เปิดตัว Llama 3.2 ให้สาธารณะใช้งานได้แล้ว โดยมีการเพิ่มโมเดลขนาด 7 หมื่นล้านพารามิเตอร์ คุณสามารถดึงโค้ดได้จาก GitHub หรือ Hugging Face
โมเดลนี้ได้รับการฝึกฝนด้วยชุดข้อมูลขนาด 2.5 ล้านล้านโทเคน Meta ปล่อยออกมา 3 ขนาดเพื่อให้เหมาะกับภาระงานที่แตกต่างกัน:
- 8 B
- 30 B
- 70 B
ทั้งสามขนาดสามารถรันบน GPU และชิป LPU สมัยใหม่ได้ สถาปัตยกรรมแบบใหม่ช่วยลดความต้องการในการประมวลผลลง 22% ซึ่งส่งผลให้ต้นทุนต่ำลงและใช้พลังงานน้อยลง
ทำไมเรื่องนี้ถึงสำคัญสำหรับคุณ
- ต้นทุนที่ต่ำลง – สตาร์ทอัพและนักพัฒนาสามารถรันโมเดลขนาดใหญ่ได้โดยไม่ต้องใช้บประมาณมหาศาล
- ประสิทธิภาพที่ดีขึ้น – ผลการทดสอบ (Benchmarks) แสดงให้เห็นว่า Llama 3.2 มีประสิทธิภาพเหนือกว่าคู่แข่งแบบ open-source หลายราย ทั้งในด้านการใช้เหตุผล (reasoning) และงานด้านภาษาที่หลากหลาย (multilingual tasks)
- อิสระในการใช้งานเชิงพาณิชย์ – ใบอนุญาต Apache 2.0 ช่วยให้คุณสามารถนำโมเดลไปใช้ในธุรกิจได้โดยไม่ต้องจ่ายค่าลิขสิทธิ์
- ความเร็วของฮาร์ดแวร์ – โมเดลทำงานได้เร็วขึ้น 1.8 เท่า บนชิปอย่าง NVIDIA H100 และ Groq LPU
Meta กำลังทุ่มเงิน 150 ล้านดอลลาร์ลงในกองทุนเพื่อสนับสนุนโครงการที่สร้างขึ้นบน Llama 3.2 เพื่อผลักดันการพัฒนา AI ออกจากห้องแล็บที่ปิดกั้นและเข้าสู่ชุมชนนักพัฒนา
ที่มา: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb
ชุมชนแห่งการเรียนรู้เพิ่มเติม: https://t.me/GyaanSetuAi
