Meta ने Llama 3.2 ओपन सोर्स म्हणून रिलीज केले

Meta ने Llama 3.2 सर्वांसाठी खुले केले असून, त्यात 70 बिलियन-पॅरामीटर मॉडेलचा समावेश केला आहे. तुम्ही GitHub किंवा Hugging Face वरून कोड मिळवू शकता.

हे मॉडेल 2.5 ट्रिलियन-टोकन डेटासेटवर प्रशिक्षित केले गेले आहे. Meta विविध कामांच्या स्वरूपानुसार तीन आकारांची मॉडेल्स उपलब्ध करून देत आहे:

  • 8 B
  • 30 B
  • 70 B

ही तिन्ही मॉडेल्स आधुनिक GPUs आणि LPU चिप्सवर चालतात. नवीन आर्किटेक्चरमुळे संगणकीय मागणी (compute demand) 22% ने कमी होते, ज्यामुळे खर्च कमी होतो आणि ऊर्जेचा वापरही कमी होतो.

हे तुमच्यासाठी का महत्त्वाचे आहे

  • कमी खर्च – स्टार्टअप्स आणि डेव्हलपर्स आता मोठ्या बजेटशिवाय मोठी मॉडेल्स चालवू शकतात.
  • उत्तम कामगिरी – बेंचमार्क असे दर्शवतात की Llama 3.2 तर्कक्षमता (reasoning) आणि बहुभाषिक कामांमध्ये अनेक ओपन-सोर्स प्रतिस्पर्ध्यांना मागे टाकते.
  • व्यावसायिक स्वातंत्र्य – Apache 2.0 लायसन्समुळे तुम्ही कोणतेही रॉयल्टी न भरता व्यवसायात हे मॉडेल वापरू शकता.
  • हार्डवेअर वेग – NVIDIA H100 आणि Groq LPU सारख्या चिप्सवर हे मॉडेल 1.8 × वेगाने चालते.

Meta Llama 3.2 वर आधारित प्रकल्पांना पाठबळ देण्यासाठी एका फंडमध्ये $150 मिलियन खर्च करत आहे, ज्यामुळे AI विकास बंद प्रयोगशाळांमधून बाहेर पडून समुदायापर्यंत पोहोचत आहे.

स्रोत: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb

पर्यायी लर्निंग कम्युनिटी: https://t.me/GyaanSetuAi