Meta ने Llama 3.2 ओपन सोर्स म्हणून रिलीज केले
Meta ने Llama 3.2 सर्वांसाठी खुले केले असून, त्यात 70 बिलियन-पॅरामीटर मॉडेलचा समावेश केला आहे. तुम्ही GitHub किंवा Hugging Face वरून कोड मिळवू शकता.
हे मॉडेल 2.5 ट्रिलियन-टोकन डेटासेटवर प्रशिक्षित केले गेले आहे. Meta विविध कामांच्या स्वरूपानुसार तीन आकारांची मॉडेल्स उपलब्ध करून देत आहे:
- 8 B
- 30 B
- 70 B
ही तिन्ही मॉडेल्स आधुनिक GPUs आणि LPU चिप्सवर चालतात. नवीन आर्किटेक्चरमुळे संगणकीय मागणी (compute demand) 22% ने कमी होते, ज्यामुळे खर्च कमी होतो आणि ऊर्जेचा वापरही कमी होतो.
हे तुमच्यासाठी का महत्त्वाचे आहे
- कमी खर्च – स्टार्टअप्स आणि डेव्हलपर्स आता मोठ्या बजेटशिवाय मोठी मॉडेल्स चालवू शकतात.
- उत्तम कामगिरी – बेंचमार्क असे दर्शवतात की Llama 3.2 तर्कक्षमता (reasoning) आणि बहुभाषिक कामांमध्ये अनेक ओपन-सोर्स प्रतिस्पर्ध्यांना मागे टाकते.
- व्यावसायिक स्वातंत्र्य – Apache 2.0 लायसन्समुळे तुम्ही कोणतेही रॉयल्टी न भरता व्यवसायात हे मॉडेल वापरू शकता.
- हार्डवेअर वेग – NVIDIA H100 आणि Groq LPU सारख्या चिप्सवर हे मॉडेल 1.8 × वेगाने चालते.
Meta Llama 3.2 वर आधारित प्रकल्पांना पाठबळ देण्यासाठी एका फंडमध्ये $150 मिलियन खर्च करत आहे, ज्यामुळे AI विकास बंद प्रयोगशाळांमधून बाहेर पडून समुदायापर्यंत पोहोचत आहे.
स्रोत: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb
पर्यायी लर्निंग कम्युनिटी: https://t.me/GyaanSetuAi
