متا مدل Llama 3.2 را بهصورت متنباز منتشر کرد
متا مدل Llama 3.2 را در دسترس عموم قرار داد و یک مدل با ۷۰ میلیارد پارامتر را به آن اضافه کرد. شما میتوانید کد را از GitHub یا Hugging Face دریافت کنید.
این مدل بر روی مجموعهدادهای با ۲.۵ تریلیون توکن آموزش دیده است. متا سه اندازه مختلف را برای پاسخگویی به حجمهای کاری متفاوت عرضه میکند:
- 8B
- 30B
- 70B
هر سه نسخه روی GPUهای مدرن و تراشههای LPU اجرا میشوند. یک معماری جدید، نیاز به محاسبات را ۲۲٪ کاهش میدهد که به معنای هزینههای کمتر و مصرف انرژی پایینتر است.
چرا این موضوع برای شما اهمیت دارد
- هزینههای کمتر – استارتاپها و توسعهدهندگان اکنون میتوانند مدلهای بزرگ را بدون بودجههای کلان اجرا کنند.
- عملکرد بهتر – بنچمارکها نشان میدهند که Llama 3.2 در وظایف استدلالی و چندزبانه از چندین رقیب متنباز پیشی میگیرد.
- آزادی تجاری – مجوز Apache 2.0 به شما اجازه میدهد مدل را بدون پرداخت حق امتیاز در کسبوکارهای خود مستقر کنید.
- سرعت سختافزاری – این مدل روی تراشههایی مانند NVIDIA H100 و Groq LPU، ۱.۸ برابر سریعتر اجرا میشود.
متا ۱۵۰ میلیون دلار به صندوقی اختصاص میدهد که از پروژههای ساخته شده بر پایه Llama 3.2 حمایت میکند؛ این اقدام توسعه هوش مصنوعی را از آزمایشگاههای بسته به سمت جامعه (community) سوق میدهد.
منبع: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb
جامعه یادگیری اختیاری: https://t.me/GyaanSetuAi
