متا مدل Llama 3.2 را به‌صورت متن‌باز منتشر کرد

متا مدل Llama 3.2 را در دسترس عموم قرار داد و یک مدل با ۷۰ میلیارد پارامتر را به آن اضافه کرد. شما می‌توانید کد را از GitHub یا Hugging Face دریافت کنید.

این مدل بر روی مجموعه‌داده‌ای با ۲.۵ تریلیون توکن آموزش دیده است. متا سه اندازه مختلف را برای پاسخگویی به حجم‌های کاری متفاوت عرضه می‌کند:

  • 8B
  • 30B
  • 70B

هر سه نسخه روی GPUهای مدرن و تراشه‌های LPU اجرا می‌شوند. یک معماری جدید، نیاز به محاسبات را ۲۲٪ کاهش می‌دهد که به معنای هزینه‌های کمتر و مصرف انرژی پایین‌تر است.

چرا این موضوع برای شما اهمیت دارد

  • هزینه‌های کمتر – استارتاپ‌ها و توسعه‌دهندگان اکنون می‌توانند مدل‌های بزرگ را بدون بودجه‌های کلان اجرا کنند.
  • عملکرد بهتر – بنچمارک‌ها نشان می‌دهند که Llama 3.2 در وظایف استدلالی و چندزبانه از چندین رقیب متن‌باز پیشی می‌گیرد.
  • آزادی تجاری – مجوز Apache 2.0 به شما اجازه می‌دهد مدل را بدون پرداخت حق امتیاز در کسب‌وکارهای خود مستقر کنید.
  • سرعت سخت‌افزاری – این مدل روی تراشه‌هایی مانند NVIDIA H100 و Groq LPU، ۱.۸ برابر سریع‌تر اجرا می‌شود.

متا ۱۵۰ میلیون دلار به صندوقی اختصاص می‌دهد که از پروژه‌های ساخته شده بر پایه Llama 3.2 حمایت می‌کند؛ این اقدام توسعه هوش مصنوعی را از آزمایشگاه‌های بسته به سمت جامعه (community) سوق می‌دهد.

منبع: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb

جامعه یادگیری اختیاری: https://t.me/GyaanSetuAi