Meta Merilis Llama 3.2 Secara Open Source

Meta membuka Llama 3.2 untuk publik, dengan menambahkan model berparameter 70 miliar. Anda dapat mengambil kodenya dari GitHub atau Hugging Face.

Model ini dilatih pada dataset berisi 2,5 triliun token. Meta menyediakan tiga ukuran untuk menyesuaikan berbagai beban kerja:

  • 8 B
  • 30 B
  • 70 B

Ketiganya dapat berjalan pada GPU modern dan chip LPU. Arsitektur baru memangkas kebutuhan komputasi sebesar 22%, yang berarti biaya lebih rendah dan penggunaan energi yang lebih sedikit.

Mengapa ini penting bagi Anda

  • Biaya lebih rendah – Startup dan pengembang kini dapat menjalankan model besar tanpa anggaran yang masif.
  • Performa lebih baik – Benchmark menunjukkan Llama 3.2 melampaui beberapa pesaing open-source dalam tugas penalaran dan multibahasa.
  • Kebebasan komersial – Lisensi Apache 2.0 memungkinkan Anda menerapkan model ini dalam bisnis tanpa membayar royalti.
  • Kecepatan perangkat keras – Model ini berjalan 1,8 × lebih cepat pada chip seperti NVIDIA H100 dan Groq LPU.

Meta menggelontorkan $150 juta ke dalam dana yang mendukung proyek-proyek yang dibangun di atas Llama 3.2, mendorong pengembangan AI keluar dari laboratorium tertutup menuju komunitas.

Sumber: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb

Komunitas belajar opsional: https://t.me/GyaanSetuAi