Meta Melancarkan Llama 3.2 Sumber Terbuka
Meta telah membuka Llama 3.2 kepada orang awam, dengan menambah model berparameter 70 bilion. Anda boleh mendapatkan kod tersebut daripada GitHub atau Hugging Face.
Model ini dilatih menggunakan set data 2.5 trilion token. Meta menyediakan tiga saiz untuk memenuhi pelbagai beban kerja:
- 8 B
- 30 B
- 70 B
Ketiga-tiganya boleh dijalankan pada GPU moden dan cip LPU. Seni bina baharu mengurangkan permintaan pengkomputeran sebanyak 22%, yang membawa kepada kos yang lebih rendah dan penggunaan tenaga yang lebih sedikit.
Mengapa ini penting untuk anda
- Kos lebih rendah – Syarikat pemula dan pembangun kini boleh menjalankan model besar tanpa bajet yang besar.
- Prestasi lebih baik – Penanda aras menunjukkan Llama 3.2 mengatasi beberapa pesaing sumber terbuka dalam tugasan penaakulan dan pelbagai bahasa.
- Kebebasan komersial – Lesen Apache 2.0 membolehkan anda menggunakan model tersebut dalam perniagaan tanpa perlu membayar royalti.
- Kelajuan perkakasan – Model ini berjalan 1.8 kali lebih pantas pada cip seperti NVIDIA H100 dan Groq LPU.
Meta menyalurkan $150 juta ke dalam dana yang menyokong projek-projek yang dibina berasaskan Llama 3.2, sekali gus memacu pembangunan AI keluar daripada makmal tertutup ke dalam komuniti.
Sumber: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb
Komuniti pembelajaran pilihan: https://t.me/GyaanSetuAi
