Meta publie Llama 3.2 en open source
Meta a ouvert Llama 3.2 au public, en ajoutant un modèle de 70 milliards de paramètres. Vous pouvez récupérer le code sur GitHub ou Hugging Face.
Le modèle a été entraîné sur un ensemble de données de 2,5 billions de tokens. Meta propose trois tailles pour s'adapter à différentes charges de travail :
- 8 B
- 30 B
- 70 B
Les trois fonctionnent sur des GPU modernes et des puces LPU. Une nouvelle architecture réduit la demande de calcul de 22 %, ce qui se traduit par des coûts inférieurs et une consommation d'énergie moindre.
Pourquoi c'est important pour vous
- Coûts réduits – Les startups et les développeurs peuvent désormais exécuter des modèles volumineux sans budgets massifs.
- Meilleures performances – Les benchmarks montrent que Llama 3.2 surpasse plusieurs rivaux open source sur les tâches de raisonnement et multilingues.
- Liberté commerciale – La licence Apache 2.0 vous permet de déployer le modèle dans une entreprise sans payer de redevances.
- Vitesse matérielle – Le modèle s'exécute 1,8 × plus vite sur des puces comme les NVIDIA H100 et les Groq LPU.
Meta injecte 150 millions de dollars dans un fonds qui soutient les projets basés sur Llama 3.2, sortant ainsi le développement de l'IA des laboratoires fermés pour l'amener vers la communauté.
Source : https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb
Communauté d'apprentissage optionnelle : https://t.me/GyaanSetuAi
