Meta 开源 Llama 3.2
Meta 向公众开放了 Llama 3.2,并新增了一个 700 亿参数的模型。你可以从 GitHub 或 Hugging Face 获取代码。
该模型在 2.5 万亿 token 的数据集上进行了训练。Meta 推出了三种规模的版本,以适应不同的工作负载:
- 8 B
- 30 B
- 70 B
这三个版本都可以在现代 GPU 和 LPU 芯片上运行。一种全新的架构将计算需求降低了 22%,这意味着更低的成本和更少的能源消耗。
这对你意味着什么
- 更低的成本 – 初创公司和开发者现在无需巨额预算即可运行大型模型。
- 更强的性能 – 基准测试显示,Llama 3.2 在推理和多语言任务上的表现超过了多个开源对手。
- 商业自由 – Apache 2.0 许可允许你在商业环境中使用该模型而无需支付版税。
- 硬件加速 – 该模型在 NVIDIA H100 和 Groq LPU 等芯片上的运行速度提升了 1.8 倍。
Meta 正在向一项基金投入 1.5 亿美元,用于支持基于 Llama 3.2 构建的项目,旨在将 AI 开发从封闭的实验室推向整个社区。
来源: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb
可选学习社区: https://t.me/GyaanSetuAi
