Meta Phát hành Llama 3.2 Mã nguồn mở
Meta đã mở mã nguồn Llama 3.2 cho công chúng, bổ sung thêm một mô hình 70 tỷ tham số. Bạn có thể tải mã nguồn từ GitHub hoặc Hugging Face.
Mô hình này được huấn luyện trên bộ dữ liệu 2,5 nghìn tỷ token. Meta cung cấp ba kích thước để phù hợp với các khối lượng công việc khác nhau:
- 8 B
- 30 B
- 70 B
Cả ba phiên bản đều chạy được trên các GPU và chip LPU hiện đại. Một kiến trúc mới giúp giảm 22% nhu cầu tính toán, giúp tiết kiệm chi phí và giảm mức tiêu thụ năng lượng.
Tại sao điều này lại quan trọng đối với bạn
- Chi phí thấp hơn – Các startup và nhà phát triển hiện có thể chạy các mô hình lớn mà không cần ngân sách khổng lồ.
- Hiệu suất tốt hơn – Các bài kiểm tra (benchmarks) cho thấy Llama 3.2 vượt xa nhiều đối thủ mã nguồn mở khác về khả năng lập luận và các tác vụ đa ngôn ngữ.
- Tự do thương mại – Giấy phép Apache 2.0 cho phép bạn triển khai mô hình trong doanh nghiệp mà không phải trả phí bản quyền.
- Tốc độ phần cứng – Mô hình chạy nhanh hơn 1,8 lần trên các loại chip như NVIDIA H100 và Groq LPU.
Meta đang rót 150 triệu USD vào một quỹ hỗ trợ các dự án được xây dựng trên Llama 3.2, nhằm đưa sự phát triển AI ra khỏi các phòng thí nghiệm đóng và đưa vào cộng đồng.
Nguồn: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb
Cộng đồng học tập tùy chọn: https://t.me/GyaanSetuAi
