Meta випускає Llama 3.2 з відкритим кодом

Meta відкрила доступ до Llama 3.2 для широкої публіки, додавши модель із 70 мільярдами параметрів. Ви можете завантажити код із GitHub або Hugging Face.

Модель була навчена на наборі даних обсягом 2,5 трильйона токенів. Meta пропонує три варіанти розміру для різних типів навантаження:

  • 8 B
  • 30 B
  • 70 B

Усі три варіанти працюють на сучасних GPU та чіпах LPU. Нова архітектура знижує вимоги до обчислювальних ресурсів на 22 %, що забезпечує менші витрати та менше споживання енергії.

Чому це важливо для вас

  • Нижчі витрати – Стартапи та розробники тепер можуть запускати великі моделі без величезних бюджетів.
  • Краща продуктивність – Бенчмарки показують, що Llama 3.2 випереджає кількох конкурентів з відкритим кодом у завданнях на міркування та багатомовність.
  • Комерційна свобода – Ліцензія Apache 2.0 дозволяє впроваджувати модель у бізнесі без виплати роялті.
  • Швидкість апаратного забезпечення – Модель працює у 1,8 раза швидше на таких чіпах, як NVIDIA H100 та Groq LPU.

Meta інвестує 150 мільйонів доларів у фонд, який підтримує проєкти, побудовані на Llama 3.2, виводячи розробку ШІ з закритих лабораторій у спільноту.

Джерело: https://dev.to/techpulse01239/meta-ai-unveils-llama-32-open-source-release-70b-model-3bhb

Додаткова навчальна спільнота: https://t.me/GyaanSetuAi