Llama
Семейство open-weight, питающее тысячи независимых проектов.
Карточка Olya
- Особенности
- Llama — это не сервис, а семейство моделей со скачиваемыми весами: вы запускаете их сами, на своём оборудовании или через своего провайдера, минуя API от Meta. Осторожнее со словом «открытый»: это open-weight, а не открытый исходный код в строгом смысле, и лицензия требует отдельного соглашения от тех, у кого больше 700 миллионов пользователей в месяц. Именно эта доступность, а не отдельный бенчмарк, сделала её де-факто стандартом для дообучения и независимых проектов.
- Сильные стороны
- Последнее поколение, Llama 4 Scout и Maverick (апрель 2025), построено на архитектуре mixture-of-experts: 17 миллиардов активных параметров на токен при 109 и 400 миллиардах в сумме, то есть хорошая отдача при умеренной стоимости вычислений, а Scout после квантизации помещается на одну GPU H100. Обе нативно мультимодальны (текст и изображения), а Scout заявляет окно контекста до 10 миллионов токенов. Вокруг — самая широкая из существующих экосистем: локальные инструменты, оптимизированные версии и сообщества под любой сценарий.
- Когда использовать
- Она окупается, когда вам нужен контроль: данные остаются внутри, запуск on-premise или на своём хостинге, отсутствие привязки к единственному поставщику. Это естественный выбор для дообучения под конкретную область или для продукта без оплаты за каждый вызов. Хороша и просто для учёбы, ведь модель можно изучать и настраивать.
- Когда избегать
- Если возиться с инфраструктурой не хочется, закрытый готовый API приведёт к результату быстрее. Огромные окна контекста — это цифра для заголовка: реальную работу на длинных документах нужно проверять на своём случае, а не принимать на веру. И стоит следить за приверженностью Meta открытости: в 2026 году новой Llama не вышло, а компания повернула к модели с закрытыми весами — знак, что дальнейший путь менее определён, чем кажется.