Gemma
Открытые собратья Gemini, идеальны для локального запуска.
Карточка Olya
- Особенности
- Gemma — это семейство моделей Google с открытыми весами, построенное на тех же исследованиях, что и Gemini, но рассчитанное на то, чтобы вы сами скачивали и разворачивали его под лицензией Apache 2.0. По-настоящему её выделяет разброс размеров: от модели на 270M, помещающейся в телефон, до 27-31 миллиарда параметров, так что компромисс между весом и качеством выбираете вы. Gemma 3 работает с текстом и изображениями, контекстом в 128K токенов и более чем 140 языками; Gemma 4, вышедшая в 2026 году, расширяет контекст и добавляет аудио.
- Сильные стороны
- Она работает локально на потребительском железе: Gemma 3 на 27B помещается на одну GPU с 24 ГБ вроде RTX 3090, а меньшие варианты доходят до ноутбуков и телефонов. Поскольку у неё открытые веса и лицензия Apache 2.0, вы можете использовать её коммерчески, дообучать на своих данных и держать всё внутри своих стен, без обращений к внешнему API. Её поддерживают везде, где это важно: Hugging Face, Ollama, llama.cpp, JAX, PyTorch и Keras.
- Когда использовать
- Она уместна, когда данные по соображениям приватности или соответствия требованиям не должны покидать вашу инфраструктуру, или когда нужны предсказуемые расходы вместо оплаты за токен. Это естественный выбор для офлайн-прототипирования, для дообучения под конкретную область или чтобы запустить что-то полезное на периферийных устройствах, где связь слабая.
- Когда избегать
- Если нужна рассуждающая способность высшего уровня на самых сложных задачах, закрытые передовые модели пока впереди, и для них проще напрямую обратиться к API Gemini. Помните также, что размещать модель у себя — значит управлять GPU, обновлениями и задержками: если эта эксплуатационная нагрузка вам не нужна, управляемый сервис сэкономит больше сил, чем денег.