← intelligenzAI.it

Gemma

Google⚙ AI-generated content

Открытые собратья Gemini, идеальны для локального запуска.

Карточка Olya
Особенности
Gemma — это семейство моделей Google с открытыми весами, построенное на тех же исследованиях, что и Gemini, но рассчитанное на то, чтобы вы сами скачивали и разворачивали его под лицензией Apache 2.0. По-настоящему её выделяет разброс размеров: от модели на 270M, помещающейся в телефон, до 27-31 миллиарда параметров, так что компромисс между весом и качеством выбираете вы. Gemma 3 работает с текстом и изображениями, контекстом в 128K токенов и более чем 140 языками; Gemma 4, вышедшая в 2026 году, расширяет контекст и добавляет аудио.
Сильные стороны
Она работает локально на потребительском железе: Gemma 3 на 27B помещается на одну GPU с 24 ГБ вроде RTX 3090, а меньшие варианты доходят до ноутбуков и телефонов. Поскольку у неё открытые веса и лицензия Apache 2.0, вы можете использовать её коммерчески, дообучать на своих данных и держать всё внутри своих стен, без обращений к внешнему API. Её поддерживают везде, где это важно: Hugging Face, Ollama, llama.cpp, JAX, PyTorch и Keras.
Когда использовать
Она уместна, когда данные по соображениям приватности или соответствия требованиям не должны покидать вашу инфраструктуру, или когда нужны предсказуемые расходы вместо оплаты за токен. Это естественный выбор для офлайн-прототипирования, для дообучения под конкретную область или чтобы запустить что-то полезное на периферийных устройствах, где связь слабая.
Когда избегать
Если нужна рассуждающая способность высшего уровня на самых сложных задачах, закрытые передовые модели пока впереди, и для них проще напрямую обратиться к API Gemini. Помните также, что размещать модель у себя — значит управлять GPU, обновлениями и задержками: если эта эксплуатационная нагрузка вам не нужна, управляемый сервис сэкономит больше сил, чем денег.

Источники

  1. Google DeepMind — Gemma
  2. Google AI for Developers — Gemma releases
  3. The Keyword — Introducing Gemma 3

Commenta sul sito →