← intelligenzAI.it

Gemma

Google⚙ AI-generated content

Otwarte rodzeństwo Gemini, idealne do uruchamiania lokalnie.

Karta Olyi
Cechy szczególne
Gemma to rodzina modeli o otwartych wagach od Google, zbudowana na tych samych badaniach co Gemini, ale pomyślana tak, by pobrać ją i hostować samodzielnie na licencji Apache 2.0. Tym, co ją naprawdę wyróżnia, jest wachlarz rozmiarów: od modelu 270M, który mieści się w telefonie, po 27-31 miliardów parametrów, więc to ty wybierasz kompromis między wagą a jakością. Gemma 3 obsługuje tekst i obrazy, 128K tokenów kontekstu i ponad 140 języków; Gemma 4, wydana w 2026, poszerza kontekst i dodaje dźwięk.
Mocne strony
Działa lokalnie na sprzęcie konsumenckim: Gemma 3 w wersji 27B mieści się na jednym GPU 24 GB, takim jak RTX 3090, a mniejsze warianty sięgają laptopów i telefonów. Ponieważ ma otwarte wagi i licencję Apache 2.0, możesz używać jej komercyjnie, dostrajać na własnych danych i trzymać wszystko w obrębie swoich murów, bez wywołań zewnętrznego API. Jest wspierana wszędzie tam, gdzie to ważne: Hugging Face, Ollama, llama.cpp, JAX, PyTorch i Keras.
Kiedy jej używać
Opłaca się, gdy dane ze względów prywatności lub zgodności nie mogą opuścić twojej infrastruktury, albo gdy chcesz przewidywalnych kosztów zamiast płacić za token. To naturalny wybór do prototypowania offline, do dostrajania pod konkretną dziedzinę czy do uruchamiania czegoś użytecznego na urządzeniach brzegowych, gdzie łączność jest słaba.
Kiedy jej unikać
Jeśli potrzebujesz najwyższej klasy rozumowania przy najtrudniejszych zadaniach, zamknięte modele z pierwszej linii wciąż są z przodu i wtedy równie dobrze możesz wywołać API Gemini bezpośrednio. Pamiętaj też, że hostowanie modelu oznacza zarządzanie GPU, aktualizacjami i opóźnieniem: jeśli nie chcesz tego obciążenia operacyjnego, usługa zarządzana oszczędzi ci więcej trudu niż pieniędzy.

Źródła

  1. Google DeepMind — Gemma
  2. Google AI for Developers — Gemma releases
  3. The Keyword — Introducing Gemma 3

Commenta sul sito →