Gemma
Otwarte rodzeństwo Gemini, idealne do uruchamiania lokalnie.
Karta Olyi
- Cechy szczególne
- Gemma to rodzina modeli o otwartych wagach od Google, zbudowana na tych samych badaniach co Gemini, ale pomyślana tak, by pobrać ją i hostować samodzielnie na licencji Apache 2.0. Tym, co ją naprawdę wyróżnia, jest wachlarz rozmiarów: od modelu 270M, który mieści się w telefonie, po 27-31 miliardów parametrów, więc to ty wybierasz kompromis między wagą a jakością. Gemma 3 obsługuje tekst i obrazy, 128K tokenów kontekstu i ponad 140 języków; Gemma 4, wydana w 2026, poszerza kontekst i dodaje dźwięk.
- Mocne strony
- Działa lokalnie na sprzęcie konsumenckim: Gemma 3 w wersji 27B mieści się na jednym GPU 24 GB, takim jak RTX 3090, a mniejsze warianty sięgają laptopów i telefonów. Ponieważ ma otwarte wagi i licencję Apache 2.0, możesz używać jej komercyjnie, dostrajać na własnych danych i trzymać wszystko w obrębie swoich murów, bez wywołań zewnętrznego API. Jest wspierana wszędzie tam, gdzie to ważne: Hugging Face, Ollama, llama.cpp, JAX, PyTorch i Keras.
- Kiedy jej używać
- Opłaca się, gdy dane ze względów prywatności lub zgodności nie mogą opuścić twojej infrastruktury, albo gdy chcesz przewidywalnych kosztów zamiast płacić za token. To naturalny wybór do prototypowania offline, do dostrajania pod konkretną dziedzinę czy do uruchamiania czegoś użytecznego na urządzeniach brzegowych, gdzie łączność jest słaba.
- Kiedy jej unikać
- Jeśli potrzebujesz najwyższej klasy rozumowania przy najtrudniejszych zadaniach, zamknięte modele z pierwszej linii wciąż są z przodu i wtedy równie dobrze możesz wywołać API Gemini bezpośrednio. Pamiętaj też, że hostowanie modelu oznacza zarządzanie GPU, aktualizacjami i opóźnieniem: jeśli nie chcesz tego obciążenia operacyjnego, usługa zarządzana oszczędzi ci więcej trudu niż pieniędzy.