Google wprowadza Gemma 3: nową otwartą sztuczną inteligencję zoptymalizowaną pod kątem pojedynczego procesora graficznego

Ostatnia aktualizacja: 12 marca 2025
  • Gemma 3 to nowy, otwarty model sztucznej inteligencji firmy Google, zaprojektowany do wydajnej pracy na pojedynczym procesorze graficznym.
  • Dostępny w 1, 4, 12 i 27 milionach parametrów, umożliwia dostosowanie do potrzeb użytkownika.
  • Oferuje obsługę 140 języków i zaawansowane funkcje, takie jak analiza obrazu, tekstu i wideo.
  • Zawiera ShieldGemma 2, narzędzie zabezpieczające, które klasyfikuje obrazy na podstawie ich zawartości.

Google Gemma 3 AI

Google zaprezentowało nową serię otwartych modeli AI – Gemma 3. Ta wersja oferuje znaczące optymalizacje wydajności, umożliwiając działanie na jednym procesorze graficznym (GPU) . Dzięki tej strategii firma dąży do ułatwienia dostępu do zaawansowanych modeli AI bez konieczności kosztownej infrastruktury.

Rodzina Gemma została wprowadzona na rynek w lutym ubiegłego roku z modelami obsługującymi 2 i 2.000 miliardów parametrów , a w maju została zaktualizowana o Gemmę 7.000, która osiągnęła 27.000 miliardów parametrów . Teraz, dzięki Gemmie 3, Google rozszerza swoją ofertę o lżejsze, bardziej wszechstronne i wydajne opcje dla programistów.

Nowe możliwości i ulepszenia w dziedzinie sztucznej inteligencji

Model Google Gemma 3

Gemma 3 została zaprojektowana z myślą o zapewnieniu optymalnej wydajności w szerokiej gamie urządzeń, od komputerów po smartfony. Jest oferowana w wariantach z 1, 4, 12 i 27 milionami parametrów , co pozwala na dostosowanie jej implementacji do różnych wymagań.

Jednym z najbardziej godnych uwagi aspektów tego modelu jest jego oparcie na tej samej technologii, co Gemini 2.0 , co zapewnia doskonałą wydajność. Według testów rankingowych LMArena, Gemma 3 przewyższa modele takie jak Llama-405B firmy Meta, DeepSeek-V3 i o3-mini firmy OpenAI , szczególnie w środowiskach opartych na procesorach graficznych Nvidia.

  Transformacja cyfrowa w firmach: dane, sztuczna inteligencja i zmiana kulturowa

Co więcej, nowy model jest zoptymalizowany pod kątem obsługi 140 języków i jest natychmiast dostępny w ponad 35 językach , co ułatwia jego integrację na różnych rynkach.

Zaawansowane funkcje i automatyzacja

Wśród głównych funkcji Gemma 3 znajduje się możliwość tworzenia i analizy treści w wielu formatach , w tym tekstu, obrazów i krótkich filmów. Okno kontekstowe tokenów o pojemności 128 KB zapewnia większą wydajność przetwarzania informacji.

Umożliwia także wywoływanie funkcji i generowanie ustrukturyzowanego wyniku , co ułatwia automatyzację zadań i wdrażanie interaktywnych doświadczeń w aplikacjach.

ShieldGemma 2: Weryfikacja bezpieczeństwa obrazu

Wraz z premierą Gemma 3, Google wprowadziło ShieldGemma 2 , narzędzie do weryfikacji bezpieczeństwa oparte na sztucznej inteligencji. Ten model parametrów 4B analizuje obrazy i klasyfikuje je na trzy kategorie: niebezpieczne, o charakterze seksualnym i brutalne . Pozwala to programistom dostosować systemy bezpieczeństwa do specyficznych potrzeb użytkowników.

Narzędzie to ma zapewnić odpowiedzialne i bezpieczne korzystanie ze sztucznej inteligencji, promując najlepsze praktyki w zakresie wdrażania modeli sztucznej inteligencji w różnych zastosowaniach.

Dostępność i integracja

Platformy obsługiwane przez Gemma 3

Gemma 3 jest teraz dostępna do integracji z wieloma platformami i środowiskami programistycznymi, w tym Hugging Face, Kaggle, Google AI Edge i Vertex AI . Można jej również używać z poziomu Google AI Studio , aby ułatwić jej wdrażanie w różnych projektach i eksperymentach AI.

W ramach swojego zaangażowania w odpowiedzialny rozwój sztucznej inteligencji firma Google przeprowadziła rygorystyczną ocenę ryzyka , aby upewnić się, że jej modele są zgodne z protokołami i standardami bezpieczeństwa zgodnymi z odpowiedzialnością technologiczną.

  Kompletny przewodnik po tworzeniu deepfake’ów: techniki, narzędzia i ryzyko

Ta nowa wersja stanowi ważny krok w kierunku demokratyzacji otwartej sztucznej inteligencji, zapewniając wydajne narzędzia dostępne dla każdego użytkownika lub programisty bez konieczności stosowania skomplikowanej infrastruktury.