- A Gemma 3 a Google új nyílt mesterségesintelligencia-modellje, amelyet egyetlen GPU-n történő hatékony működésre terveztek.
- 1, 4, 12 és 27 milliós paraméterben kapható, a felhasználói igényekhez igazíthatóságot tesz lehetővé.
- 140 nyelv támogatását és olyan speciális funkciókat kínál, mint a kép-, szöveg- és videóelemzés.
- Tartalmazza a ShieldGemma 2 biztonsági eszközt, amely tartalmuk alapján osztályozza a képeket.

A Google bemutatta új, nyílt mesterséges intelligencia alapú modellsorozatát, a Gemma 3-at. Ez a verzió jelentős teljesítményoptimalizálást kínál, lehetővé téve, hogy egyetlen grafikus feldolgozóegységen (GPU) fusson . Ezzel a stratégiával a vállalat célja, hogy drága infrastruktúra nélkül is hozzáférést biztosítson a fejlett mesterséges intelligencia modellekhez.
A Gemma családot tavaly februárban indították útjára 2 és 2.000 milliárd paramétert kezelő modellekkel , májusban pedig frissítették a Gemma 7.000-vel, amely elérte a 27.000 milliárd paramétert . Most a Gemma 3-mal a Google könnyebb, sokoldalúbb és hatékonyabb fejlesztői lehetőségeket kínál.
Új képességek és fejlesztések az AI-ban
A Gemma 3-at úgy tervezték, hogy optimális teljesítményt biztosítson számos eszközön, a számítógépektől az okostelefonokig. 1, 4, 12 és 27 millió paraméterrel rendelkező változatokban érhető el , így a megvalósítása a különböző igényekhez igazítható.
A modell egyik legfigyelemreméltóbb aspektusa, hogy a Gemini 2.0 alapjául szolgáló technológiára épül , ami kiváló teljesítményt biztosít. Az LMArena rangsoroló tesztjei szerint a Gemma 3 felülmúlja az olyan modelleket, mint a Meta Llama-405B, a DeepSeek-V3 és az OpenAI o3-mini , különösen Nvidia GPU -alapú környezetekben.
Továbbá ez az új modell 140 nyelv támogatására van optimalizálva , több mint 35 nyelven azonnal elérhető , megkönnyítve a különböző piacokra való integrációját.
Speciális funkciók és automatizálás
Főbb funkciói között a Gemma 3 lehetővé teszi a tartalom létrehozását és elemzését többféle formátumban , beleértve a szöveget, képeket és rövid videókat. A 128K tokenes kontextuális ablak nagyobb információfeldolgozási kapacitást biztosít.
Képes függvényhívások és strukturált kimenet végrehajtására is , ami megkönnyíti a feladatautomatizálást és az interaktív élmények megvalósítását az alkalmazásokon belül.
ShieldGemma 2: Képbiztonsági ellenőrzés
A Gemma 3 megjelenésével együtt a Google bemutatta a ShieldGemma 2-t , egy mesterséges intelligencia által vezérelt biztonsági ellenőrzőt. Ez a 4B paraméteres modell elemzi a képeket, és három tartalmi kategóriába sorolja azokat: veszélyes, szexuálisan explicit és erőszakos . Ez lehetővé teszi a fejlesztők számára, hogy biztonsági rendszereiket a felhasználók egyedi igényeinek megfelelően testreszabják.
Ez az eszköz a mesterséges intelligencia felelős és biztonságos használatának biztosítására törekszik, népszerűsítve a legjobb gyakorlatokat a mesterséges intelligencia-modellek különféle alkalmazásokban történő megvalósításában.
Hozzáférhetőség és integráció

A Gemma 3 mostantól több platformmal és fejlesztői környezettel is integrálható, beleértve a Hugging Face-t, a Kaggle-t, a Google AI Edge-et és a Vertex AI-t . A Google AI Studio- ból is használható a különféle MI-projektekben és -kísérletekben való telepítés megkönnyítésére.
A mesterséges intelligencia felelősségteljes fejlesztése iránti elkötelezettségének részeként a Google szigorú kockázatértékelést végzett , biztosítva, hogy modelljei megfeleljenek a technológiai felelősséggel összhangban lévő biztonsági protokolloknak és szabványoknak.
Ez az új kiadás fontos lépést jelent a nyílt mesterséges intelligencia demokratizálása felé, nagy teljesítményű eszközöket biztosítva , amelyek bármely felhasználó vagy fejlesztő számára elérhetők komplex infrastruktúrák nélkül.
