- Gemini 3 predstavlja generativne vmesnike in izboljšuje sklepanje na ravni strokovnjakov.
- Izboljšana multimodalnost z 1 milijonom žetonov in izboljšanimi rezultati slik in videoposnetkov.
- Zmogljivejši agenti: Antigravitacija, integracija delovnega prostora in uporaba orodij.
- Široka uvedba in izboljšana varnost, z dostopom v aplikaciji, iskanju, AI Studiu in Vertex AI.

Googlova nova generacija umetne inteligence prihaja z jasno ambicijo: preiti od pogovora k izvajanju. Z Gemini 3 podjetje naredi izjemen preskok v sklepanju, multimodalnosti in agentnih zmogljivostih ter predstavi tudi drugačen način interakcije: vmesnike, ki jih model sam ustvari sproti, da vam pomagajo doseči cilj, ne da bi izgubljali čas z vmesnimi koraki.
Vse to prinaša prenovo aplikacije, izboljšave Iskanja Google, delovnega prostora in orodij za razvijalce ter močan poudarek na varnosti. Opazne spremembe so za vse, vendar bodo številne najpomembnejše izboljšave vidne pri napredni uporabi: programiranju, analizi podatkov, delu z videoposnetki in slikami ter avtomatizaciji z agenti , ki načrtujejo in delujejo pod človeškim nadzorom.
Kaj je Gemini 3 in zakaj pomeni prelomnico?
V praksi se to odraža v bolj neposrednih in uporabnih odgovorih, zmanjšanju "laskavosti", značilne za nekatere klepetalne robote, in boljši interpretaciji konteksta , tudi pri delu z dolgimi ali heterogenimi vhodnimi podatki (besedilo, slike, video, zvok in koda).
Poleg tega je Google od prvega dne namestil Gemini 3 na več površin: aplikacijo Gemini, način umetne inteligence iskalnika, AI Studio, Vertex AI, CLI modela in novo platformo agentov, imenovano Google Antigravity , ki je zasnovana za načrtovanje in izvajanje kompleksnih programskih nalog z dostopom do urejevalnika, terminala in brskalnika.
Da bi poudarili obseg lansiranja, podjetje opozarja na kumulativni vpliv dobe Gemini: izkušnja View, ki jo poganja umetna inteligenca, doseže milijarde ljudi na mesec, aplikacija presega stotine milijonov uporabnikov, večina strank Google Clouda že uporablja zmogljivosti umetne inteligence, milijoni razvijalcev pa so zgradili rešitve z njenimi generativnimi modeli.
Generativni vmesniki in nova uporabniška izkušnja
Gemini 3 predstavlja aplikacijo s čistejšo in sodobnejšo estetiko, ki olajša začetek pogovorov in iskanje ustvarjenega v mapi »Moje stvari« . Prenova ni le kozmetična: velik korak naprej so generativni vmesniki , vrsta odziva, kjer model določi optimalno obliko in namesto bloka navadnega besedila ustvari dinamične vizualne elemente.
Med prvimi poskusi sta »vizualna zasnova« ( pogled v slogu revije s fotografijami in interaktivnimi moduli) in »dinamični pogled«, zasnovan za raziskovanje in prilagajanje rezultatov. Če ga prosite, naj »načrtuje 3-dnevni izlet v Rim poleti«, dobite navigacijski vizualni načrt poti z nadaljnjimi vprašanji in interaktivnimi elementi.
Ideja je povezana s tako imenovanim vibriranjem : cilj opišete v naravnem jeziku, sistem pa ustvari vmesnik ali kodo, potrebno za njegovo dosego. Če je torej diagram, animacija ali interaktivna mini aplikacija boljša od odstavka, jo Gemini 3 ustvari znotraj izkušnje, ne da bi vas prisilil k menjavi orodij.
Tudi nakupovalna izkušnja je doživela skok vpred: seznami, primerjalne tabele in cene so integrirani neposredno iz storitve Google Shopping Graph (z več deset milijardami referenc), da se ustvarijo interaktivni vodniki, ne da bi se zapustili tok nakupovanja, v slogu specializirane strani s priporočili, vendar jih model generira sproti.
Druga praktična izboljšava je, da se lahko omejena skupina naročnikov v iskalniku odloči za različico Gemini 3 Pro, ki je usmerjena v sklepanje , da bi prejela bolj celovite in utemeljene povzetke, ne le sintetičnega odgovora trenutnega načina.

Napredno sklepanje in način globokega razmišljanja
Google izpostavlja znatno izboljšanje pri testih visoke težavnosti: govori o sklepanju na ravni doktorata , z zelo konkurenčnimi rezultati pri testih, kot sta Humanity's Last Exam in GPQA Diamond. Kar zadeva številke, Gemini 3 Pro dosega rezultate, kot sta 37,5 % pri HLE (brez orodij) in 91,9 % pri GPQA Diamond, ter vzpostavlja najsodobnejšo zmogljivost pri matematiki z 23,4 % pri MathArena Apex.
Način Gemini 3 Deep Think gre še korak dlje pri posebej kompleksnih in novih izzivih. Pri internih ocenjevanjih prekaša Pro na več področjih: 41,0 % pri Humanity's Last Exam (brez orodij), 93,8 % pri GPQA Diamond in 45,1 % pri ARC-AGI, ko je dovoljeno izvajanje kode – kombinacija simbolnega sklepanja, uporabe orodij in programiranja, zasnovanega za zahtevne probleme.
V agentnih domenah model kaže dobro delovanje v programu Terminal-Bench 2.0 (54,2 %), ki meri njegovo sposobnost upravljanja računalnika prek terminala in ohranja stabilno odločanje v dolgotrajnih okoljih, kot je Vending-Bench 2 , kjer je v poslovni simulaciji v virtualnem letu dosegel neto donos več kot pet tisoč dolarjev.
Poleg metrik je pomembna tudi sprememba vloge: od odzivnega asistenta do aktivnega agenta . Gemini 3 načrtuje, razdeli naloge na korake, po potrebi zahteva odobritev in jih izvaja s človeškim nadzorom v zanki. Lahko razvrsti mapo »Prejeto« v Gmailu, organizira urnike z navzkrižnim sklicevanjem na razpoložljivost ali pripravi kompleksen potek dela z združevanjem sklepanja, klicev orodij in navigacije.
Razvijalci in poslovna skupnost že opažajo oprijemljive izboljšave: boljše vizualno razumevanje, zanesljivejše generiranje kode in večjo zmogljivost pri dolgotrajnih nalogah. Vse to se odraža v bolj uporabnih agentih, ki so sposobni dosledno vzdrževati projekte in ostati na pravi poti skozi čas.

Multimodalnost in obsežni kontekst
Gemini 3 Pro krepi svoje multimodalno razumevanje in dviguje standarde za sliko in video: blesti v MMMU-Pro (81 %) in Video-MMMU (87,2 %), napredek v dejanski natančnosti pa kaže s SimpleQA Verified (72,1 %). Ključ je v njegovi sposobnosti kombiniranja besedila, kode, fotografij, zvoka in video posnetkov znotraj istega konteksta, pri čemer interpretira odnose in nianse.
Model obdeluje velike količine podatkov zaradi kontekstnega okna z 1 milijonom žetonov , kar je dovolj za dolge članke, celotne razrede, repozitorije kode ali več dokumentov, ki se izvajajo vzporedno. To omogoča zelo praktične aplikacije: od poenotenja ročno napisanih družinskih receptov (tudi v več jezikih) in njihove pretvorbe v kuharsko knjigo do preoblikovanja znanstvenih člankov in dolgih videoposnetkov v interaktivne kartice in vizualizacije.
Za programerje Google govori o pomembnem skoku naprej v analizi kode, abstraktnem sklepanju in nadzorovanem izvajanju. V scenarijih razvojne pomoči, kot je Code Assist 3.0 , opisuje razumevanje celotne arhitekture repozitorija in razširjeno kontekstno okno do 10 milijonov žetonov, kar je uporabno za odkrivanje odvisnosti, ki bi jih lahko lokalna sprememba prekinila.
Model izboljša tudi vzporedno sklepanje z vizualnimi in besedilnimi podatki, s čimer izpopolni interpretacijo tabel, diagramov in vmesnikov. Ta napredek je ključnega pomena, kadar ni pomembno le "videti" sliko, temveč jo primerjati z besedilom in številkami, da bi lahko sklepali in ukrepali.
Posledično odgovori niso vedno v obliki besedila: včasih je idealen odgovor interaktivna spletna aplikacija (kalkulator, simulator ali pripomoček v realnem času), ki omogoča bolj intuitivno raziskovanje rešitve znotraj samega Geminijevega toka.
Agenti, razvoj in platforma Google Antigravity
Gemini 3 je zdaj na voljo razvijalcem v Google AI Studiu , Vertex AI in CLI ter predstavlja Google Antigravity , razvojno platformo, ki temelji na agentih in ima neposreden dostop do urejevalnika, terminala in brskalnika. Sistem lahko načrtuje in izvaja celovite programske naloge , preverja lastno kodo in se usklajuje z drugimi površinami v družini Gemini (kot sta računalniški nadzor in urejanje slik).
Model je vodilni v merilih uspešnosti, kot je WebDev Arena (1.487 ELO), dosega 54,2 % v Terminal-Bench 2.0 in 76,2 % v SWE-bench Verified, pri čemer blesti pri generiranju kode brez primerov in ustvarjanju bogatih spletnih vmesnikov iz kompleksnih navodil. Za podjetja to pospeši razvoj prilagojenih rešitev, ki temeljijo na agentih.
Primeri iz resničnega sveta to že izkoriščajo: podjetja, ki ustvarjajo avtomatizirane predstavitve, modelu zagotavljajo tehnično dokumentacijo za ustvarjanje delov, za katere so analitiki prej potrebovali več ur. Z Gemini 3 se je to delo zaradi multimodalnega sklepanja in razširjenega konteksta skrajšalo na nekaj minut .
Integracija z Google Workspace in iskalnikom
Najbolj viden vpliv na ekipe bo prišel v storitvi Google Workspace . Gemini ni več le stranska vrstica; zdaj je integriran kot mehanizem v Gmail, Dokumente, Preglednice, Koledar, YouTube in Zemljevide. V Gmailu na primer ne le povzema: piše osnutke, določa prioritete, odgovarja in načrtuje sestanke glede na vašo dejansko razpoložljivost. V Preglednicah deluje kot podatkovni analitik, ki ustvarja grafikone in vrtilne tabele na podlagi vaših vprašanj.
Gemini Vids je prav tako konsolidiran in zmožen ustvarjanja celotnih video predstavitev iz dokumentacije Drive, izboljšano pa je tudi sodelovanje z večmodalno vsebino: model razume in združuje besedilo, slike in posnetke, da v krajšem času ustvari uporabna sredstva.
V Iskanju lahko nekateri naročniki poleg povzetkov, ki jih poganja umetna inteligenca, nadgradijo na Gemini 3 Pro za bogatejše odgovore na podlagi analitičnih zmogljivosti. V Nakupovanju pa Gemini uporablja Googlov Shopping Graph za ustvarjanje priporočilnih vodnikov z najnovejšimi cenami in podrobnostmi, ne da bi vas pri tem odvrnil od izkušnje.
Druga opazna izboljšava je, da lahko iskalnik vaša vprašanja bolje razdeli na podpoizvedbe, ki jih preišče namesto vas, s čimer natančneje razume namen in se izogne opustitvam, ki so prej uhajale.
Na splošno ta integracija obljublja manj trenja : vprašate, kaj potrebujete, in če je primerno, model ustvari pogled, tabelo, koledar ali mini aplikacijo v istem toku, ne da bi vas silil v preklapljanje med zavihki.
Razpoložljivost, uvajanje in varnost
Google trdi, da je Gemini 3 njihov najvarnejši model doslej , zahvaljujoč najobsežnejšemu naboru ocen, kar jih je kdajkoli izvedel. Izboljšave vključujejo manjše ranljivosti, večjo odpornost na napade s takojšnjim vbrizgavanjem in izboljšano zaščito pred zlorabo, povezano s kibernetskimi napadi, kar so potrdili neodvisni strokovnjaki in zunanji organi (kot je britanski AISI ) ter specializirana podjetja.
Uvedba je obsežna: končni uporabniki jo lahko najdejo v aplikaciji Gemini in v načinu AI iskalnika, razvijalci v Gemini API, AI Studio, Antigravity in CLI , organizacije pa prek Vertex AI in Gemini Enterprise. Nekatere napredne funkcije, kot sta Deep Think in nekatere zmogljivosti agentov, so sprva na voljo naročnikom Google AI Ultra in se bodo sčasoma širile.
Praktična opomba: Gemini 3 Pro je od prvega dne na voljo brezplačno v aplikaciji in na spletu, kar je doslej nekaj brez primere, čeprav je nadgradnja na Pro v Iskanju trenutno rezervirana za plačljive pakete. Poleg tega ga je že mogoče preizkusiti v storitvi Google AI Studio, njegova splošna uvedba pa bo omogočena v prihodnjih dneh, odvisno od regije in izdelka.
Google uvedbo podpira s podatki o uvedbi: izkušnja z umetno inteligenco v iskalniku dosega milijarde mesečnih uporabnikov, aplikacija daleč presega pol milijarde, več kot 70 % strank Google Cloud uporablja zmogljivosti umetne inteligence, 13 milijonov razvijalcev pa je ustvarilo rešitve z njihovimi modeli.
Uporaba v podjetjih in primeri uporabe
V poslovnih okoljih Gemini 3 omogoča oblikovanje prilagojenih rešitev, ki v ključne procese integrirajo agente, avtomatizacijo in multimodalno umetno inteligenco . To sega od podpore razvoju in izboljšanju podatkovnih cevovodov do ustvarjanja pogovornih izkušenj, ki obravnavajo dokumente, slike in videoposnetke z enotnim pristopom.
Številna podjetja te zmogljivosti združujejo s praksami kibernetske varnosti in testiranja penetracije za zaščito modelov in podatkov ter uvajajo oblačne infrastrukture (AWS in Azure), ki zagotavljajo skalabilnost, razpoložljivost in skladnost. V analitiki so nadzorne plošče in storitve poslovne inteligence (na primer s Power BI) integrirane za pretvorbo podatkov v uporabne odločitve, pri čemer se opirajo na sklepanje modela in ustvarjanje vizualizacij .
Paket ima tudi prednost pri iskanju Google , ki odgovore zasidra na zanesljive informacije o aktualnih temah in s tem zmanjšuje dezinformacije. Kar zadeva programiranje, Gemini 3 razume arhitekturo repozitorija, predlaga spremembe in opozarja na morebitne okvarjene odvisnosti, kar tehničnim ekipam prihrani čas.
Google v prihodnje pričakuje radikalno prilagajanje : modele, ki se zasebno in varno prilagajajo slogu, tonu in strokovnemu znanju vaše organizacije brez potrebe po zapletenih postopkih natančnega uglaševanja . In upoštevajte: čeprav povprečen uporabnik morda ne bo opazil vseh sprememb, bodo tehnične in podatkovne ekipe opazile očitne izboljšave v natančnosti, hitrosti in uporabnosti.
Gemini 3 na novo opredeljuje način dela z umetno inteligenco z združevanjem naprednega sklepanja, praktičnih agentov in generativnih vmesnikov: manj trenja, več konteksta in možnost interaktivne izkušnje , ki vas s samo nekaj dobro podanimi navodili popelje od cilja do izvedbe.


