Tvillingernes 3. karakteristika: alt der ændrer sig, og hvorfor det betyder noget

Sidste ændring: 23 November 2025
Forfatter: TecnoDigital
  • Gemini 3 introducerer generative grænseflader og forbedrer ræsonnement på ekspertniveau.
  • Forbedret multimodalitet med 1 million tokens og forbedrede billed- og videoresultater.
  • Mere kapable agenter: Antigravity, integration af arbejdsområder og værktøjsbrug.
  • Bred implementering og forbedret sikkerhed med adgang i app, Search, AI Studio og Vertex AI.

Gemini 3-funktioner

Googles nye generation af AI ankommer med en klar ambition: at gå fra at tale til at udføre. Med Gemini 3 tager virksomheden et bemærkelsesværdigt spring inden for ræsonnement, multimodalitet og agentiske evner , og debuterer også med en anderledes måde at interagere på: grænseflader, som modellen selv genererer undervejs for at hjælpe dig med at nå dit mål uden at spilde tid på mellemliggende trin.

Alt dette kommer med et redesign af appen, forbedringer af Google Søgning, Workspace og udviklerværktøjer samt et stærkt fokus på sikkerhed. Der er mærkbare ændringer for alle, men mange af de mest betydningsfulde forbedringer vil ses i avancerede anvendelser: programmering, dataanalyse, arbejde med videoer og billeder samt automatisering med agenter , der planlægger og handler under menneskelig overvågning.

Hvad er Gemini 3, og hvorfor markerer det et vendepunkt?

I praksis betyder dette mere direkte og brugbare svar, en reduktion i den "smiger", der er typisk for nogle chatbots, og en bedre fortolkning af konteksten , selv når man arbejder med lange eller heterogene input (tekst, billeder, video, lyd og kode).

Derudover har Google siden dag ét implementeret Gemini 3 på tværs af flere platforme: Gemini-appen, søgemaskinens AI-tilstand, AI Studio, Vertex AI, modellens CLI og en ny agentplatform kaldet Google Antigravity , der er designet til at planlægge og udføre komplekse softwareopgaver med adgang til editor, terminal og browser.

For at understrege omfanget af lanceringen minder virksomheden om den kumulative effekt af Gemini-æraen: Den AI-drevne View- oplevelse når ud til milliarder af mennesker om måneden, appen har over hundredvis af millioner brugere, de fleste Google Cloud-kunder bruger allerede AI-funktioner, og millioner af udviklere har bygget løsninger med dens generative modeller.

Gemini Nyheder 3

Generative grænseflader og en ny brugeroplevelse

Gemini 3 lancerer en app med en renere og mere moderne æstetik, der gør det nemmere at starte samtaler og finde det, man har oprettet, i mappen "Mine ting" . Redesignet er ikke kun kosmetisk: det store spring fremad er generative grænseflader , en type respons, hvor modellen bestemmer det optimale format og genererer dynamiske visuelle elementer i stedet for en blok af almindelig tekst.

Blandt de første eksperimenter er det "visuelle design" (en magasinlignende visning med fotos og interaktive moduler) og den "dynamiske visning", der er designet til at udforske og personliggøre resultater. Hvis du beder den om at "planlægge en 3-dages tur til Rom om sommeren", får du en navigerbar visuel rejseplan med opfølgende spørgsmål og interaktive elementer.

Ideen er relateret til det, der kaldes vibe-kodning : du beskriver målet i naturligt sprog, og systemet opretter den brugerflade eller kode, der er nødvendig for at opnå det. Så hvis et diagram, en animation eller en interaktiv mini-app er bedre end et afsnit, genererer Gemini 3 det i oplevelsen uden at tvinge dig til at skifte værktøj.

Shoppingoplevelsen tager også et spring: lister, sammenligningstabeller og priser integreres direkte fra Google Shopping Graph (med milliarder af referencer) for at opbygge interaktive guider uden at forlade flowet, i stil med en specialiseret anbefalingsside, men genereret on-the-fly af modellen.

  Sådan bruger du kunstig intelligens uden at registrere dig eller oprette en konto

En anden praktisk forbedring er, at en begrænset gruppe abonnenter i søgemaskinen kan vælge den ræsonnementsorienterede variant af Gemini 3 Pro for at modtage mere omfattende og underbyggede resuméer, og ikke kun det syntetiske svar fra den nuværende tilstand.

Gemini 3 generativ brugerflade

Avanceret ræsonnement og dyb tænkningstilstand

Google fremhæver en betydelig forbedring i sværhedsgradstests: de taler om ræsonnement på ph.d.-niveau med meget konkurrencedygtige resultater i tests som Humanity's Last Exam og GPQA Diamond. I tal opnår Gemini 3 Pro scorer som 37,5% i HLE (uden værktøjer) og 91,9% i GPQA Diamond og etablerer en state-of-the-art præstation i matematik med 23,4% i MathArena Apex.

Gemini 3 Deep Think- tilstanden tager tingene et skridt videre til særligt komplekse og nye udfordringer. I interne vurderinger overgår den Pro på flere fronter: 41,0% i Humanity's Last Exam (uden værktøjer), 93,8% i GPQA Diamond og 45,1% i ARC-AGI, når kodeudførelse er tilladt – en kombination af symbolsk ræsonnement, værktøjsbrug og programmering designet til vanskelige problemer.

Inden for agentdomæner viser modellen god ydeevne i Terminal-Bench 2.0 (54,2%), som måler dens evne til at håndtere en computer via terminal, og opretholder stabil beslutningstagning i langvarige miljøer som Vending-Bench 2 , hvor den opnåede et nettoafkast på over fem tusind dollars i en forretningssimulering i løbet af et virtuelt år.

Ud over metrikken er det relevante ændringen i rolle: fra en responsiv assistent til en aktiv agent . Gemini 3 planlægger, opdeler opgaver i trin, anmoder om godkendelse, når det er nødvendigt, og udfører med menneskelig overvågning i loopet. Den kan sortere en Gmail-indbakke, organisere tidsplaner ved at krydsreferere tilgængelighed eller forberede en kompleks arbejdsgang ved at kombinere ræsonnement, værktøjskald og navigation.

Udviklere og erhvervslivet ser allerede håndgribelige forbedringer: bedre visuel forståelse, mere pålidelig kodegenerering og øget ydeevne på langvarige opgaver. Alt dette resulterer i mere nyttige agenter, der er i stand til at opretholde projekter konsekvent og holde sig på sporet over tid.

Ræsonnement og dyb tænkning i Tvillingerne 3

Multimodalitet og storskala kontekst

Gemini 3 Pro styrker sin multimodale forståelse og hæver barren for billede og video: den udmærker sig i MMMU-Pro (81%) og Video-MMMU (87,2%) og viser fremskridt i faktuel nøjagtighed med SimpleQA Verified (72,1%). Nøglen ligger i dens evne til at kombinere tekst, kode, fotos, lyd og videoklip inden for samme kontekst og fortolke relationer og nuancer.

Modellen håndterer store mængder data takket være et kontekstvindue på 1 million tokens , nok til lange artikler, hele klasser, kodelagre eller flere dokumenter, der kører parallelt. Dette muliggør yderst praktiske anvendelser: lige fra at samle håndskrevne familieopskrifter (selv på flere sprog) og omdanne dem til en kogebog, til at omdanne videnskabelige artikler og lange videoer til interaktive kort og visualiseringer.

For programmører taler Google om et betydeligt spring fremad inden for kodeanalyse, abstrakt ræsonnement og kontrolleret udførelse. I udviklingsassistancescenarier som Code Assist 3.0 beskriver det en forståelse af den komplette repository-arkitektur og et udvidet kontekstvindue på op til 10 millioner tokens, hvilket er nyttigt til at detektere afhængigheder, der kan brydes af en lokal ændring.

  Uddannelsesteknologi: Nøglen til at frigøre enhver elevs potentiale

Modellen forbedrer også parallel ræsonnement med visuelle og tekstuelle data og forfiner fortolkningen af ​​tabeller, diagrammer og grænseflader. Denne forbedring er afgørende, når det vigtigste ikke blot er at "se" billedet, men at krydsreferere det med tekst og tal for at drage konklusioner og handle.

Som følge heraf er svarene ikke altid tekstbaserede: nogle gange er det ideelle svar en interaktiv webapp (en lommeregner, en simulator eller en realtidswidget), der giver dig mulighed for at udforske løsningen mere intuitivt i selve Gemini-flowet.

Multimodalitet og kontekst i Gemini 3

Agenter, udvikling og Google Antigravity-platformen

Gemini 3 er nu tilgængelig for udviklere i Google AI Studio , Vertex AI og CLI, og introducerer Google Antigravity , en agentbaseret udviklingsplatform med direkte adgang til editoren, terminalen og browseren. Systemet kan planlægge og udføre end-to-end softwareopgaver , validere sin egen kode og koordinere med andre overflader i Gemini-familien (såsom computerstyring og billedredigering).

Modellen fører an i benchmarks som WebDev Arena (1.487 ELO), scorer 54,2% i Terminal-Bench 2.0 og opnår 76,2% i SWE-bench Verified, og udmærker sig ved eksempelfri kodegenerering og oprettelse af omfattende webgrænseflader ud fra komplekse instruktioner. For virksomheder accelererer dette udviklingen af ​​skræddersyede, agentbaserede løsninger.

Eksempler fra den virkelige verden udnytter allerede dette: Virksomheder, der opretter automatiserede præsentationer, bruger tekniske modeller til at generere dele, der tidligere tog en analytiker timer at færdiggøre. Med Gemini 3 reduceres dette arbejde til få minutter takket være multimodal ræsonnement og udvidet kontekst.

Integration med Google Workspace og søgemaskinen

Den mest synlige effekt for teams vil komme i Google Workspace . Gemini er ikke længere bare en sidebjælke; den er nu integreret som en motor i Gmail, Docs, Sheets, Kalender, YouTube og Maps. I Gmail opsummerer den for eksempel ikke bare: den udarbejder kladder, prioriterer, svarer og planlægger møder baseret på din faktiske tilgængelighed. I Sheets fungerer den som dataanalytiker og opretter diagrammer og pivottabeller baseret på dine spørgsmål.

Gemini Vids er også konsolideret og kan generere komplette videopræsentationer fra Drive-dokumentation, og samarbejdet med multimodalt indhold forbedres: modellen forstår og kombinerer tekst, billeder og klip for at producere nyttige aktiver på kortere tid.

I Søgning kan visse abonnenter, udover AI-drevne resuméer, opgradere til Gemini 3 Pro for at få mere omfattende svar baseret på dens analytiske egenskaber. Og i Shopping bruger Gemini Googles Shopping Graph til at generere anbefalingsguider med opdaterede priser og detaljer uden at afbryde oplevelsen.

En anden bemærkelsesværdig forbedring er, at søgemaskinen bedre kan opdele dine spørgsmål i underforespørgsler, som den undersøger på dine vegne, hvilket giver en mere præcis forståelse af intentionen og undgår udeladelser, der tidligere har undsluppet.

Samlet set lover denne integration mindre friktion : du beder om det, du har brug for, og hvis det er relevant, genererer modellen visningen, tabellen, kalenderen eller miniappen i samme flow, uden at du skal hoppe mellem faner.

Tilgængelighed, implementering og sikkerhed

Google hævder, at Gemini 3 er deres sikreste model til dato takket være det mest omfattende sæt af vurderinger, de nogensinde har implementeret. Forbedringerne omfatter reducerede sårbarheder, større modstandsdygtighed over for prompt injection-angreb og forbedret forsvar mod misbrug relateret til cyberangreb, valideret af uafhængige eksperter og eksterne organer (såsom Storbritanniens AISI ) og specialiserede firmaer.

  Sådan bruger du kunstig intelligens uden en konto eller registrering

Udrulningen er massiv: slutbrugere kan finde den i Gemini-appen og i søgemaskinens AI-tilstand, udviklere i Gemini API, AI Studio, Antigravity og CLI , og organisationer via Vertex AI og Gemini Enterprise. Nogle avancerede funktioner, såsom Deep Think og visse agentfunktioner, tilbydes i første omgang til Google AI Ultra- abonnenter og vil blive udvidet over tid.

En praktisk bemærkning: Gemini 3 Pro tilbydes gratis fra dag ét på appen og nettet, noget der er hidtil uset, selvom opgraderingen til Pro i Søgning i øjeblikket er forbeholdt betalte abonnementer. Derudover kan den allerede testes fra Google AI Studio, og den generelle udrulning vil blive aktiveret i de kommende dage afhængigt af region og produkt.

Google bakker udrulningen op med adoptionsdata: AI-oplevelsen i søgemaskinen når milliarder af månedlige brugere, appen overstiger langt en halv milliard, mere end 70 % af Google Cloud-kunderne bruger AI-funktioner, og 13 millioner udviklere har skabt løsninger med dens modeller.

Anvendelser i virksomheder og use cases

I virksomhedsmiljøer muliggør Gemini 3 design af skræddersyede løsninger, der integrerer agenter, automatisering og multimodal AI i nøgleprocesser. Dette spænder fra at understøtte udvikling og forbedring af datapipelines til at skabe samtaleoplevelser, der håndterer dokumenter, billeder og videoer med en samlet tilgang.

Mange virksomheder kombinerer disse funktioner med cybersikkerhed og penetrationstestpraksis for at beskytte modeller og data og implementerer cloudinfrastrukturer (AWS og Azure), der sikrer skalerbarhed, tilgængelighed og overholdelse af regler. Inden for analyser integreres dashboards og business intelligence-tjenester (f.eks. med Power BI) for at omdanne data til handlingsrettede beslutninger, baseret på modellens ræsonnement og generering af visualiseringer .

Suiten drager også fordel af et fundament med Google Search , som forankrer svar til pålidelig information om aktuelle emner og minimerer misinformation. Med hensyn til programmering forstår Gemini 3 repository-arkitekturen, foreslår ændringer og advarer om potentielt ødelagte afhængigheder, hvilket sparer tid for tekniske teams.

Fremadrettet forventer Google radikal tilpasning : modeller, der privat og sikkert tilpasser sig din organisations stil, tone og ekspertise uden behov for komplekse finjusteringsprocesser . Og bemærk: Selvom den gennemsnitlige bruger måske ikke bemærker alle ændringerne, vil tekniske teams og datateams se klare forbedringer i nøjagtighed, hastighed og handlingsrettethed.

Gemini 3 omdefinerer, hvordan vi arbejder med AI, ved at kombinere avanceret ræsonnement, praktiske agenter og generative grænseflader: mindre friktion, mere kontekst og muligheden for en interaktiv oplevelse , der fører dig fra mål til udførelse med blot et par veludformede prompts.

gemini robotics-0
Relateret artikel:
Google revolutionerer robotteknologi med sin Gemini Robotics AI