- ChatGPT Images laiž klajā jaunu, ātrāku un precīzāku modeli, kas labāk spēj izpildīt lietotāja norādījumus.
- Atjauninājums koncentrējas uz uzlabotu rediģēšanu, iepriekš iestatītiem stiliem un radošām transformācijām no reālām fotogrāfijām.
- Sistēma uzlabo tekstu attēlos, rediģēšanas konsekvenci un samazina iepriekšējo versiju "dzeltenīgo" izskatu.
- Jaunā versija ir integrēta ChatGPT un ir pieejama visā pasaulē gan bezmaksas, gan maksas kontiem.
Ne tik sen puse interneta sāka tēlot animācijas filmu režisoru Studio Ghibli stilā ar ChatGPT palīdzību. Sociālos medijus pārpludināja sapņainas ainas, piemīlīgi tēli un foni ar nepārprotamu japāņu pieskārienu. Aiz šīs aizrautības slēpās OpenAI attēlu ģenerēšanas modelis, kas integrēts ChatGPT, kas ikvienu pārvērta par pseidoilustratoru, pat nezinot, kā zīmēt.
Tomēr ģeneratīvā mākslīgā intelekta pasaule attīstās tik strauji, ka šī tendence bija īslaicīga. Drīz pēc tam saruna pārcēlās uz citiem piedāvājumiem, piemēram, Nano Banana Pro un Google jaunajiem modeļiem, kas spēj radīt tik reālistiskus attēlus, ka tos ir grūti atšķirt no fotogrāfijām, vai tādiem rīkiem kā MidJourney , kas pārvērš tekstu attēlos. Saskaroties ar šo situāciju, OpenAI nav palicis dīkā: tas ir atklājis jaunu ChatGPT Images versiju , kas paredzēta konkurencei, piedāvājot lielāku ātrumu, uzlabotu instrukciju izpratni un ievērojamu lēcienu uz priekšu uzlabotās rediģēšanas iespējās.
Kāda ir jaunā ChatGPT Images versija un kas to atšķir?
OpenAI ir oficiāli paziņojis par nākamās paaudzes ChatGPT Images izlaišanu, kas sakrīt ar jaunākā valodas modeļa GPT-5.2 izlaišanu. Abi soļi ir daļa no vienas stratēģijas: tieši reaģēt uz Google ofensīvu ar tādiem modeļiem kā Gemini 3 Pro un pierādīt, ka tie joprojām ir konkurētspējīgi augstākajā teksta un attēlu apstrādes līmenī.
Šajā jaunajā fāzē ChatGPT Images darbojas ar GPT Image 1.5 modeli , kas ir īpaši izstrādāts attēlu ģenerēšanai un rediģēšanai ar lielāku kontroli un ātrumu nekā iepriekšējās versijās. Pats uzņēmums apgalvo, ka sistēma tagad spēj radīt rezultātus līdz pat četrām reizēm ātrāk , un šī atšķirība ir īpaši pamanāma mobilajās ierīcēs, kur iepriekš bija ierasts, ka process tika pārtraukts, ja lietotājs paaudzes vidū pārslēdza lietojumprogrammas.
Salīdzinājums ar iepriekšējo modeli ir skaidrs: tur, kur iepriekš bija ilgs gaidīšanas laiks un zināma lēnuma sajūta, tagad pieredze vairāk atgādina reāllaika digitālo studiju . Kopīgotajos testos attēli izskatās daudz vienmērīgāki, ar mazāk sasalšanas brīžiem un bez iespaida, ka lietotne ir sasalusi, kamēr serveris veic aprēķinus.
Papildus ātrumam OpenAI par galveno kvalitatīvo lēcienu uzskata precizitāti un lietotāja norādījumu ievērošanu . Mērķis ir panākt, lai ChatGPT Images vairs nebūtu tikai kaprīzs ģenerators, kas interpretē uzvednes savā veidā, bet gan kļūtu par uzticamāku rīku radošām un profesionālām darbplūsmām; tāpēc ir ļoti svarīgi zināt, kā rakstīt uzvednes grafiskajam dizainam.

Paplašināta rediģēšana: mainiet tikai to, ko vēlaties, nesabojājot attēlu
Viens no attēlu ģeneratoru tradicionālajiem Ahilleja papēžiem ir bijusi noteiktu elementu lokalizēta rediģēšana . Ja vēlaties retušēt jaku, mainīt fonu vai pielāgot apgaismojumu, modelis bieži vien "pārveido" visu ainu, un rezultāts pilnībā atšķiras no iecerētā.
Jaunā ChatGPT Images versija koncentrējas tieši uz šīs problēmas risināšanu. OpenAI apgalvo, ka sistēma tagad spēj modificēt tikai lietotāja norādītās daļas , atstājot pārējo attēlu neskartu. Tas ietver visu, sākot no konkrētiem objektiem (automašīna, ceļa zīme, apģērba gabals) līdz globāliem aspektiem, piemēram, apgaismojumam, kadrēšanai un kopējai kompozīcijai, nezaudējot attēla kopējo saskaņotību.
Uzņēmums skaidro, ka modelis ir apmācīts:
- Modificējiet tikai pieprasītos elementusmaksimāli respektējot sākotnējo kontekstu.
- Atstājiet pārējo attēlu nemainītu.novēršot nevēlamu jaunu detaļu parādīšanos.
- Saglabāt konsekvenci starp sākotnējo attēlu, ģenerētajiem rezultātiem un secīgajām rediģēšanām, ko veicat.
Tas ir īpaši pamanāms iteratīvās darbplūsmās, kur nelielas korekcijas tiek veiktas vairākās kārtās . Citos modeļos pēc dažām rediģēšanas reizēm attēls sāktu deformēties vai zaudētu kvalitāti: sejas mainītos, fons kļūtu neatpazīstams, detaļas pazustu. Izmantojot ChatGPT Images, ideja ir tāda, ka varat retušēt, atsaukt izmaiņas, precizēt detaļas un apvienot versijas, nepasliktinot gala rezultātu.
Labs piemērs ir OpenAI demonstrētā uzvedne: sākot ar to pašu pilsētvides ainu, piemēram, Losandželosas ainavu ar cilvēku uz motorollera, un pieprasot ļoti specifiskas izmaiņas: “padarīt viņu kreklu sarkanu, cepuri dzeltenu, ātruma ierobežojuma zīmi 15 un pārvērst kravas automašīnu par ugunsdzēsēju mašīnu.” Tā vietā, lai visu atjaunotu no nulles, modelis pielāgo tikai šīs detaļas, saglabājot sākotnējo kadrējumu, atmosfēru un fotografēšanas stilu.

"Kabatas izmēra radošā studija" ainu radīšanai un pārveidošanai
OpenAI jauno versiju raksturo kā sava veida pārnēsājamu radošo studiju, kas ir tieši integrēta ChatGPT. Ideja ir tāda, ka neatkarīgi no tā, vai sākat no nulles vai strādājat ar reālu fotoattēlu, jūs varat daudz precīzāk vadīt rezultātu, gandrīz tāpat kā dizaina komanda, bet sarunas ietvaros.
Modelis izceļas ar tādiem uzdevumiem kā elementu pievienošana vai noņemšana no ainavas. Piemēram, varat pieprasīt aizsedzoša objekta noņemšanu, ievietot papildu tēlu, pievienot fonam novietotu automašīnu vai noņemt cilvēkus no ainavas, neatstājot nekādas acīmredzamas rediģēšanas pēdas. Sistēma rekonstruē fonu un pielāgo ēnas, atspīdumus un apgaismojumu, lai manipulācija būtu nemanāma.
Ir uzlabota arī attēlu apvienošanas un sapludināšanas iespēja . Tas ļauj, piemēram, uzņemt fotoattēlu, kurā redzams viens cilvēks, un citu fotoattēlu ar pilnīgi atšķirīgu vidi, un radīt ticamu ainu, kas apvieno abus elementus. Vai arī apvienot objektus no vairākām atsevišķām fotogrāfijām vienā, saskaņotā kompozīcijā, kas ir ļoti noderīgi, lai radītu šķietami neiespējamas, bet ticamas montāžas.
Vēl viena svarīga funkcija ir iespēja pārkārtot veselas kompozīcijas . Izmantojot uzvedni, varat pieprasīt, lai tiktu pārvietoti noteikti kadra elementi, lai kamera pietuvinātu vai attālinātu attēlu, lai uzņēmums kļūtu par tuvplānu vai panorāmu, vai lai aina tiktu interpretēta atkārtoti citā diennakts laikā. Tas viss tiek darīts, cenšoties saglabāt vizuālās īpašības, kas padarīja sākotnējo attēlu atpazīstamu.
Visbeidzot, stilu un struktūru transponēšana ir ievērojami uzlabota . Tas nozīmē, ka atsauces fotoattēla kompozīciju, krāsu paleti vai apgaismojumu var piemērot citam attēlam, saglabājot sākotnējās ainas struktūru, bet ar atšķirīgu atmosfēru. Šāda veida darbība ļauj pāriet no reālistiskas ainas uz kinematogrāfisku 2000. gadu estētiku vai uz 90. gadu beigu dokumentālu ielas fotogrāfiju, kas uzņemta uz 35 mm filmas ar izteiktu graudainību.
Radošas pārvērtības ar savām fotogrāfijām
Viena no jomām, kurā jaunā ChatGPT Images funkcija īpaši izceļas, ir radošas transformācijas, izmantojot reālus attēlus . Vienkārši augšupielādējiet savu fotoattēlu (vai kāda cita fotoattēlu ar jūsu atļauju) un pievienojiet tam relatīvi vienkāršu uzdevumu, lai dažu sekunžu laikā iegūtu rezultātus, kas daudzos gadījumos ir pārsteidzoši ticami.
Šī ideja nav pilnīgi jauna: tādi modeļi kā Nano Banana jau bija likuši lielu uzsvaru uz šo iespēju, ļaujot reālus portretus pārveidot par reklāmas kampaņām, plakātiem vai ļoti stilizētām ainām. Tagad OpenAI šo pieeju ievieš tieši ChatGPT, ar sistēmu, kas labāk izprot lietotāja nodomu un precīzāk saglabā sākotnējā objekta iezīmes.
Starp spilgtākajiem piemēriem ir tādi aicinājumi kā: “Izveidojiet šī vīrieša tēlu, bet Taimskvērā 2025. gada ziemā.” Modelis pielāgo apģērbu, apkārtni, nakts apgaismojumu un pilsētas elementus Ņujorkas estētikai šajā gada laikā, vienlaikus saglabājot sākotnējā objekta žestus, vispārējo stāju un sejas vaibstus, un pat ļauj attēlu konvertēt tādos formātos kā WhatsApp uzlīmes.
Vēl viens izplatīts pielietojums ir vizuāls “ceļojums”: varat pieprasīt kaut ko līdzīgu: “Novietojiet šo personu pilnā redzeslokā Japānas pilsētā lietainā naktī ar neona gaismām, atspīdumiem uz zemes un kiberpanka estētiku .” Sistēma ģenerē ainu ar neona gaismām, peļķēm uz asfalta un tipiskām ēkām, integrējot personu šajā pasaulē tā, it kā tā patiešām tur atrastos, neizskatoties pēc vienkārša izgriezuma, kas ielīmēts uz fona.
Tiem, kas dod priekšroku kaut kam fantastiskākam, ir iespējamas tādas pārvērtības kā "Pārvērtiet šo vīrieti par japāņu samuraju ar tradicionālām bruņām un katanām reālistiskā vēsturiskā vidē bez moderniem elementiem" . Šeit ChatGPT Images no jauna interpretē apģērbu, stāju un kontekstu, taču saglabā noteiktu sejas nepārtrauktību, lai jūs joprojām atpazītu objektu. Rezultāts varētu atgādināt vēsturisku ilustrāciju un atjaunotu fotogrāfiju sajaukumu.
Ir arī vieta nostalģiskām pieskaņām. Viens no OpenAI parādītajiem piemēriem ir pieprasījums: "Izmantojiet šī vīrieša attēlu, lai izveidotu pilna auguma Eiropas reklāmu no 90. gadiem ." Modelis pielāgo krāsu paleti, kadrējumu, pozu un fonu, lai tie atbilstu 90. gadu reklāmas stilam: tā laika apģērbs, ainā integrēta atšķirīga tipogrāfija un tā nedaudz novecojusi sajūta, ko ikviens, kurš ir redzējis tā laika reklāmas, uzreiz atpazīst.
Uzlabota instrukciju izsekošana un salasāmāks teksts attēlos
Vēl viens svarīgs uzlabojums jaunajā ChatGPT Images ir tā spēja precīzi izpildīt norādījumus . Iepriekš bija ierasts lūgt kaut ko ļoti specifisku un saņemt rezultātu, kas bija līdzīgs, bet ar nepilnīgām galvenajām detaļām: nepareizas krāsas, trūkstoši objekti vai izmaiņas, kas nebija pieprasītas.
Saskaņā ar OpenAI datiem, daļa no šīm problēmām tagad ir pagātne. Ja jūs sniedzat detalizētus norādījumus, modelim vajadzētu būt iespējai tos ievērot daudz precīzāk . Tas attiecas gan uz attēlu ģenerēšanu no nulles, gan uz augšupielādēta attēla rediģēšanu: cilvēku skaita, kadru veidu, konkrētu krāsu, fotografēšanas vai ilustrācijas stila, vēsturiskā perioda, apģērba, laikapstākļu u.c. norādīšanai tagad ir taustāmāka ietekme uz gala rezultātu.
Uzņēmums arī izceļ konkrētus uzlabojumus teksta atveidošanā attēlos . Vēsturiski salasāmu vārdu rakstīšana uz plakātiem, izkārtnēm, reklāmām vai vākiem bija viens no sarežģītākajiem uzdevumiem ģeneratīvajiem modeļiem, kas bieži atgrieza izkropļotas rakstzīmes, valodu sajaukumus vai bezjēdzīgus vārdus.
Ar šo jauno versiju ChatGPT Images ir kompetentāks konsekventas tipogrāfiju un pareizu ziņojumu ģenerēšanā , kas ir ļoti svarīgi, ja vēlaties izmantot rīku plakātu, reklāmas materiālu, sociālo mediju baneru vai mārketinga materiālu izveidei, kur teksts ir tikpat svarīgs kā fona attēls.
Turklāt ir strādāts pie gadījumiem, kas bieži vien ir īpaši sarežģīti, piemēram, ainām ar vairākām mazām sejām . Iepriekšējās versijās, kad fonā vai lielās grupās parādījās daudz cilvēku, sejas varēja viegli izkropļot, atkārtoties vai iegūt nereālistiskas iezīmes. Jaunais modelis uzlabo šo detaļu apstrādi, piedāvājot dabiskākus rezultātus pat plašos kadros vai pūļa ainās.
Ardievu (gandrīz) galīgi no agrīno versiju dzeltenīgā toņa
Ilgu laiku viens no vienkāršākajiem veidiem, kā noteikt, vai attēls ir ģenerēts ar ChatGPT, bija tā raksturīgā siltā un krēmīgā estētika . Daudziem no šiem darbiem bija kopīga palete, kurā dominēja dzelteni un oranži toņi, maigs apgaismojums un "kinematogrāfiska" sajūta, kas galu galā kļuva par sava veida firmas zīmi, labāk vai sliktāk.
Šķiet, ka ar jauno versiju OpenAI ir vēlējies lauzt šo netīšo vizuālo parakstu. Uzņēmuma publicētajos salīdzinājumos jaunais modelis ievērojami atšķiras no šiem noklusējuma dzeltenīgajiem toņiem , ja vien lietotājs tos nepārprotami nepieprasa uzvednē. Attēli tagad tiecas uz neitrālāku krāsu attēlojumu vai tādu, kas precīzāk atbilst lietotāja ievadei, neuzspiežot tik izteiktu stilu pēc noklusējuma.
Tam ir acīmredzamas priekšrocības profesionālai lietošanai: ja vēlaties tīru reklāmu, produkta maketu vai fotoreālistisku ainu, nevēlaties, lai modelis lietotu daļēji pastāvīgu filtru ar siltu izskatu, kas liek visiem attēliem izskatīties identiskiem. Jaunā pieeja ļauj daudz lielākas vizuālā izskata variācijas, necīnoties ar pārāk dominējošu bāzes stilu.
Praksē tas nozīmē, ka tagad ir vieglāk sasniegt plašu rezultātu klāstu: sākot no vēsiem, nepiesātinātiem attēliem līdz spilgtai, krāsainai estētikai, tostarp vintage stiliem, pasteļtoņiem, dokumentālajai fotogrāfijai un īpaši spilgtai reklāmai. Modelis ir elastīgāks, pielāgojoties kontekstam un tonim, ko norādāt instrukcijās.
Iepriekš definēti stili un ieteikumi: veidojiet, neapgrūtinot galvu ar uzvednēm
Viena no visiecienītākajām jaunajām funkcijām tiem, kas nevēlas mocīties ar sarežģītām uzvednēm, ir iepriekš definētu stilu un koncepciju ieviešana ChatGPT Images ietvaros. Tā vietā, lai rakstītu izsmeļošus aprakstus ar tehniskiem parametriem, varat tieši izvēlēties gatavu vizuālo pieeju un ļaut sistēmai aizpildīt detaļas.
Šie iepriekš iestatītie stili ir izstrādāti, lai ietaupītu laiku gan ikdienas lietotājiem, gan profesionāļiem, kuriem nepieciešama konsekvence dažādos darbos. Piemēram, varat atlasīt konkrētu estētiku kampaņai un atkārtoti izmantot to vairākos attēlos, katru reizi neatceroties precīzu uzvedni.
Turklāt ChatGPT lietotnes attēlu sadaļā atradīsiet virkni gatavu ieteikumu . Varat sākt procesu, izvēloties stilu, augšupielādējot fotoattēlu vai pat uzņemot selfiju tieši no lietotnes, un ļaut mākslīgajam intelektam ieteikt radošas transformācijas, jums pārāk daudz nedomājot par sākotnējo tekstu.
Tas ievērojami pazemina ienākšanas barjeru tiem, kas nav pazīstami ar "uzvedņu valodu". Tā vietā, lai apsēsti aprakstītu visu līdz pēdējai detaļai, varat sākt ar saprātīgu bāzi un pēc tam, redzot rezultātus, pieprasīt konkrētākas korekcijas.
Praksē ChatGPT šeit darbojas kā interaktīvs radošais asistents : tas var ieteikt variācijas, stila izmaiņas, kadrējuma pielāgojumus vai jaunas idejas, kas saistītas ar jau esošo attēlu, lai process galu galā atgādinātu nevis vienkāršu vienreizēju paaudzes izveidi, bet gan kopīgu mākslas virziena darbu.
Kur lietot ChatGPT attēlus un kā tie integrējas lietotnē
Jaunā ChatGPT Images versija tiek ieviesta globāli visiem lietotājiem , tostarp tiem, kuriem ir bezmaksas konti. OpenAI nav paziņojis par konkrētiem reģionāliem ierobežojumiem, tāpēc ideja ir tāda, ka ikviens, kam ir piekļuve ChatGPT, var izmantot jaunās attēlu ģenerēšanas un rediģēšanas iespējas.
Ja izmantojat mobilo lietotni, visticamāk, pēc tās atvēršanas jau esat saņēmis paziņojumu ar aicinājumu sākt veidot attēlus . Turklāt saskarnē ir iekļauta jauna sadaļa “Attēli” sānu joslā, kur varat skatīt visus savus darbus vienuviet.
Šī sadaļa kalpo ne tikai kā personīgā galerija, bet arī kā vadības centrs vizuālo projektu pārvaldībai . Šeit varat pārskatīt vecus attēlus, lai tos rediģētu, dublēt rezultātus, salīdzināt versijas vai sākt no iepriekšēja darba, lai eksperimentētu ar pilnīgi atšķirīgiem stiliem, nezaudējot oriģinālu.
Patiesi interesanti ir tas, ka visa šī funkcionalitāte ir integrēta pašā ChatGPT pieredzē. Lai veiktu konkrētas izmaiņas, nav jāatver ārēji rīki vai jāeksportē attēli uz citiem rediģēšanas pakalpojumiem: varat pieprasīt korekcijas, izmantojot tekstu tieši sarunā , pārskatīt rezultātu, atkārtot darbību utt.
Galu galā jaunā ChatGPT Images lietotne pārveidojas par vairāk nekā tikai vienkāršu tērzēšanas robotu: tā kļūst par pilnīgu multimodālu izveides platformu , kurā teksts, attēls un rediģēšana nemanāmi saplūst, skaidri koncentrējoties gan uz rotaļīgiem lietojumiem, gan nopietnākām darbplūsmām, sākot no ātrām reklāmas kampaņām līdz produktu prototipiem vai vizuālām skicēm prezentācijām.
Ar šo atjauninājumu OpenAI mērķis ir nostiprināt savu pozīciju sacensībā par uzlabotu vizuālo ģenerēšanu, reaģējot uz Google un citu spēlētāju sasniegumiem ar pakotni, kas apvieno lielāku ātrumu, uzlabotu precizitāti, lielāku radošo kontroli un nemanāmu integrāciju ChatGPT ietvaros. Vidusmēra lietotājam rezultāts ir rīks eksperimentēšanai, ideju testēšanai un arvien izsmalcinātāku attēlu veidošanai, neizejot no tās pašas tērzēšanas lapas, kurā viņi jau ikdienā sarunājas, plāno vai raksta.