- Az OpenAI elindítja az Operator nevű ügynököt, amely automatizálja a böngészőben az űrlapok kitöltését, a foglalást vagy a vásárlást, grafikus felületeken, emberi felhasználóként viselkedve.
- A CUA modellen alapul, amely a fejlett GPT-4 látást és a megerősítéses tanulást ötvözi a képernyő elemeivel való interakció és az önkorrekció érdekében.
- Korlátozott hozzáférés: a ChatGPT Pro előzetes verziója az Egyesült Államokban (200 dollár), további csomagokra való frissítéssel és fokozatos bővítéssel.
- Magában foglalja az adatvédelmi intézkedéseket, a felhasználók érzékeny tevékenységeinek figyelését és a gyanús webhelyek blokkolását; az OpenAI együttműködik a platformokkal az integrációk érdekében.

Az OpenAI jelentős lépést tett előre a mesterséges intelligencia fejlesztésében az Operator , a böngészőben végrehajtott feladatok automatizálására tervezett új ügynökprogramjának bevezetésével. A korábbi fejlesztések, mint például a ChatGPT és a GPT-4 mintájára ez az eszköz forradalmasítani kívánja a webes interakciónkat, praktikus megoldást kínálva a mindennapi tevékenységekhez, mint például az űrlapok kitöltése, az éttermi asztalfoglalás vagy az online vásárlások kezelése.
Az Operator jelentős elmozdulást jelent a mesterséges intelligenciához való hozzáállásban, mivel a MI aktív résztvevője a digitális világnak. Saját integrált böngészőjén keresztül a rendszer képes azonosítani és manipulálni a grafikus felhasználói felületeket (GUI-kat), a gombokkal, legördülő menükkel és szövegmezőkkel az emberhez hasonló módon kommunikálva. Elsődleges célja az ismétlődő feladatok egyszerűsítése és a felhasználói idő megtakarítása.
Hogyan működik az operátor

Az Operator lelke a Számítógépet Usalló Ügynök (CUA) modell , amelyet az OpenAI fejlesztett ki. Ez a technológia a GPT-4 fejlett látási képességeit ötvözi a megerősítéses tanuláson alapuló érvelési technikákkal . Ez lehetővé teszi az ágens számára, hogy képernyőképeken keresztül „lássa” a képernyőn megjelenő tartalmat, úgy lépjen interakcióba az elemekkel, mintha billentyűzetet és egeret használna, sőt, akár önjavítást is végezzen , ha hibákat vét.
A felhasználónak csak egy egyszerű utasítást kell megadnia, például: „foglaljon asztalt két főre egy étteremben este 8-kor”. Ha akadályokba ütközik – például, ha az adott időpontban nincs szabad hely –, a rendszer további bemenetet kér, például az időpont módosítását vagy érzékeny adatok megadását a művelet végrehajtásához. Továbbá a felhasználó bármikor manuálisan is átveheti az irányítást a böngésző felett. Ha érdekli hasonló ügynökök létrehozása, van egy gyakorlati útmutató az n8n segítségével AI-ügynökök létrehozásához, amely hasznosnak találhatja.
Elérhetőség és hozzáférés

Az Operator jelenleg a „kutatási előzetes” program korai szakaszában van. Ez a hozzáférés a ChatGPT Pro felhasználóira korlátozódik, a szolgáltatás havi 200 dolláros költséggel jár , és csak az Egyesült Államokban érhető el . Az OpenAI bejelentette, hogy tervei szerint elérhetőségét más előfizetési szintekre, például a Plus , a Team és az Enterprise szintekre is kiterjeszti , valamint a jövőben integrálja a ChatGPT-be. Ha érdekli a hasonló mesterséges intelligencia alapú böngészők fejlesztése, itt megismerheti az OpenAI mesterséges intelligencia alapú böngészőjének működését.
A korlátozott bevezetés mind technikai, mind szabályozási szempontokat figyelembe vesz, és célja a biztonságos és ellenőrzött termékfejlesztés biztosítása . A vállalat ezt a fázist a felhasználói visszajelzések gyűjtésére és az ügynök teljesítményének optimalizálására is használja .
Biztonsági és testreszabási funkciók
Az OpenAI egyik fő szempontja a felhasználók adatainak védelme volt. Az ágens olyan intézkedéseket tartalmaz, amelyek garantálják, hogy az érzékeny feladatok, például a bejelentkezési adatok vagy banki adatok megadását igénylő feladatok, a felhasználó közvetlen felügyelete alatt történjenek . Továbbá a felhasználók beállíthatják az ismétlődő feladatok beállításait, és leiratkozhatnak a modell betanításáról, ha nem kívánják megosztani böngészési adataikat.
Az Operator olyan funkciókat tartalmaz, amelyekkel gyanús webhelyek észlelése esetén leállítható a feladat , és elutasíthatók a károsnak vagy illegálisnak tekinthető kérések. Ez a megközelítés megerősíti az Operator elkötelezettségét a mesterséges intelligencia etikus és biztonságos használata iránt.
Együttműködések és jövőbeli fejlesztések

Az OpenAI aktívan együttműködik különböző vállalatokkal, mint például a DoorDash , az Instacart , az OpenTable , az Uber és más cégekkel, hogy integrálja az Operator szolgáltatásait a felhasználók körében már népszerű platformokba. Ezek a partnerségek azt célozzák, hogy az ágens technikai problémák nélkül tudja kezelni a valós feladatokat. Érdemes megjegyezni, hogy ezek az együttműködések nem pénzügyi megállapodásokon alapulnak, hangsúlyozva az Operator fejlesztésének függetlenségét. Az ilyen típusú ágensek iránti érdeklődés részben tükröződik más, az emberi munka automatizálására törekvő ágensek elemzéseiben is.
Az OpenAI a jövőben az ágens jelenlegi korlátainak leküzdését is tervezi, például a bonyolultabb felületek , például a naptárak és a prezentációs eszközök kezelésének nehézségeit. A hosszú távú cél az, hogy az Operator egy valóban univerzális eszköz legyen , amely a felhasználók digitális életének számos aspektusába integrálható.
Az operátor jelentős előrelépést jelent a generatív mesterséges intelligencia világában. Azzal, hogy a mesterséges intelligenciát a passzív megfigyelőből aktív résztvevővé alakítja a digitális ökoszisztémán belül, az OpenAI lefekteti az automatizálás egy új szintjének alapjait , amely megváltoztathatja a technológiához fűződő viszonyunkat. Bár még kísérleti szakaszban van, a sokoldalú és biztonságos digitális asszisztens ígérete egy olyan valóság, amely már kezd formát ölteni.
