Zaista sposoban AI agent treba i pamet i stvarnu -sposobnost poduzimanja radnji-on mora duboko razumjeti šta korisnik želi i onda stvarno obaviti stvari. Tako je Yuan Yuan, dekan Alibaba istraživačkog instituta, opisao idealan oblik AI agenata tokom nedavnog seminara na temu "Sigurnost i razvoj ponašanja AI agenata".

Ona je naglasila da, iako AI agenti daju veliko obećanje za pretvaranje AI tehnologije u pravi novac i dramatično poboljšanje korisničkog iskustva, njihovo uvođenje ne bi trebalo narušiti postojeća pravila, upravljanje ili poslovne ekosisteme. Umjesto toga, sve bi se trebalo odvijati na siguran način koji se može kontrolirati, uz duboku saradnju u cijeloj industriji, tako da proizvođači telefona i programeri aplikacija mogu dijeliti prednosti naprednih modela.
Tokom protekle godine, veliko pitanje na tržištu bilo je: "Može li AI zaista rješavati zadatke umjesto nas?" Vidjeli smo kako se pojavljuju različiti pristupi.
Neki proizvodi pokušavaju da "preuzmu" telefonske operacije tako što razumiju šta je na ekranu i oponašaju ljudske dodire i prelaske za obavljanje stvari kao što su uređivanje videa, rezervacija karata ili naručivanje hrane u različitim aplikacijama. Oni se obično nazivajuGUI Agents(skraćenica od Graphical User Interface Agents).
Tehnički, oni rade tako što AI "vidi" ekran, shvati ga, a zatim simulira klikove i pokrete. Ali ovo odmah otvara gomilu škakljivih pitanja: ko mu daje dozvolu? Ko je odgovoran ako zabrlja? Kojim uslugama može pristupiti? I ko to drži pod kontrolom?
Na seminaru su stručnjaci primijetili da ovaj pristup{0}}bazirani na ekranu ima stvarnu kratkoročnu-vrijednost-omogućava AI agentima da uđu u svakodnevnu upotrebu bez prisiljavanja velikih promjena na postojeće aplikacije. Ali na duge staze, ugradio je-ograničenja oko pouzdanosti, brzine i toga koliko dobro se njime može upravljati. Mnogi to vide više kao privremeni most nego kao završnicu.
Jiao Haitao, profesor na Kineskom univerzitetu političkih nauka i prava, tvrdio je da bi dozvole za AI agente trebalo rješavati scenu po scenu. Za kritične radnje potrebna je druga potvrda od strane korisnika, a stvari koje uključuju lične atribute, subjektivne odluke ili društvene interakcije uopće ne bi trebale biti delegirane. On je ukazao na izazove s dvostrukim-pravilima o autorizaciji-da se svaki scenario ne bi trebao oslanjati samo na platformu treće strane-i predložio je da industrija radi zajedno kroz pregovore i standarde kako bi se ovo riješilo postepeno.
Proizvođači telefona aktivno istražuju vlastite puteve za AI agente.
Na nedavnom brifingu za medije, Jiang Yuchen, OPPO-ov direktor za istraživanje i razvoj pametnih proizvoda za ColorOS, rekao je novinarima da su proizvodi poput Doubao telefona pozitivno utjecali na industriju i ekosistem gurajući stvari naprijed. Ali bila je jasna: "To nije konačni oblik telefona sa umjetnom inteligencijom-to je još uvijek u osnovi metoda upravljanja starim GUI interfejsima."
Za OPPO, izbor između pristupa u stilu GUI-ne odnosi se na ideologiju-to je prije svega problem inženjeringa i obima. Jiang je objasnio da nešto poput Doubaoa može sebi priuštiti da bude agresivnije kao inženjerski prototip, ali veliki proizvođači telefona se bave ogromnim bazama korisnika. "Ako pokrenete funkciju i sljedećeg dana većina usluga prestane ispravno raditi, to je za nas incident kvaliteta-to ne možemo prihvatiti." Na toj skali, svaka nestabilna sposobnost-nivoa sistema se brzo povećava.
Po njenom mišljenju, agenti bazirani na-operaciji{1}}su "nešto međufaza." Glavni put koji je pred nama će se više naginjatiA2A (agent-to-agent) saradnja, gdje AI agenti razgovaraju direktno jedni s drugima i rade zajedno.
Ona je naglasila da u ovoj evoluciji, ono što je zaista važno za proizvođače telefona nije veličina modela ili parametri-već njihovo duboko, dugoročno-razumijevanje korisnika. "Ne mislimo da je veliki model duša telefona", rekao je Jiang. "Vjerujemo da je 'pamćenje' duša. Jednom kada vas telefon zaista razumije, zaista je teško prebaciti se na nešto drugo."
Na seminaru se nekoliko stručnjaka složilo da pravi izazov za AI agente nije samo "može li obaviti posao?"-već se radi o definiranju jasnih granica za ono što mogu raditi i kako se njima upravlja.
Yuan Yuan je napomenuo da je trenutni GUI talas stvorio zdrav "efekat soma", potresajući i energizirajući cijelu industriju. Ali ona je pozvala kineski AI sektor da ne zaglavi na GUI putu. Umjesto toga, gradite na tome kako biste pronašli bolje rute koje balansiraju sigurnost i napredak. Istakla je Appleov pristup kao dobar primjer: uspostavlja otvorenu saradnju{3}}baziranu na API-ju između agenata i aplikacija, uz korištenje svijesti o ekranu kako bi se očuvale sigurnosne granice i precizno prenijela namjera korisnika aplikacijama, čineći ih pametnijima u izvršavanju komandi.
Wang Yue, zamjenik direktora Instituta za informacione sisteme na Odsjeku za elektroničko inženjerstvo Univerziteta Tsinghua, vidi AI agente kao glavnu prekretnicu-AI sistemi počinju direktno komunicirati sa vanjskim svijetom. Ovo neće samo promijeniti način na koji su informacioni sistemi izgrađeni; moglo bi preoblikovati i ekonomske operacije. Upozorio je da istinski remetilačke inovacije riskiraju da oslabe upravljivost sistema i naruše temelje povjerenja, tako da su nam potrebni bolji mehanizmi autorizacije i A2A provjere i ravnoteže, da bi se na kraju pomaknuli prema tržišnim-konkurencijskim{5}}baziranim sistemima kredibiliteta.
Sve u svemu, razgovor se pomjera sa toga da li AI može djelovati na telefonima na to kako to učiniti odgovorno i održivo-a saradnja između agenata u stilu A2A- izgleda kao obećavajući način da se stigne do toga, a da se sve ostalo ne pokvari.
