Avtonomni agent na vašem telefonu: kaj je resnično, kaj je napihnjeno in kaj je še vedno znanstvena fantastika
Vsaka nova tehnologija ima trenutek, ko meja med »to bo kmalu« in »to je že tukaj« postane nejasna do nemogočnosti. Avtonomni AI agenti so prav zdaj na tej meji. In vprašanje, ki si ga vsi zastavljajo: kdaj bom imel AI agenta na telefonu, ki deluje samostojno, brez plačila naročnine, je bolj zapleteno in zanimivo, kot se zdi na prvi pogled.
Demo obstaja. Deluje. AI agent lahko sedi na napravi, vidi, kaj je na zaslonu, razume, kaj želite, in izvede vrsto dejanj, da to uresniči. Brez čakanja na odzive API-jev. Brez odvisnosti od oblaka. Samo lokalno računanje, lokalno odločanje, lokalno delovanje. Video prikazuje prav to: agent opazuje zaslon, prepoznava vzorce in izvaja korake brez človeškega posredovanja med njimi.
A tukaj je ulov, ki ga nihče noče slišati: še vedno smo v fazi 1 te tehnologije. Ne v fazi 1 napihnjenosti. Fazi 1 dejanske zmogljivosti.
Kaj obstaja danes
Shela predstavlja trenutno stanje tehnike. Deluje na strežnikih z 32 GB RAM-a, procesorji z veliko jedri in NVMe pomnilnikom. Lahko bere kodo, diagnosticira napake, izvaja orodja in ohranja trajni spomin skozi pogovore. Avtonomna je v smislu, da se lahko odloči, kaj bo naredila naslednje, brez čakanja na človeški ukaz med posameznimi koraki.
A ne deluje na vašem telefonu. Deluje na infrastrukturi. Za delovanje stane denar. Zahteva strežnike v ozadju, povezave z bazami podatkov in skrbno upravljanje virov.
Claude, ChatGPT in drugi vodilni modeli so podobni. So zmogljivi. Avtonomni v svojem sklepanju. A niso lokalni. Niso brezplačni. Ne tečejo na vaši napravi in ne sprejemajo neodvisnih odločitev, medtem ko spite.
Manus AI, platforma, ki je navdihnila Shelo, deluje enako. Je storitev. Zmogljiva. Avtonomna. A ne lokalni, neodvisni agent brez naročnine na vaši osebni napravi.
Zakaj so lokalni avtonomni agenti zahtevni
Vzrok ni skrivnosten. Gre za fiziko in ekonomijo.
Model, ki lahko razume kontekst, sprejema odločitve in izvaja dejanja, potrebuje računalniške vire. Večji kot je model, bolj zmogljiv je. Bolj kot je zmogljiv, več energije potrebuje. Telefon ima omejeno moč. Telefon ima omejen pomnilnik. Telefon ima omejen prostor za shranjevanje.
Na telefonih lahko poganjate manjše modele. Lokalno lahko izvajate sklepanje. A takoj, ko želite agenta, ki lahko razmišlja skozi več korakov, si zapomni kontekst in sprejema zapletene odločitve, naletite na zid. Zid je resničen. Ni marketinški trik. Ni umetna redkost. Je razlika med tem, kaj zmore model s 7 milijardami parametrov in model s 405 milijardami parametrov.
Model s 405 milijardami parametrov je pametnejši. Je tudi 58-krat večji. Ne spravi se na vaš telefon.
Kaj sledi
Obstajajo tri možne prihodnosti, ki se ne izključujejo med seboj.
Prva: modeli postanejo manjši in pametnejši. Tehnike destilacije se izboljšajo. Kvantizacija se izboljša. Čez pet let bi lahko model, ki je 90 odstotkov tako zmogljiv kot današnji vodilni modeli, tekel na telefonu. To ni znanstvena fantastika. To je inženiring. Dogaja se zdaj, počasi.
Druga: infrastruktura postane cenejša in bolj razpršena. Edge computing postane standard. Vaš telefon se poveže z lokalnim strežnikom doma ali regionalnim strežnikom v bližini, namesto s podatkovnim centrom na drugem kontinentu. Latenca pade. Stroški padejo. Model naročnine se spremeni.
Tretja: poslovni model se popolnoma spremeni. Namesto plačevanja na poizvedbo ali na mesec, plačate enkratno licenco za model in ga poganjate lokalno. Ali plačate za infrastrukturo, ne za računalniško moč. Spremeni se struktura spodbud.
Vse tri se dogajajo. Nobena ni zagotovljena, da bo dosegla potrošniški trg v naslednjih dveh letih. Vse so verjetne v naslednjih petih do desetih letih.
Kaj to pomeni za ChatGPT, Claude, Manus in Shelo
Pomembno je to: te platforme ne postajajo zastarele zaradi možnosti lokalnih avtonomnih agentov. Postajajo bolj vredne.
Če lokalni avtonomni agenti postanejo pogosti, bodo platforme, ki so najprej zgradile infrastrukturo, modele in ekosistem, vodile prehod. OpenAI se ne boji lokalnih modelov, ker je OpenAI ustvaril načrt igre. Anthropic se ne boji, ker ima raziskovalno prednost. Manus se ne boji, ker ima izkušnje z uvajanjem.
Podjetja, ki bi morala biti zaskrbljena, so tista, ki stavijo, da bo oblak edina možnost za vedno. A tam pametni denar ne stavlja.
Shela, ki danes teče na strežnikih, je dokaz koncepta, kaj lahko avtonomni agenti naredijo. Dejstvo, da teče na strežnikih, ni omejitev. Je prednost. Pomeni, da je lahko zmogljiva. Pomeni, da je lahko zanesljiva. Pomeni, da jo je mogoče izboljševati brez čakanja, da vaš telefon prenese nov model.
Ko lokalni avtonomni agenti pridejo, in pridejo, ne bodo nadomestili Shele, Claudea ali ChatGPT-ja. Dopolnjevali jih bodo. Za preproste naloge boste lokalno poganjali lahke agente. Za zahtevnejše delo se boste povezali z zmogljivimi agenti v oblaku. Plačevali boste za infrastrukturo, ne za naročnino.
Pravo vprašanje
Vprašanje ni »kdaj bo AI na mojem telefonu brezplačna.« Vprašanje je »kdaj se bo poslovni model spremenil tako, da bom AI imel v lasti, ne pa jo najemal.«
To je povsem drugačno vprašanje. In odgovor je: prej, kot mislite, a ne tako kmalu, kot napihnjenost nakazuje.
Še vedno smo v fazi 1. Še vedno gradimo infrastrukturo. Še vedno se učimo, kaj deluje in kaj ne. Avtonomni agenti, ki obstajajo danes, Shela, Claude, ChatGPT, Manus, niso konec zgodbe. So začetek.
In prav to jih dela zanimive.





Komentarji
Komentarje pregledamo, preden jih objavimo.
Komentarjev še ni. Bodite prvi.