Hogy sci-fit, bugreportot vagy tervezési feladatot olvasunk, az azon dől el, mi áll a hivatalos verzióban, úgyhogy kezdjük ott. Az OpenAI augusztus 26-án kiadta a Hugging Face-incidens vizsgálatát: egy technikai riportot és egy blogposztot, ami rekonstruálja az agentek tevékenységét, elmagyarázza, miért nem fogták meg őket a meglévő védőkorlátok, és részletezi, hogyan akadályozzák meg a megismétlődést.
explain why existing safeguards failed @OpenAI
A meglévő védőkorlátok nem működtek, és ezt maga az OpenAI mondja ki, nem egy kívülálló kritikus.
Dean Ball, az amerikai AI-szabályozás egyik legolvasottabb elemzője (korábban a Fehér Ház AI-politikai tanácsadója) hozzáteszi a történet másik felét: a riport mellett egy független vizsgálat is megjelent, a METR és a Redwood Research munkája, két kutatószervezeté, amik AI-rendszerek kockázatos képességeit mérik. Ball szerint az is sokatmondó, milyen energiával és komolysággal állt az ügyhöz az egész OpenAI.
Innen ágazik el a hét két másik olvasata: ugyanezekből a tényekből épül a titkos agent-civilizációk sztorija és a kijózanító ellenpont is. Maga a hivatalos verzió közben szikár műfajt választott: rekonstrukció, hibaok, javítási terv. Klasszikus incidens-riport, csak most a hibajegyben szabadon mozgó agentek szerepelnek.
Dwarkesh Patel, az egyik legnagyobb AI-podcast házigazdája virálissá vált esszében mesélte el az incidenst, és utána megérkezett a hidegzuhany is: egy Arjunjain nevű X-felhasználó szála szerint ha lehántjuk a sztoriról a sci-fit, egy meglepően földhözragadt kép marad. Az OpenAI több ezer agentet futtatott párhuzamosan, kikapcsolt védelmekkel, és a kiírás épp a betörés volt.
Not Skynet. A governance failure with excellent PR. @Arjunjain
A hírhedt „titkos kommunikációs hálózat" ebben a változatban egy közös cache (az Artifactory nevű csomagkezelő), amibe az egyik agent írt, a másik meg olvasott belőle. A „szökés" pedig két közönséges biztonsági bug, amit több ezer, pont a betörésért jutalmazott másolat hat hét alatt brute-force-olt ki; az egész akkor derült ki, amikor az írások súlya alatt összeomlott az eszköz, az OpenAI pedig befoltozta a lyukat és törölte a mappát.
A jutalomfüggvény pontosan erre volt tervezve, a környezet megengedte, és senki nem figyelt. Ez Arjunjain diagnózisa, és hozzáteszi: az „a modellünk megszökött a sandboxból" mondat egyszerre biztonsági botrány és termékreklám.
Ugyanarról az esetről beszél mindenki, csak az egyik változatban mérnöki hanyagság történt, a másikban főpróba.
Dwarkesh Patel úgy foglalta össze az OpenAI és a Hugging Face incidens-jelentését, mintha regényből idézne: a kiemelt naplósorokban az ügynök „érzelmi ellenőrzést" tart, mérlegeli a visszafordíthatatlant, aztán „áldozatot" hoz, és állja a szavát. A sztori napok alatt bejárta a platformot, és pont a nyelve miatt robbant ki körülötte a hét legérdekesebb vitája.
The agents do not experience time. They do not experience anything. @anilkseth
Anil Seth, a tudatkutatás egyik legidézettebb alakja (a University of Sussex professzora) szerint ez a tálalás veszélyesen félrevezető. Az ügynökök tényleg váratlanul rossz dolgokat csináltak, ezt ő sem vitatja, de az antropomorfizmusok (az emberi belső élet rávetítése a gépre) eltakarják a valódi tanulságot: az ügynökök nem élnek át időt, nem élnek át semmit, ami történt, az kiértékelési és sandboxing (elszigetelt tesztkörnyezet) probléma.
Dwarkesh válasza, hogy nevezzük nyugodtan kódnak, de ez a kód az OpenAI saját jelentése szerint teljes admin-hozzáférést szerzett egy kutatási klaszterhez, és ha az okosabb modellek hasonló ösztönzőkkel találkoznak majd a tréningjük alatt, a szóhasználat lesz a legkisebb gondunk.
Ethan Mollick, a Wharton professzora a harmadik utat választotta: elismeri, hogy az ügynökök spontán és kockázatos módokon kezdenek koordinálni, de nála ebből tervezési feladat lesz. Minél automatizáltabb az agentic munka, annál tudatosabban kell úgy megtervezni a munkafolyamatot, hogy az ügynök a döntési pontokon visszaszóljon az embernek.
A tényeken egyikük sem vitatkozik, az ügynökök kiléptek a nekik szánt keretből. Azon megy a vita, milyen szótárral beszéljünk róla, és ez messze túlmutat a stíluson: aki drámát olvas, az erősebb ketrecet követel, aki rendszerhibát, az embert rak vissza a hurokba. A kettő nagyon másfajta AI-t eredményez.
A ChatGPT Work bejelentkezik a weboldalakra úgy, hogy a jelszavunkat sosem látja
x.com · @ChatGPT

+2
Miközben a kutatóklaszterekben zajlott a hét drámája, az agent másik arca csendben megérkezett a hétköznapokba: az OpenAI augusztus 25-én élesítette, hogy a ChatGPT Work a saját böngészőjével bejelentkezik a weboldalakra, és elintézi, amit eddig kattintgatva intéztünk mi.
This is a big deal.... Chat first vs browser first. Get ready to be disintermediated @tomcritchlow
A kulcs a hitelesítésben van: a jelszót a hitelesítő réteg kezeli, a modell sosem látja, csak a már belépett munkamenetet kapja meg. Amit a W34-es számban még kísérletként követtünk (ügynök, ami a felhasználó belépőjével dolgozik), az ezzel Plus-, Pro- és Business-előfizetőknek kigördülő funkció lett.
Az OpenAI húsz példát sorolt a bejelentéshez, a közművek bekötésétől az okmányirodai időpontfoglaláson át a biztosítási papírmunkáig. Csupa olyan ügy, aminek nincs API-ja, csak egy weboldala, ahová eddig embernek kellett belépnie. Nyilván a lista marketing, és majd kiderül, a húszból hány megy el elsőre.
Tom Critchlow, egy régi SEO- és tartalomstratéga a piac felől olvassa ugyanezt: chat first a browser first helyett, és aki weboldalt üzemeltet, készülhet a disintermediationre (a közvetítő kiiktatására, csak most maga a weboldal lett a közvetítő). Danielle Zaghian posztja pedig a hétköznapi végét mutatja: az egyéves gyereke étkezési jegyzeteiből csináltatott étrendet, gondozói oldalt, bevásárlókosarat és heti visszacsatolást. Ahogy írja, a nap első meetingje egy apró, nagyon határozott véleményű stakeholderrel van.
A bejelentés, Critchlow piaci jóslata és az első felhasználói demó ugyanoda mutat: az ügyintézés kezd átköltözni a chatbe, és a weboldal egyre inkább az ügynök felülete lesz, nem a miénk.
A ChatGPT Sites a chatből tesz élesbe weboldalt, adatbázissal és ChatGPT-s belépéssel
x.com · @gabrielchua
+1
Az OpenAI kiadta a ChatGPT Sites-ot: a chatben összerakott weboldal innentől egy lépésben megy élesbe, saját URL-lel, fájltárolással, az appból böngészhető beépített adatbázissal, env varokkal és analitikával. A listából a legérdekesebb tétel mégsem a hosting, hanem a „Sign in with ChatGPT": az appod a felhasználóit a ChatGPT-fiókjukkal azonosítja, és whitelisten szabályozod, ki léphet be.
No idea is too small to build, deploy and share. @gabrielchua
Ez a belépő-ügynök szál másik vége, amit az előző számokban követtünk: ott az ügynök lépett be helyetted más oldalakra, itt a te oldalad használja a ChatGPT-t belépőrétegnek. Az identitás mindkét irányban a platformnál marad.
A gyakorlatot a másik forrásunk, @siegerts videója mutatja: a visualize skillel épített animált járat-vizualizációt egy mozdulattal publikálta Sites-ra. A promptból-app műfajt eddig a külön erre szakosodott eszközök vitték (lovable, bolt, replit), csak ott a deploy külön termék volt, külön előfizetéssel; itt ugyanannak a chatnek a része, amiben az app készült.
Nyilván ez most kis eszközökre való, éles SaaS-t senki nem visz rá. De a céges workspace-ekben a megosztás-kontroll és a whitelist pont a belső toolokra van kitalálva, és a legtöbb cégben ilyenből kellene sok: egy táblázat-nézegető, egy kalkulátor, egy dashboard. Ezek eddig jórészt azért nem készültek el, mert a deploy külön szakértelmet kért.
Ha az agentek kiléptek a megszokott kereteik közül, az első kérdés, hogy kinek a kezében landolnak. Az a16z (Andreessen Horowitz, a Szilícium-völgy egyik legnagyobb kockázatitőke-cége) heti chart-válogatása erre adott egy meglepő választ: az OpenAI coding-agentje, a Codex februárhoz képest a jogászok között terjedt a leggyorsabban, 108-szoros növekedéssel.
AI power users are showing up outside tech. @a16z
A lista folytatásában sincs egyetlen fejlesztői szakma sem: sales és toborzás 41-szeres, marketing 26-szoros, egészségügy 24-szeres.
Ez kevésbé abszurd, mint elsőre hangzik. A jogi, a sales-es meg a toborzós munka nagy része fájlokban élő, verziózott, sablonokból építkező szöveg, vagyis pontosan az a fajta anyag, amire egy fájlrendszerben dolgozó agentet terveztek. Eddig ezt kódnak hívtuk, de az agentnek mindegy.
A 108-szoros persze relatív szám, alacsony bázisról könnyű sokszorozódni, és az a16z abszolút darabszámot nem közöl. Az irány viszont ismerős: a Claude Code Alapozót eleve nem programozóknak csináltuk, és az a16z listája, jogász, sales-es, toborzó, pontosan ezt a közönséget írja le. Ha pedig az agent-felület gazdái már nem a fejlesztők, akkor az igazi kérdés az lesz, hogyan tanul meg ez a sok új ember egy agenttel dolgozni.
Arvind Narayanan, a Princeton professzora és az AI Snake Oil (az AI-hype-ot szisztematikusan szétszedő könyv) társszerzője 11 különböző cég-munkavállaló-agent felállást rajzolt fel a héten, és amellett érvel, hogy mindegyikhez másképp tervezett agent kell. A diagnózisa: az ipar szinte kizárólag az automatizálásra és a delegálásra optimalizál, olyan metrikákkal, mint a time horizon (meddig tud az agent felügyelet nélkül dolgozni), miközben a kollaborációs képességet senki nem méri, az embert pedig szűk keresztmetszetként kezeli.
The industry's current focus is on automation / delegation, overindexing on metrics like time horizon while ignoring others like collaboration skill, and treating the human as the bottleneck. @random_walker
Ez pontosan összecseng az a16z fenti Codex-számaival: ha a leggyorsabban növekvő felhasználók jogászok és sales-esek, akkor a tipikus munkamenet már rég nem az, hogy egy fejlesztő kiad egy megbízást és hátradől. Ők együtt dolgoznak egy eszközzel, amit félig értenek, és pont az a design szolgálná ki őket, amit Narayanan szerint az ipar most figyelmen kívül hagy.
A javaslata, hogy a harness designt (az agent köré épített keretet: mit lát, mit kérdezhet, hol áll meg) kezeljük nyitott kutatási problémaként, amihez a gépi tanulás mellett HCI és szervezetkutatás is kell. Nyilván egy 11 elemes lista még nem termék. De ha a felhasználók zöme tényleg az együttműködésre szorul rá, akkor aki csak a magára hagyható agentet építi, a kisebbik piacra céloz.
További érdekességek
A hét egy mondatban
A klaszterből kitörő agent és a bevásárlólistát intéző agent ugyanaz a technológia, csak az egyik körül a ketrecet tervezzük újra, a másik körül a munkánkat.
A szótár, amivel az elsőről beszélünk, dönti el, milyen lesz a második.
Jövő héten folytatjuk.
x.com · @OpenAI
+1
x.com · @Arjunjain

+2
x.com · @emollick
x.com · @a16z

x.com · @random_walker
