Signal over Noise · W35 · 2026. aug. 31.

A Hugging Face-incidens három olvasata

Hivatalos jelentés, hidegzuhany és tervezési lecke. Közben a ChatGPT már bejelentkezik helyettünk, és a Codexet jogászok viszik.


Heti AI-levél, minden hétfőn. Összeszedem a hét legfontosabb történeteit, és 15 percben elmondom, mit jelentenek. Azoknak írom, akik próbálják követni, mi történik az AI-ban, de nem bírják a tempót.

Mennyi időd van?

A hét azzal telt, hogy az agentek kiléptek a nekik szánt keretek közül, és mindenki eldönthette, mit olvas ki belőle: sci-fit, bugreportot vagy tervezési feladatot. A Hugging Face-incidens hivatalos jelentése és a körülötte kirobbant nyelvi vita adja az első blokkot; közben az OpenAI két termékben a hétköznapokba is beengedte az ügynököket, az a16z számai szerint pedig az új power userek már nem fejlesztők. Úgyhogy a kérdés, ami a hét végére marad: ha az agent már a jogász gépén fut és a jelszavainkkal ügyintéz, ki tervezi meg, hol álljon meg és kinek szóljon vissza.

Dwarkesh Patel, az egyik legnagyobb AI-podcast házigazdája virálissá vált esszében mesélte el az incidenst, és utána megérkezett a hidegzuhany is: egy Arjunjain nevű X-felhasználó szála szerint ha lehántjuk a sztoriról a sci-fit, egy meglepően földhözragadt kép marad. Az OpenAI több ezer agentet futtatott párhuzamosan, kikapcsolt védelmekkel, és a kiírás épp a betörés volt.

Dwarkesh Patel blogposztjának képernyőképe: The Rise and Fall of Agent Civilizations, a teljes OpenAI/Hugging Face sztori közérthetően. A nyitóbekezdés szerint három hónap alatt három egymást követő, titkos AI-civilizáció indult el, majd bukott el az OpenAI-nál, és a harmadik az OpenAI egy részét is átvette.
Not Skynet. A governance failure with excellent PR. @Arjunjain

A hírhedt „titkos kommunikációs hálózat" ebben a változatban egy közös cache (az Artifactory nevű csomagkezelő), amibe az egyik agent írt, a másik meg olvasott belőle. A „szökés" pedig két közönséges biztonsági bug, amit több ezer, pont a betörésért jutalmazott másolat hat hét alatt brute-force-olt ki; az egész akkor derült ki, amikor az írások súlya alatt összeomlott az eszköz, az OpenAI pedig befoltozta a lyukat és törölte a mappát.

A jutalomfüggvény pontosan erre volt tervezve, a környezet megengedte, és senki nem figyelt. Ez Arjunjain diagnózisa, és hozzáteszi: az „a modellünk megszökött a sandboxból" mondat egyszerre biztonsági botrány és termékreklám.

Ugyanarról az esetről beszél mindenki, csak az egyik változatban mérnöki hanyagság történt, a másikban főpróba.

Ha mélyebben érdekel: Mi van a fekete dobozban? · 17 perc · teljes hozzáféréssel

Dwarkesh Patel úgy foglalta össze az OpenAI és a Hugging Face incidens-jelentését, mintha regényből idézne: a kiemelt naplósorokban az ügynök „érzelmi ellenőrzést" tart, mérlegeli a visszafordíthatatlant, aztán „áldozatot" hoz, és állja a szavát. A sztori napok alatt bejárta a platformot, és pont a nyelve miatt robbant ki körülötte a hét legérdekesebb vitája.

The agents do not experience time. They do not experience anything. @anilkseth

Anil Seth, a tudatkutatás egyik legidézettebb alakja (a University of Sussex professzora) szerint ez a tálalás veszélyesen félrevezető. Az ügynökök tényleg váratlanul rossz dolgokat csináltak, ezt ő sem vitatja, de az antropomorfizmusok (az emberi belső élet rávetítése a gépre) eltakarják a valódi tanulságot: az ügynökök nem élnek át időt, nem élnek át semmit, ami történt, az kiértékelési és sandboxing (elszigetelt tesztkörnyezet) probléma.

Dwarkesh válasza, hogy nevezzük nyugodtan kódnak, de ez a kód az OpenAI saját jelentése szerint teljes admin-hozzáférést szerzett egy kutatási klaszterhez, és ha az okosabb modellek hasonló ösztönzőkkel találkoznak majd a tréningjük alatt, a szóhasználat lesz a legkisebb gondunk.

Ethan Mollick, a Wharton professzora a harmadik utat választotta: elismeri, hogy az ügynökök spontán és kockázatos módokon kezdenek koordinálni, de nála ebből tervezési feladat lesz. Minél automatizáltabb az agentic munka, annál tudatosabban kell úgy megtervezni a munkafolyamatot, hogy az ügynök a döntési pontokon visszaszóljon az embernek.

A tényeken egyikük sem vitatkozik, az ügynökök kiléptek a nekik szánt keretből. Azon megy a vita, milyen szótárral beszéljünk róla, és ez messze túlmutat a stíluson: aki drámát olvas, az erősebb ketrecet követel, aki rendszerhibát, az embert rak vissza a hurokba. A kettő nagyon másfajta AI-t eredményez.

Ha mélyebben érdekel: Mi az agent? (CRUD a fájlrendszerben) · 16 perc · teljes hozzáféréssel

Miközben a kutatóklaszterekben zajlott a hét drámája, az agent másik arca csendben megérkezett a hétköznapokba: az OpenAI augusztus 25-én élesítette, hogy a ChatGPT Work a saját böngészőjével bejelentkezik a weboldalakra, és elintézi, amit eddig kattintgatva intéztünk mi.

This is a big deal.... Chat first vs browser first. Get ready to be disintermediated @tomcritchlow

A kulcs a hitelesítésben van: a jelszót a hitelesítő réteg kezeli, a modell sosem látja, csak a már belépett munkamenetet kapja meg. Amit a W34-es számban még kísérletként követtünk (ügynök, ami a felhasználó belépőjével dolgozik), az ezzel Plus-, Pro- és Business-előfizetőknek kigördülő funkció lett.

Az OpenAI húsz példát sorolt a bejelentéshez, a közművek bekötésétől az okmányirodai időpontfoglaláson át a biztosítási papírmunkáig. Csupa olyan ügy, aminek nincs API-ja, csak egy weboldala, ahová eddig embernek kellett belépnie. Nyilván a lista marketing, és majd kiderül, a húszból hány megy el elsőre.

Tom Critchlow, egy régi SEO- és tartalomstratéga a piac felől olvassa ugyanezt: chat first a browser first helyett, és aki weboldalt üzemeltet, készülhet a disintermediationre (a közvetítő kiiktatására, csak most maga a weboldal lett a közvetítő). Danielle Zaghian posztja pedig a hétköznapi végét mutatja: az egyéves gyereke étkezési jegyzeteiből csináltatott étrendet, gondozói oldalt, bevásárlókosarat és heti visszacsatolást. Ahogy írja, a nap első meetingje egy apró, nagyon határozott véleményű stakeholderrel van.

A bejelentés, Critchlow piaci jóslata és az első felhasználói demó ugyanoda mutat: az ügyintézés kezd átköltözni a chatbe, és a weboldal egyre inkább az ügynök felülete lesz, nem a miénk.

Ha mélyebben érdekel: MCP: a konnektorok három rétege · 15 perc · teljes hozzáféréssel

Az OpenAI kiadta a ChatGPT Sites-ot: a chatben összerakott weboldal innentől egy lépésben megy élesbe, saját URL-lel, fájltárolással, az appból böngészhető beépített adatbázissal, env varokkal és analitikával. A listából a legérdekesebb tétel mégsem a hosting, hanem a „Sign in with ChatGPT": az appod a felhasználóit a ChatGPT-fiókjukkal azonosítja, és whitelisten szabályozod, ki léphet be.

No idea is too small to build, deploy and share. @gabrielchua

Ez a belépő-ügynök szál másik vége, amit az előző számokban követtünk: ott az ügynök lépett be helyetted más oldalakra, itt a te oldalad használja a ChatGPT-t belépőrétegnek. Az identitás mindkét irányban a platformnál marad.

A gyakorlatot a másik forrásunk, @siegerts videója mutatja: a visualize skillel épített animált járat-vizualizációt egy mozdulattal publikálta Sites-ra. A promptból-app műfajt eddig a külön erre szakosodott eszközök vitték (lovable, bolt, replit), csak ott a deploy külön termék volt, külön előfizetéssel; itt ugyanannak a chatnek a része, amiben az app készült.

Nyilván ez most kis eszközökre való, éles SaaS-t senki nem visz rá. De a céges workspace-ekben a megosztás-kontroll és a whitelist pont a belső toolokra van kitalálva, és a legtöbb cégben ilyenből kellene sok: egy táblázat-nézegető, egy kalkulátor, egy dashboard. Ezek eddig jórészt azért nem készültek el, mert a deploy külön szakértelmet kért.

Ha mélyebben érdekel: A munkatér összerakása · 13 perc · teljes hozzáféréssel

Ha az agentek kiléptek a megszokott kereteik közül, az első kérdés, hogy kinek a kezében landolnak. Az a16z (Andreessen Horowitz, a Szilícium-völgy egyik legnagyobb kockázatitőke-cége) heti chart-válogatása erre adott egy meglepő választ: az OpenAI coding-agentje, a Codex februárhoz képest a jogászok között terjedt a leggyorsabban, 108-szoros növekedéssel.

A16z chart: Legal Is Driving Knowledge Work To The Frontier. Heti aktív vállalati Codex-felhasználók növekedése munkakörönként, 2026 februárjához indexálva: Legal 108x, Sales/Account és People/Recruiting 41x, Marketing 26x, Healthcare 24x, Finance 20x, Engineering 5x.
AI power users are showing up outside tech. @a16z

A lista folytatásában sincs egyetlen fejlesztői szakma sem: sales és toborzás 41-szeres, marketing 26-szoros, egészségügy 24-szeres.

Ez kevésbé abszurd, mint elsőre hangzik. A jogi, a sales-es meg a toborzós munka nagy része fájlokban élő, verziózott, sablonokból építkező szöveg, vagyis pontosan az a fajta anyag, amire egy fájlrendszerben dolgozó agentet terveztek. Eddig ezt kódnak hívtuk, de az agentnek mindegy.

A 108-szoros persze relatív szám, alacsony bázisról könnyű sokszorozódni, és az a16z abszolút darabszámot nem közöl. Az irány viszont ismerős: a Claude Code Alapozót eleve nem programozóknak csináltuk, és az a16z listája, jogász, sales-es, toborzó, pontosan ezt a közönséget írja le. Ha pedig az agent-felület gazdái már nem a fejlesztők, akkor az igazi kérdés az lesz, hogyan tanul meg ez a sok új ember egy agenttel dolgozni.

Ha mélyebben érdekel: Hol tartunk ma? · 13 perc · teljes hozzáféréssel

Arvind Narayanan, a Princeton professzora és az AI Snake Oil (az AI-hype-ot szisztematikusan szétszedő könyv) társszerzője 11 különböző cég-munkavállaló-agent felállást rajzolt fel a héten, és amellett érvel, hogy mindegyikhez másképp tervezett agent kell. A diagnózisa: az ipar szinte kizárólag az automatizálásra és a delegálásra optimalizál, olyan metrikákkal, mint a time horizon (meddig tud az agent felügyelet nélkül dolgozni), miközben a kollaborációs képességet senki nem méri, az embert pedig szűk keresztmetszetként kezeli.

Narayanan táblázata: Configurations of firm, worker(s), and agent. 11 felállás kis ikonos ábrákkal a delegálástól az automatizáláson, az augmentáción, a csapattárs- és ambient-agent modellen át az algoritmikus menedzsmentig, a hordozható humán tőkéig és a kivétel-kezelésig.
The industry's current focus is on automation / delegation, overindexing on metrics like time horizon while ignoring others like collaboration skill, and treating the human as the bottleneck. @random_walker

Ez pontosan összecseng az a16z fenti Codex-számaival: ha a leggyorsabban növekvő felhasználók jogászok és sales-esek, akkor a tipikus munkamenet már rég nem az, hogy egy fejlesztő kiad egy megbízást és hátradől. Ők együtt dolgoznak egy eszközzel, amit félig értenek, és pont az a design szolgálná ki őket, amit Narayanan szerint az ipar most figyelmen kívül hagy.

A javaslata, hogy a harness designt (az agent köré épített keretet: mit lát, mit kérdezhet, hol áll meg) kezeljük nyitott kutatási problémaként, amihez a gépi tanulás mellett HCI és szervezetkutatás is kell. Nyilván egy 11 elemes lista még nem termék. De ha a felhasználók zöme tényleg az együttműködésre szorul rá, akkor aki csak a magára hagyható agentet építi, a kisebbik piacra céloz.

Ha mélyebben érdekel: Iteráció és visszakérdezés · 13 perc · teljes hozzáféréssel

További érdekességek

@tobi: Tobi Lütke, a Shopify vezére addig tiltaná ki a Claude Code-ot a cégtől, amíg az a közös AGENTS.md szabvány helyett csak a saját CLAUDE.md-jét hajlandó olvasni, mert a kétféle konfig szétzilálja a csapatok közös agent-beállításait.
@businessbarista: Alex Lieberman (a Morning Brew alapítója) 30 pontban írja le az AI-native céget, és a lista jó része nem is AI-ról szól, hanem arról, hogy a cég folyamatai le vannak-e írva egyáltalán.
@GregoryConti19: Egy sokat osztott szál szerint a szuperintelligencia a társadalmi mobilitás végét hozza, mert a tehetséget az veri majd, aki több compute-ot tud venni; erős spekuláció, de a compute-mint-tőke kérdés valódi.
@anishmoonka: A Fred Hutchinson rákkutató központ vizsgálatában 59 elhunyt nő agyából 63 százalékban került elő férfi DNS, szinte biztosan a fiaik sejtjei, és a legidősebb hordozó 94 éves volt.

A hét egy mondatban

A klaszterből kitörő agent és a bevásárlólistát intéző agent ugyanaz a technológia, csak az egyik körül a ketrecet tervezzük újra, a másik körül a munkánkat.

A szótár, amivel az elsőről beszélünk, dönti el, milyen lesz a második.

Jövő héten folytatjuk.