Az Anthropic a token-sorsolásba építette a vízjelet, nincs belőle mit kitörölni
x.com · @elder_plinius
+3
Augusztus 10-én jelentette be az Anthropic, hogy vízjelet tesz a Claude szövegeibe és a fájlokhoz csatolt metaadatokba. Az aggregátor-fiókok azonnal vitték szét („láthatatlan vízjel MINDEN szövegben"), a technikai közönség pedig láthatatlan Unicode-karakterekre kezdett vadászni, mert így képzeli el az ember a rejtett jelet.
Négy nappal később, az Anthropic kérdés-válasz oldala után Pliny (elder_plinius, a jailbreak-közösség egyik legismertebb alakja) leírta, mi történik valójában. A Claude minden szónál egy valószínűség-felhőből sorsol, és a vízjel ezt a sorsolást cseréli le: a véletlen forrása egy titkos kulcsból és az addigi szövegkörnyezetből származik. Egyetlen tokenen nincs mit észrevenni, több ezer szó-választás viszont statisztikai aláírást ad ki annak, akinél a kulcs van.
The output IS the watermark. @elder_plinius
A szóválasztás mintázata maga a jel, ezért a copy-paste sem visz el belőle semmit, hiszen a hordozót másoltuk ki. A módszer a Google DeepMind SynthID-Text nevű megoldásának egy változata, ezt az Anthropic meg is erősítette.
A pánik-oldalon közben egy másik lista futott. Arturo Villa összefoglalója szerint a jel permanens és eltávolíthatatlan, minden új modellre jön, a meglévőkre decemberben, a fordításokra is, és az Anthropic globálisan alkalmazza, nem csak abban az unióban, ahol az AI Act mellé tartozó magatartási kódexet önként írta alá. A poszt tanácsa: aki zéró-AI szabály alatt ad le munkát, váltson szolgáltatót.
Alex Cui, a GPTZero (AI-detektorokat fejlesztő cég) technológiai vezetője kívülről ugyanezt a mechanikát írta le, a korlátaival együtt. Az átfogalmazás az egyszerűbb változatoknál elrontja a hasheket, a rövid vagy kiszámítható szövegben (mondjuk egy „2+2=4"-ben) nincs elég szabadságfok az aláíráshoz, a minőségre pedig van hatás, csak a Google 20 ezer szövegen futtatott tesztje szerint nem észrevehető.
A permanencia a nyers kimenetre igaz, arra a folyamatra viszont már nem, amiben egy ember átírja, összevágja és beszerkeszti a szöveget. Az Anthropic bejelentett detektora ráadásul bináris: azt mondja meg, volt-e AI, azt nem, hogy mennyi, hol és mihez képest. Vezetőként innen az a kérdés, hol vállaljuk fel a gépi kört és hol nem. A „nincs benne AI" szabály ugyanis mostantól eldönthető, és amit el lehet dönteni, azt előbb-utóbb el is fogja dönteni valaki.
Egy connecticuti férfi, aki saját magát képviselte a perben, apró fehér betűkkel rejtett utasításokat a hivatalos beadványaiba, emberi szemnek olvashatatlanul, azzal a tartalommal, hogy a dokumentumot átnéző AI neki adjon igazat. Az ügyet a 404 Media írta meg augusztus közepén.
A bejövő papír ugyanígy elveszti a semlegességét. A prompt injection (a szövegbe rejtett utasítás, ami a dokumentumot feldolgozó modellhez beszél, miközben az emberi szem átfut fölötte) eddig javarészt biztonsági bemutatókból és álláspályázatokból volt ismerős, ahol a fehér betűs trükk a HR-szűrőt célozta. Bírósági iratban azért súlyosabb, mert ott maga a dokumentum az eljárás, és a beadvány szerzője abból indult ki, hogy a papírját először egy modell olvassa el.
Written in tiny white text invisible to humans. @MTSlive
Az eset aznap már a Polymarketnél, a nagy fogadási piacnál is ment, JUST IN felvezetéssel. A rejtett utasítás ezzel átlépett a biztonsági szaklapokból abba a hírfolyamba, ahol nem szakemberek olvassák.
Egyetlen ügy, egy magát képviselő ember, és a trükköt kiszúrták, tehát a rendszer ezúttal működött. Ami mégis marad belőle: ha a bejövő anyagokat modellel szűrjük elő, a védekezés azon a fegyelmen áll, hogy a gépi összefoglalót valaki visszaolvassa a forrás mellett, és hogy előre le legyen írva, melyik iratot kell embernek is végigolvasnia. A naplóból utólag legalább az kiderül, melyik dokumentumból jött a döntés alapja.
Az xAI, Elon Musk AI-cége augusztus 11-én kiadta a Grok Botot, ami saját gépet kap, és a mi belépőnkkel jelentkezik be a Gmailbe, a Salesforce-ba, a LinkedInre. A bejelentés saját szavai szerint a botok AI-csapattársak, amik ugyanúgy használják az eszközeinket, ahogy mi, és akkor is dolgoznak, amikor a laptop csukva van. Egyszer megmutatunk nekik egy folyamatot, abból rutin lesz, több bot fut párhuzamosan, és egymás között adják át a feladatokat.
They sign in to your tools, use them just like you do. @bot
Eddig arról szólt a hét, hogy egy szövegről eldönthető-e, gép írta-e. A bot elvégzett munkával jön vissza, és ezzel a kérdés a fogalmazványokról a műveletekre csúszik.
kimmonismus, aki naponta bontja szét az új kiadásokat, a terjesztést tartja a legárulkodóbbnak: a letöltéseket a Cursor, az AI-kódszerkesztő hosztolja, a Cursor Ultra-előfizetés tartalmazza a botokat, és az xAI a Grok Bot oldalán Cursor-csomagot ad el.
Lenny Rachitsky, a Lenny's Newsletter szerzője korai hozzáférést kapott, és négy dolgot sorol fel, amit már rábízott: állást keresők párosítása hirdető cégekkel, support-emailek automatikus megválaszolása, a bankkártya-kivonatai átfésülése az elfeledett előfizetésekért, és briefek a közelgő podcast-vendégekről. A meglévő önhosztolt ügynökökhöz képest egyszerűbbnek és kevésbé félelmetesnek írja le, és pont ez a súrlódás-csökkenés az, amiből vezetői kérdés lesz.
Az a négy tétel ugyanis két csoportra esik szét. A brief és az előfizetés-lista olvasásból áll, ott a legnagyobb baj a pontatlanság, a kiküldött support-email viszont a mi nevünkben megy el, az előfizetés-lemondás pedig egy szerződést szüntet meg. Amíg egy óra ilyen munka a néhány dolláros sávban van, a költség nem fogja megszűrni, mit adunk oda. A szűrő az lesz, hogy a fiók, amibe az ügynök belép, mit tud írni, elküldeni és törölni.
Az a16z, a Szilícium-völgy egyik legnagyobb kockatőkése a hét elején kiposztolt egy órabér-összevetést a computer-use ügynökökről (azokról az AI-ügynökökről, amik magát a böngészőt és a felületeket kezelik): 6-8 dollár egy gépi munkaóra, a tengerentúlra kiszervezett munkaerőnél 10 körül, amerikai munkatársnál 30-45 között. A számnál többet mond a mellé tett indoklás, hogy az irány innen is lefelé megy, mert az inference (a modell futtatása) folyamatosan olcsóbb lesz, és a nyílt modellek egyre több workflow-hoz elég jók.
The math only gets better, inference keeps getting cheaper. @a16z
Az összevetés két különböző dolgot tesz egymás mellé. A kiszervezett kollégának saját fiókja, saját belépője és saját felelősségi lánca van, a computer-use ügynök a mi fiókjainkba lép be, a mi jogosultságainkkal, és ez a különbség nincs benne a 6 dollárban.
Egy 40 dolláros órabérhez üzleti indoklás kell, és valaki aláírja, 6 dollárnál viszont nincs, aki aláírja, mert be sem kerül a döntési folyamatba. A csapat kipróbálja, működik, és fél évvel később derül ki, mi mindenhez volt közben hozzáférése. Az árlistát könnyű összehasonlítani, a rossz lépés költségét nem: egy elküldött ajánlat, egy lemondott foglalás, egy törölt rekord súlya azon múlik, visszatehető-e a dolog a helyére.
Riley Brown 10 perc beszédből kapja meg a diagramjai 80 százalékát
x.com · @petergyang
Riley Brown, aki 1,5 milliónál több követővel visz egy egyszemélyes tartalom-üzletet, Peter Yang új epizódjában elmondta, hogyan készül a diagramjai zöme. Bekapcsolja a Wispr Flow-t (beszéd-diktáló app), sétál 10 percet, kimondja az összes ötletét, aztán kér egy kilenc lapos Excalidraw-vázlatot. Mire visszaér, megvan annak a 80 százaléka, amit tényleg használni fog, és rámegy még 20 perc szerkesztés.
When I come back, it has 80% of the diagrams I'll use. @rileybrown
Ha a szöveg eredete eldönthetővé vált, akkor a következő kérdés az, mi marad a folyamatban emberi, és itt az arányok válaszolnak. 10 perc gondolkodás elöl, 20 perc válogatás a végén, a kettő közötti gyártás pedig kikerült a napjából. Ugyanez a mintázat a skill-fájlokban is, amikkel a Codexet vezeti: Brown szerint egyet sem nyitott meg soha, ha rossz az output, megkéri a modellt, hogy javítsa a saját utasítását.
Óvatosan ezzel a számmal. Itt egy tartalom-üzlet fut, ahol a legrosszabb kimenet egy csúnya ábra, a 80 százalék pedig a szerző saját becslése a saját munkájáról. Ahol a leadott anyagért vállalunk valamit, ott az a 20 perc a folyamat legdrágább része. A vízjel meg fogja tudni mondani, hogy a diagram gépből jött. Azt, hogy miért pont az a kilenc lap került egymás után, a szerzőn kívül nem tudja megmondani senki.
Amodei saját bevallása szerint alig jár a közösségi médián, augusztus 15-én mégis leült egy több bekezdéses válaszra egy vitapartnerének, aki a szabályozást a hatalom összegyűjtésével tette egyenlővé. Azt a szembeállítást, hogy a technológia vagy pár kiválasztott cég és politikus kezében gyűlik össze a szabályozás által, vagy szabadon szétterjed, hamis választásnak nevezi.
At their best, institutions can vest power in ideas rather than people. Dario Amodei
Helyette egy intézményi érvet ad: a bíróság is tud avíttnak és elitistának tűnni, a kiszolgáltatott ember jogait mégis jobban védi, mint a lincselő tömeg. A jól működő intézmény emberek helyett ötletekbe helyezi a hatalmat, és pont ezzel szórja szét.
Az érdekes rész az analógia mögötti három javaslat. Az általa támogatott kaliforniai SB 53 minden 500 millió dollár alatti bevételű céget kivesz a hatálya alól. A CAISI-nál (az amerikai állami AI-tesztelő intézetnél) és a Fehér Háznál szorgalmazott eljárás a frontier modellekre szigorúbb, mint a mögöttük járókra. A Pacing the Frontier néven futó felhívás pedig a legjobb modellek tempóját fékezné, a felzárkózókét nem. Mind a három az Anthropic üzleti érdeke ellen dolgozik, és a kihívóknak segít, az open-weights modelleket is beleértve.
Amodei közben kimondja, hogy az AI szerkezetileg hatalomkoncentráló technológia, ami egy frontier labor vezetőjétől szokatlan tétel. Egy szabály pontosan annyit ér, amennyit a küszöbszáma, és a küszöböt embernek kell kitalálnia. Az 500 millió dolláros határ nem következik semmiből, valaki leírta, és attól kezdve az a határ.
További érdekességek
A hét egy mondatban
A hét szálai ugyanoda futnak ki. A kimenet elárulja, hogy gépből jött, a beadvány a modellhez beszél, az ügynök pedig a saját fiókunkban intézkedik, és mindhárom mellé kell egy ember, aki visszaolvassa.
Ami emberi marad, az a küszöb kitalálása: hol vállaljuk fel a gépi kört, melyik iratot kell végigolvasni, és melyik művelet előtt kell valakinek kézzel rányomnia. Amodei 500 millió dolláros határa és a workshopos tíz folyamat ugyanaz a munka, csak más méretben.
Jövő héten folytatjuk.

x.com · @MTSlive
+1
x.com · @bot
+2
x.com · @a16z

x.com · @DarioAmodei