Anthropic je branio Fable 5 neposredno prije vladine zabrane. “Sigurnost AI-ja uvijek je stvar procjene”

U intervjuu koji je dao samo nekoliko sati prije nego što je američka vlada izdala direktivu o gašenju najnovijeg Anthropicovog AI modela, glavni direktor za komercijalne poslove tvrtke rekao je za Forbes kako postoje određeni “kompromisi” kada je riječ o objavi tako moćnog alata.
Kasno u petak, prošli tjedan, Anthropic je iznenada objavio da gasi svoj novi model Fable 5, predstavljen svega nekoliko dana ranije, nakon što je američka vlada izdala direktivu pozivajući se na zabrinutosti vezane uz nacionalnu sigurnost. Model predstavlja zaštićenu verziju Anthropicove obitelji modela Mythos, koji su nakon predstavljanja u travnju ocijenjeni toliko moćnima da su izazvali široku zabrinutost zbog mogućih prijetnji kibernetičkoj sigurnosti.
U objavi na blogu od 12. lipnja Anthropic je naveo da vjeruje kako je vlada saznala za metodu “jailbreakinga” kojom se mogu zaobići zaštitne mjere ugrađene u Fable 5. Iako se tvrtka pridržava direktive, istodobno joj se protivi.
“Ne slažemo se da bi otkrivanje uske mogućnosti za potencijalni jailbreak trebalo biti razlog za povlačenje komercijalnog modela koji koristi stotine milijuna ljudi”, navodi se u objavi. “Kada bi se ovaj standard primjenjivao na cijelu industriju, vjerujemo da bi praktički zaustavio sve nove implementacije modela svih pružatelja naprednih AI sustava.”
Samo nekoliko sati prije izdavanja direktive — Anthropic navodi da je vladino pismo primio u 17:21 po istočnoameričkom vremenu u petak — glavni direktor za komercijalne poslove Paul Smith govorio je za Forbes o kompromisima povezanim s objavom tako moćnog alata.
“Morate donijeti procjenu u takvim situacijama”, rekao je. “Najsigurnije je ne dopustiti ljudima da nešto koriste. Tada je to potpuno sigurno. Ali kako to pomaže misiji i kako pomaže ljudima da zaista izvuku stvarnu vrijednost iz inteligencije na razini Mythosa?”
Otišli predaleko
Naravno, nije govorio o direktivi koja tada još nije bila izdana. Smithovi komentari bili su odgovor na pritužbe nekih korisnika da je Anthropic otišao predaleko sa zaštitnim mjerama te da je model opteretio tolikim ograničenjima, osobito kod upita vezanih uz biologiju (koja bi mogla biti iskorištena za razvoj biološkog oružja) i kibernetičku sigurnost, da je model postao gotovo beskoristan.
“Tijekom sljedećih nekoliko dana i tjedana možemo prilagoditi i ublažiti te klasifikatore kako bismo korisnicima omogućili ugodnije i jednostavnije iskustvo, ali upravo je to bila tanka linija po kojoj smo pokušavali hodati”, nastavio je.
Smithov stav ipak pruža koristan okvir za razumijevanje najnovijeg sukoba između Anthropica i vlade. Vlada je još u veljači pokušala zabraniti korištenje Anthropicovih proizvoda u saveznoj administraciji, a u petak je zabranila korištenje Mythosa stranim državljanima. Cilj Anthropica jest plasirati svoje alate na tržište i učiniti ih što sigurnijima, ali tvrtka priznaje da određeni rizici uvijek postoje.
David Sacks, savjetnik Bijele kuće za umjetnu inteligenciju, ne dijeli to mišljenje.
“Anthropic je u prošlosti uvijek tvrdio da sigurnost mora biti apsolutni prioritet i da joj se mora pristupiti vrlo ozbiljno. U ovom slučaju Anthropic je dao prednost nastavku ponude potrošačkog modela umjesto sigurnosti”, napisao je na platformi X.
Potres u industriji
Anthropic je odbio dodatno komentirati situaciju izvan onoga što je objavio na svom blogu.
U međuvremenu, odluka o gašenju modela izazvala je potrese u cijeloj industriji. Za neke Anthropicove korisnike došla je potpuno neočekivano.
“Izgleda da ćemo morati ugasiti pristup Fableu”, napisao je kasno na platformi X Amjad Masad, izvršni direktor tvrtke Replit, koja korisnicima omogućuje pristup Anthropicovim modelima za programiranje uz pomoć umjetne inteligencije.
Prema Reutersovu izvješću koje se poziva na izvor upoznat sa situacijom, nekoliko tehnoloških direktora, uključujući izvršnog direktora Amazona Andyja Jassyja, izrazilo je zabrinutost predsjedniku Trumpu zbog sigurnosnih rizika povezanih s najnovijim Anthropicovim modelima.
U ožujku je izvršni direktor Dario Amodei vodio vrlo javni sukob s Ministarstvom rata (Department of War) oko mogućnosti Pentagona da koristi Anthropicovu umjetnu inteligenciju, osobito za masovni nadzor i autonomno naoružanje. Nakon napetih pregovora vlada je Anthropic označila kao “rizik za opskrbni lanac”, što predstavlja ozbiljan udarac za svaku tvrtku koja posluje s vojskom. Anthropic je potom tužio Ministarstvo rata, a sudac je privremeno blokirao tu oznaku.
Osim zaštitnih mjera ugrađenih u Fable, Smith se tijekom razgovora za Forbes dotaknuo i drugih tema.
Na pitanje bi li situacija s Ministarstvom rata bila složenija da je Anthropic već bio javno izlistana kompanija, Smith nije želio nagađati.
“To je pitanje za kristalnu kuglu”, rekao je. “To je bila vrlo složena situacija. Mislim da će uvijek biti vrlo složena situacija, bez obzira na to radi li se o javnoj kompaniji ili ne.”
Planiranje IPO-a
Odbio je govoriti o vremenskom okviru planirane inicijalne javne ponude dionica (IPO) nakon što je tvrtka prošlog mjeseca povjerljivo predala svoj S-1 prospekt američkoj Komisiji za vrijednosne papire i burzu (SEC).
Ipak, inzistirao je na tome da misija sigurnosti umjetne inteligencije, koju Anthropic javno zagovara, neće biti u sukobu sa statusom javne kompanije koja mora odgovarati dioničarima.
“Nema nikakve sumnje u predanost Darija i ostalih suosnivača sigurnosti, povjerenju i ostajanju fokusiranima na tu temeljnu misiju”, rekao je. “Iskreno, mislim da će glavno pitanje na konferencijskim pozivima nakon IPO-a biti kako napreduje širenje umjetne inteligencije kroz šire gospodarstvo.”
Govorio je i o Anthropicovu ugovoru sa SpaceX-om Elona Muska, koji je u petak izašao na burzu u najvećem IPO-u u povijesti, prema kojem će Anthropic svoje modele pokretati na SpaceX-ovu superračunalu Colossus.
Prema SpaceX-ovu S-1 prospektu, Anthropic će u sklopu ugovora plaćati SpaceX-u 15 milijardi dolara godišnje do 2029. godine.
“Kako je do toga došlo? Uvijek želimo diverzificirati izvore računalne snage. Ovo je jednostavno bio savršen trenutak jer je i SpaceX želio diverzificirati korisnike koji koriste tu infrastrukturu”, rekao je Smith. “Dogovor je postignut vrlo, vrlo, vrlo brzo.”
Neobični saveznik
Ipak, Anthropic i Musk djeluju kao neobičan savez. U veljači je Musk na platformi X žestoko kritizirao tvrtku, nazvavši je “zlom” i diskriminatornom.
“Iskreno, mislim da ne možete pobjeći od neizbježne ironije da Anthropic na kraju postane Misanthropic”, napisao je tada. “Bili ste osuđeni na takvu sudbinu onog trenutka kada ste odabrali to ime.”
Smith danas na te komentare odmahuje rukom.
“U pravilu reagiram samo na ono što ljudi govore kada sjede s vama u istoj prostoriji i vode stvarne razgovore, a ne na ono što se objavljuje na X-u ili drugim platformama”, rekao je. “Radije se bavim onime što je ispred mene.”
Pritom pojašnjava da nije doslovno bio u prostoriji kada je ugovor sa SpaceX-om pregovaran. Prema njegovim riječima, pregovore su vodili suosnivač Anthropica Tom Brown i financijski direktor Krishna Rao.
Richard Nieva, novinar Forbesa (link na originalni članak)