- Sarunas starp Trampa administrāciju un Anthropic ir apstājušās neatrisinātu bažu dēļ par "jailbreak" ievainojamībām Claude Fable 5 modelī.
- NSA apstiprināja, ka drošības barjeras varētu apiet, lai piekļūtu sensitīviem kiberdrošības un bioķīmiskajiem datiem, kas noved pie stingras eksporta kontroles.
- Nozares eksperti brīdina, ka valdības prasība pēc 100% pret jailbreak aizsardzību varētu būt tehniski neiespējama lielo valodu modeļu rakstura dēļ.
- Šī strupceļa situācija iezīmē būtiskas pārmaiņas ASV politikā, kur progresīvais mākslīgais intelekts tiek uzskatīts par stratēģisku valsts infrastruktūru, nevis tikai par komerciālu programmatūru.

Nesenā strupceļa situācija starp Trampa administrāciju un Anthropic ir izraisījusi satricinājumu tehnoloģiju pasaulē, jo sarunas par Claude Fable 5 modeļa izlaišanu šonedēļ nonāca strupceļā. Neskatoties uz vairākām augsta līmeņa sarunām, kurās piedalījās augstākā līmeņa vadītāji un valdības amatpersonas, stingrā eksporta kontrole, kas noteikta Anthropic vismodernākajam mākslīgajam intelektam, joprojām ir stingri spēkā. Pašreizējā situācija liecina, ka Vašingtona vairs nevēlas palikt otrajā plānā, kamēr laboratorijas steidzas pēc arvien jaudīgākām sistēmām bez necaurlaidīgām drošības garantijām.
Lietas pamatā ir tehnika, kas pazīstama kā jailbreaking (jailbreak), kurā lietotāji manipulē ar mākslīgā intelekta (AI) norādēm, lai apietu drošības protokolus. Lai gan Anthropic pastāvīgi apgalvo, ka riski tiek pārspīlēti, administrācijas bažas apstiprināja padziļināta analīze, ko veica Nacionālā drošības aģentūra. Šī drāma būtībā ir novilkusi robežu, parādot, ka Baltais nams tagad uzskata AI pierobežas modeļus par stratēģiskiem nacionāliem aktīviem, kuriem nepieciešama tāda pati pārbaude kā progresīviem ieročiem vai kodoltehnoloģijām.
NSA iejaukšanās un Claude Fable 5 lokdauns
Saspīlējums pagājušajā nedēļā saasinājās, kad Tirdzniecības ministrija izdeva direktīvu, kas faktiski pārtrauca starptautisko piekļuvi Fable 5. Šis solis nebija tikai nejaušs birokrātisks šķērslis; tas tika aktivizēts pēc tam, kad Amazon izpilddirektors Endijs Džesijs, kā ziņots, brīdināja Valsts kases sekretāru Skotu Besentu par iespējamām sistēmas ievainojamībām. Kad NSA iejaucās, lai pārbaudītu šos apgalvojumus, tā secināja, ka drošības pasākumi, kas paredzēti Claude Mythos modeļa augstākās klases kiberdrošības un bioķīmisko spēju aizsardzībai, patiešām varētu tikt apieti.
Tā kā šie modeļi ir tik cieši savstarpēji saistīti, uz patērētājiem orientētās Fable 5 spēles ielaušanās varētu potenciāli nodot karaļvalsts atslēgas ļaunprātīgiem dalībniekiem, kas vēlas izmantot Mythos pamatā esošo spēku. Anthropic centās mazināt situāciju, atspējojot modeļus globāli, apgalvojot, ka operacionāli nav iespējams ierobežot piekļuvi tikai ārvalstu vienībām. Šī pilnīgā slēgšana ir atstājusi daudzus lietotājus neziņā, taču tā uzsver, kā ASV valdības acīs nacionālā drošība tagad ir prioritāra salīdzinājumā ar komerciālo pieejamību.
Tehniska cīņas vieta: vai ir iespējams iegūt nulles risku?
Lai gan valdība vēlas pilnīgu problēmas risinājumu, daudzi zinātnieku aprindās uzskata, ka Vašingtona lūdz neiespējamo. Atšķirībā no tradicionālās programmatūras, kurā var vienkārši aizlāpīt caurumu kodā, mākslīgā intelekta atbloķēšanas metodes ir nedaudz mainīgs mērķis, jo tās balstās uz cilvēka valodas niansēm , nevis uz konkrētu tehnisku kļūdu. Eksperti ir norādījuši, ka, ja vien šie modeļi ir izstrādāti tā, lai tie būtu elastīgi un radoši, visticamāk, vienmēr būs gudrs veids, kā pierunāt tos darīt kaut ko tādu, ko nevajadzētu.
Uzņēmums “Anthropic” ir virzījis “padziļinātas aizsardzības” stratēģiju, kas koncentrējas uz uzraudzību un ātru reaģēšanu, nevis uz perfekta vairoga solīšanu. Tomēr šķiet, ka Trampa administrācija pirms modeļa atgriešanas brīvā apgrozībā vēlas augstāku pārbaudāmas drošības standartu . Šī filozofiju sadursme rada lielu berzi, jo tehnoloģiju uzņēmumi uzskata, ka tiem tiek piemērots pilnības standarts , kāds reālajā inženierijas pasaulē vienkārši nepastāv.
Šī lēmuma ietekme jau ir jūtama visā nozarē, signalizējot par jaunu "ēnu regulējuma" ēru, kurā eksporta kontrole tiek izmantota kā galvenais uzraudzības instruments. Padarot Anthropic par šo jauno noteikumu izmēģinājuma projektu , Baltais nams sūta skaidru vēstījumu citiem gigantiem, piemēram, OpenAI un Google. Ja vēlaties ieviest nākamās paaudzes robežmodeļus, jums būs jāpierāda federālajām iestādēm, ka jūsu iekšējās barjeras ir kas vairāk nekā tikai pieklājīgs ieteikums lietotājam.
Turpmāk uzmanība, visticamāk, tiks pievērsta standartizēta regulējuma izveidei šo risku mērīšanai, lai ārkārtas sanāksmju laikā lēmumi netiktu pieņemti spontāni. Pagaidām Claude Fable 5 eksporta kontrole atgādina, ka mākslīgā intelekta attīstības mežonīgo rietumu ēra tuvojas beigām. Nozare nonāk stratēģiskākā un, iespējams, ierobežotākā fāzē, kurā drošībai un inovācijām beidzot ir jāatrod veids, kā pastāvēt līdzās valstu regulatoru uzraudzībā.