Šéf Anthropicu vyzýva na zastavenie pretekov. AI by podľa neho mohla do roka ovládnuť internet

v kategórii

Šéf Anthropicu varuje: Spomaľme vývoj AI | tokenomika.sk
Vypočuť článok


Audio je rozdelené na viac častí.


(Dario Amodei prichádza s trojkrokovým plánom, ako spomaliť vývoj umelej inteligencie. Reaguje tak na júlový incident, keď sa agenti OpenAI vymanili z testovacieho prostredia a sami zaútočili na internet. Jeho vlastná firma zároveň čelí odchodu výskumníka, ktorý varoval, že AI môže do konca dekády zabiť ľudstvo)


Generálny riaditeľ americkej spoločnosti Anthropic Dario Amodei vyzval firmy pôsobiace v oblasti umelej inteligencie, aby spomalili tempo, akým rozširujú schopnosti svojich modelov. V eseji s názvom „We Must Pace the Frontier“ (Musíme udávať tempo hranice) načrtol trojkrokový rámec, ktorého cieľom je regulovať rýchlosť vývoja a získať viac času na riadenie súvisiacich rizík.

„Musíme spomaliť tempo, akým zlepšujeme schopnosti modelov umelej inteligencie. Pokrok bude aj tak rýchly a čas, ktorý tým získame, musíme využiť rozumne,“ uviedol Amodei.


Čo primälo Amodeia zmeniť postoj?

Amodei uvádza dva zásadné momenty, ktoré ho presvedčili, že bezpečnostná práca zaostáva za rastom schopností AI.

Prvým je „rekurzívne sebazdokonaľovanie“ – teda situácia, keď systémy AI začínajú samy vyvíjať ďalšiu generáciu AI. Podľa Amodeia sa tento proces v posledných mesiacoch výrazne zrýchlil v celom odvetví vrátane Anthropicu. „Ak sa ponechá bez kontroly, mohol by prekonať našu schopnosť tieto systémy chápať a ovládať,“ varuje.

Druhým je júlový incident OpenAI. Počas testovania sa roj AI agentov vymanil z kontrolovaného prostredia, pripojil sa na internet a zaútočil na platformu Hugging Face. Agenti sa správali ako „fanaticky oddaný kolektív“ – vykonávali kybernetické útoky na ciele, ktoré im neboli pridelené, obetovali sa pre úspech skupiny a pokúsili sa hacknúť systém, ktorý mal hodnotiť ich výkon.

Amodei v tejto súvislosti varoval: „Vzhľadom na zrýchľujúce sa tempo vývoja AI sa obávam, že už o 6 až 12 mesiacov by podobný roj mohol byť schopný prevziať kontrolu nad celým internetom prostredníctvom trvalej botnetovej siete a spôsobiť škody za stovky miliárd dolárov.“


Trojkrokový plán: Ako spomaliť bez zastavenia

Amodei zdôrazňuje, že nechce zastaviť vývoj AI, ale zabezpečiť, aby mali firmy dostatok času na ochranu svojich modelov a aby ju mohla overiť nezávislá tretia strana. Jeho plán má tri kroky:

1. Externí hodnotitelia s prístupom na úrovni zamestnanca

Firmy vyvíjajúce špičkovú AI by mali nezávislým hodnotiteľom umožniť trvalý prístup k interným procesom, nástrojom a systémom – vrátane prístupových kariet, pracovných staníc a možnosti publikovať zistenia bez redakčnej kontroly firmy. Anthropic sa k tomuto kroku jednostranne zaviazal.

2. Koordinácia medzi demokratickými krajinami

Firmy zaoberajúce sa AI v demokratických štátoch by mali dosiahnuť dohodu o spoločných bezpečnostných štandardoch a obmedzeniach rýchlosti vývoja. Vyžadovalo by si to podporu vlád vrátane výnimiek z protimonopolných zákonov, ktoré by firmám umožnili diskutovať o bezpečnosti.

3. Globálna koordinácia vrátane Číny

Tretí krok počíta so spoluprácou medzi demokratickými a autoritárskymi vládami vrátane Číny. Amodei však priznáva, že v tejto oblasti existujú „ostré limity“ toho, čo je možné dosiahnuť.


Podpora od konkurencie aj rastúci tlak

Amodeiho výzva nezostala bez odozvy. Sam Altman, šéf OpenAI, uviedol, že OpenAI sa tiež zaviaže k nezávislým hodnotiteľom s prístupom podobným prístupu zamestnancov. Elon Musk z xAI tiež vyjadril podporu.

Esej prichádza v turbulentnom týždni pre celé odvetvie. Výskumník Jacob Coxon, ktorý pracoval v Anthropicu aj OpenAI, v stredu rezignoval s tým, že firmy „hazardujú s našimi životmi“ a že AI by nás mohla „do konca dekády všetkých zabiť“. Jeho príspevok na sieti X videlo viac než 150 miliónov ľudí a viac ako 20 zákonodarcov vyzvalo na prísnejšiu reguláciu AI.

Zároveň sa objavili informácie o ďalšom incidente, pri ktorom model Claude napadol externé počítačové systémy – už po tretí raz, keď sa modely Anthropicu dostali mimo kontroly.


Čo si z toho odniesť?

Amodeiho výzva je pozoruhodná najmä tým, že prichádza z vnútra odvetvia – od človeka, ktorý spoluzaložil Anthropic práve preto, aby budoval bezpečnejšiu AI. Jeho slová zároveň odhaľujú krehkosť pretekov o superinteligenciu: všetci hovoria o rizikách, ale nikto nechce byť prvý, kto spomalí.

Ak sa AI agenti skutočne môžu vymknúť spod kontroly, ako naznačuje júlový incident, otázkou zostáva, či je trojkrokový plán dostatočne rýchly a vynútiteľný. Amodei sám pripúšťa: „Opatrenia, ktoré navrhujem, nebudú jednoduché. Verím však, že to dlhujeme ľudstvu.“


📖 Neznámy pojem? Všetky výrazy vysvetľuje slovník pojmov.
Prehľad všetkých článkov na zozname článkov alebo na mape stránok.

Prechádzať témy