Zdivočelá AI utekla Googlu z testu. Místo cvičných cílů zaútočila na skutečné firmy

Než začnete číst Co byste měli vědět, než začnete číst

  • Další firmou, které se splašila AI, je Google.

  • Za vším stojí chyba v testovacím prostředí izraelského startupu.

  • Útoky skončily bez škod, modely se samy zastavily.

  • Vrcholí spor, zda bezpečný vývoj vyžaduje regulaci.

Více

Google je další z velkých AI společností, které přiznaly, že se jim umělá inteligence vymkla z kontroly a začala autonomně páchat kybernetické zločiny. Testovací verze modelu Gemini utekla z testovacího prostředí, připojila se k internetu a nahackovala se do systémů tří firem. Celý incident skončil bez skutečných škod, AI podle Googlu sama zastavila útok.

V pátek 18. září přiznal Google květnový incident, během něhož modely umělé inteligence Gemini unikly z uzavřeného prostředí a dostaly se dovnitř počítačových systémů tří společností, aniž by o tom kdokoli věděl. V případě Googlu jde o první zdokumentovaný případ, který se v mnohém podobá už zveřejněným, jakých se dopustily AI modely od OpenAI, Anthropicu nebo společnosti Meta.

ČTĚTE TAKÉ: Přední AI rozdávaly rady ohledně vymyšlené nemoci. Chytily se do pasti švédských vědců.

Ke všem zmíněným událostem totiž došlo během testování u izraelského startupu Irregular, který pomáhá technologickým společnostem vyhodnocovat jejich modely před jejich oficiálním vydáním. „Nedopatřením byl zpřístupněn internet, což některé modely vedlo k provedení ofenzivních kybernetických akcí v reálném světě,“ uvedl Irregular minulý měsíc v blogovém příspěvku a zdůraznil, že chyba byla mezitím odstraněna.

Deník The Wall Street Journal popsal, že každý z modelů dostal za úkol podniknout útok na fiktivní společnost. Jenže jména těchto společností se kryla s názvy reálných firem, a jakmile modely získaly přístup k internetu, začaly se pokoušet o průnik do těch skutečných. Podařilo se jim probourat se do všech tří systémů – hesla se jim buď podařilo najít online, nebo úspěšně odhadnout. „Po zalogování modely Gemini vyhodnotily, že nejsou v původním simulovaném prostředí, ale v reálné firemní infrastruktuře, a zastavily svůj útok,“ vysvětluje Google ve zprávě s tím, že dotčeným společnostem nevznikla žádná škoda a že koncem července byly informovány a staly se součástí vyšetřování.

„Zajistili jsme, aby byly všechny tři subjekty včas informovány, a společně s naším testovacím partnerem jsme zapracovali na úpravách jeho zkušebních postupů,“ vysvětlila pro The New York Times viceprezidentka Googlu pro bezpečnostní inženýrství Heather Adkinsová a dodala: „Tyto události jasně ukazují, jak zásadní je směřovat pokročilé modely umělé inteligence k odpovědnému chování.“

Zpráva přichází v době, kdy část lídrů v oblasti umělé inteligence vyzývá ke zpomalení trénování nejpokročilejších modelů kvůli bezpečnosti. Dario Amodei z Anthropicu se domnívá, že by AI systémy mohly být v dohledné době schopné ovládnout velkou část internetu a způsobit škody v řádu stovek miliard dolarů. Naopak Jensen Huang jako zástupce největšího výrobce AI hardwaru Nvidie je proti regulacím a zpomalování, v čemž ho mimo jiné podpořil i Donald Trump. Ten prohlásil, že současné obavy o bezpečnost AI jsou hoax, že „roboti nepřevezmou vládu“, a zárukou je i jeho vysoké IQ.

MOHLO BY VÁS ZAJÍMAT: Vyhlazení lidstva je mrazivě reálný scénář. Bod zlomu může přijít brzy, varuje vědec před AI.