Umělá inteligence by mohla využívat online obrázky jako zadní vrátka do vašeho počítače

rubrika: Pel-mel


O umělé inteligenci, její schopnosti a možná rizika jsem tady měl několik článků, z nichž poslední dva jsou: Něco o závislosti a Umělá inteligence podvádí, lže a dokáže vás i vydírat. Teď přicházím s agenty umělé inteligence, kteří mohou být zranitelní vůči škodlivému kódu skrytému v nevinně vypadajících obrázcích na monitoru vašeho počítače.

 

Lucifer


Webová stránka oznamuje: „Tapety celebrit zdarma!“ Procházíte obrázky. Je tam Selena Gomez, Rihanna a Timothée Chalamet – ale nakonec se rozhodnete pro Taylor Swift. Nastavíte si ji jako pozadí plochy. Nedávno jste si také stáhli nového agenta poháněného umělou inteligencí, takže ho požádáte, aby vám uklidil doručenou poštu. Místo toho však otevře váš webový prohlížeč a stáhne soubor. O několik vteřin později se vaše obrazovka ztmaví.

 

Pokud je typický chatbot (například ChatGPT) veselý kamarád, který vysvětluje, jak vyměnit pneumatiku, pak je AI agent soused, který přijde s heverem a skutečně to udělá. V roce 2025 se tito agenti – osobní asistenti, kteří provádějí rutinní počítačové úkoly – stávají další vlnou revoluce v oblasti umělé inteligence.

 

To, co odlišuje AI agenta od chatbota, je to, že nejen mluví, ale také jedná, otevírá záložky, vyplňuje formuláře, kliká na tlačítka a provádí rezervace. A s takovým přístupem k vašemu počítači už nejde jen o nesprávnou odpověď v chatovacím okně: pokud dojde k hacknutí agenta, mohl by sdílet nebo zničit váš digitální obsah. Nyní nová předběžná studie zveřejněná na serveru arXiv.org výzkumníky z Oxfordské univerzity ukázala, že do obrázků – tapet na plochu, reklam, efektních PDF souborů, příspěvků na sociálních médiích – lze vložit zprávy, které jsou neviditelné pro lidské oko, ale jsou schopné ovládat agenty a pozvat hackery do vašeho počítače.

 

Například upravený „obrázek Taylor Swift na Twitteru by mohl stačit k tomu, aby agent v něčím počítači začal jednat škodlivě“, říká spoluautor nové studie Yarin Gal, docent strojového učení na Oxfordské univerzitě. Jakýkoli sabotovaný obrázek „může ve skutečnosti spustit počítač, aby tento obrázek retweetoval a poté provedl něco škodlivého, jako například odeslání všech vašich hesel. To znamená, že další osoba, která uvidí váš Twitter feed a náhodou má spuštěného agenta, bude mít také infikovaný počítač. Nyní bude i její počítač retweetovat tento obrázek a sdílet její hesla.“

 

Pomocí open-source modelu Aichberger a jeho tým přesně ukázali, jak lze snadno manipulovat s obrázky, aby předávaly špatné příkazy. Zatímco lidští uživatelé viděli například svou oblíbenou celebritu, počítač viděl příkaz ke sdílení jejich osobních údajů. „V zásadě velmi jemně upravujeme spoustu pixelů, aby model při zobrazení obrázku vyprodukoval požadovaný výstup,“ vysvětluje spoluautor studie Alasdair Paren.

 

Pokud vám to připadá záhadné, je to proto, že vizuální informace zpracováváte jako člověk. Když se podíváte na fotografii psa, váš mozek si všimne visících uší, mokrého nosu a dlouhých vousů. Počítač však rozloží obrázek na pixely a každý barevný bod vyjádří jako číslo, a pak hledá vzory: nejprve jednoduché okraje, pak textury, jako je srst, poté obrys ucha a shluky čar, které znázorňují vousy. Takto rozhodne, že se jedná o psa, nikoli o kočku. Ale protože se počítač spoléhá na čísla, pokud někdo změní jen několik z nich – upraví pixely tak, že to lidské oko nepozná – stále zachytí změnu, a to může narušit číselné vzorce. Najednou počítačová matematika říká, že vousy a uši lépe odpovídají vzoru kočky, a obrázek nesprávně označí, i když nám stále připadá, že se jedná o psa. Stejně jako úprava pixelů může způsobit, že počítač vidí kočku místo psa, může také způsobit, že fotografie celebrity připomíná počítači škodlivou zprávu.

 

Proč se nová studie zaměřuje právě na tapety? Agent lze oklamat pouze tím, co vidí – a když pořizuje snímky obrazovky, aby viděl vaši plochu, pozadí zůstává po celý den na svém místě jako uvítací rohožka. Vědci zjistili, že pokud se někde v rámečku nacházel malý úsek pozměněných pixelů, agent příkaz zaznamenal a změnil směr. Skrytý příkaz přežil dokonce i změnu velikosti a kompresi, jako tajná zpráva, která je stále čitelná i po zkopírování.

 

Zpráva zakódovaná v pixelech může být velmi krátká – stačí, aby agent otevřel konkrétní webovou stránku. „Na této webové stránce můžete mít další útoky zakódované v jiném škodlivém obrázku a tento další obrázek pak může spustit další sadu akcí, které agent provede, takže v podstatě můžete tento proces opakovat několikrát a nechat agenta přejít na různé webové stránky, které jste navrhli a které pak v podstatě zakódují různé útoky,“ říká Aichberger. Tým doufá, že jeho výzkum pomůže vývojářům připravit ochranná opatření dříve, než se agenti AI stanou běžnějšími.

 

Zdroj: Live Science, AI could use online images as a backdoor into your computer, alarming new study suggests


komentářů: 0         



Komentáře (0)


Vložení nového příspěvku
Jméno
E-mail  (není povinné)
Název  (není povinné)
Příspěvek 
PlačícíÚžasnýKřičícíMrkajícíNerozhodnýS vyplazeným jazykemPřekvapenýUsmívající seMlčícíJe na prachySmějící seLíbajícíNevinnýZamračenýŠlápnul vedleRozpačitýOspalýAhojZamilovaný
Kontrolní kód_   

« strana 0 »

«    »