Newsletter Subscribe
Enter your email address below and subscribe to our newsletter

Komentár k filmu, názov kaviarne, mesto, koníček alebo povolanie: Samy o sebe takéto informácie prezradia len málo. Nová štúdia však ukazuje, že umelá inteligencia z nich dokáže zostaviť prekvapivo presný digitálny odtlačok prsta.
Výskumníci dokázali pomocou rozsiahlych jazykových modelov prepojiť viac ako polovicu z 987 pseudonymných používateľov Hacker-News s ich skutočnou identitou . Zjavné indície, ako sú osobné webové stránky, názvy sociálnych médií a prezývky na GitHub, boli vopred odstránené.
Cena experimentu: iba 2 000 dolárov alebo jeden až štyri doláre za profil .
Výskumníci zanechali zdanlivo neškodné informácie: mená kolegov, inštitúcií a miestnych podnikov, miesta bydliska, záujmy, demografické informácie a technické zručnosti.
Umelá inteligencia tieto informácie skombinovala a vyhľadala vhodné profily medzi 89 000 používateľmi . Výsledok: S presnosťou 90 percent bolo identifikovaných 55,2 percenta vyhľadaných profilov. S presnosťou 99 percent stále identifikovala 45,1 percenta.
Staršia metóda štatistickej deanonymizácie dosiahla s rovnakými údajmi iba 0,1 percenta.
Zásadný rozdiel: To, čo si predtým vyžadovalo časovo náročnú detektívnu prácu, sa teraz dá automatizovať pomocou umelej inteligencie a vykonávať za extrémne nízke náklady.
Ďalší experiment s používateľmi Redditu ukázal, že aj zdanlivo triviálne informácie o filmových preferenciách môžu prispieť k identifikácii. Čím viac niekto publikuje, tým jedinečnejší sa stáva jeho digitálny profil.
Výskumníci zhrnuli princíp jednoducho: mesto, povolanie, účast na konferencii alebo špecializovaný koníček zužujú okruh možných jednotlivcov. Kombinácia sa môže stať jedinečným odtlačkom prsta.
Dokonca aj veľkosť platformy ponúka len obmedzenú ochranu. Výskumníci odhadujú, že ich metóda by stále mohla nájsť približne 45 percent hľadaných jednotlivcov v skupine jedného milióna ľudí a približne 27 percent v teoretickej skupine 100 miliónov kandidátov.
Dôsledky sú značné. Vlády by mohli takéto metódy použiť na prepojenie pseudonymných účtov novinárov, disidentov alebo aktivistov so skutočnými ľuďmi. Spoločnosti a sprostredkovatelia údajov by mohli prepojiť profily na rôznych platformách.
Na to nikto nemusí hackovať databázy: Štúdia použila výlučne verejne dostupné informácie, ktoré sami používatelia zverejnili.
Dokonca aj bezpečnostné filtre systémov umelej inteligencie môžu ponúkať len malú ochranu. Útok sa dá rozdeliť na zdanlivo neškodné úlohy – sumarizovanie profilov, porovnávanie dokumentov, hodnotenie kandidátov. Okrem toho je možné pomocou modelov s otvoreným zdrojovým kódom odstrániť ochranné mechanizmy.
Tento vývoj sa stáva obzvlášť explozívnym v súvislosti s digitálnymi identitami a overovaním veku online. Často sa sľubuje, že používatelia môžu preukázať svoju identitu raz a potom zostať pseudonymní.
Ak však umelá inteligencia už dokáže identifikovať osobu na základe jej publikovaného obsahu, tento rozdiel sa stáva čoraz krehkejším. Štúdia nedokazuje, že digitálne identifikátory automaticky odhaľujú anonymné profily. Ukazuje však, ako ľahko sa teraz dajú rozptýlené online stopy spojiť a vytvoriť tak identitu v reálnom svete.
Nebezpečenstvo teda nespočíva vo veľkom rozsahu krádeže údajov, ale v tisíckach malých detailov, ktoré ľudia v priebehu rokov dobrovoľne zverejnili. Predtým boli tieto stopy roztrúsené po internete. Dnes ich umelá inteligencia dokáže poskladať za pár dolárov – až kým sa za pseudonymom neobjaví skutočné meno.
Subscribe to get the latest posts sent to your email.
Nemôžete kopírovať obsah tejto stránky