Kaip šlamštas tobulina AI

Tie įkyrūs vaizdiniai galvosūkiai, kuriuos reikia užpildyti kiekvieną kartą, kai prisiregistruojate gauti žiniatinklio pašto paskyrą arba paskelbiate komentarą tinklaraštyje, yra atakuojami. Vis dėlto tai ne tik nuo nepageidaujamą elektroninį paštą spjaudančių kompiuterių ar įsilaužėlių; tai taip pat yra mokslininkų, kurie naudoja anti-spam galvosūkius, kad sukurtų protingesnius, labiau žmogiškus algoritmus.





Katės prieš šunis: Projektas, vadinamas Asirra, naudoja kačių ir šunų nuotraukas, kad atskirtų žmones nuo kompiuterių. Paprastai tai sudėtinga užduotis kompiuteriams, tačiau naujas algoritmas gali teisingai klasifikuoti vaizdus 83 procentus laiko.

Labiausiai paplitęs galvosūkis (iškraipytų raidžių ir skaičių serija) vis dažniau nulaužiamas naudojant išmanesnę AI programinę įrangą. Ir dabar kompiuterių mokslininkas sukūrė algoritmą, kuris gali nugalėti net naujausius nuotraukomis pagrįstus bandymus.

Šie galvosūkiai, žinomi kaip CAPTCHA (visiškai automatizuotas viešasis Turingo testas, skirtas atskirti kompiuterius ir žmones), buvo sukurti 90-ųjų pabaigoje, siekiant atskirti tikrus vartotojus nuo mašinų, kurios kuria el. pašto paskyras, kad išsiųstų šlamštą arba prisijungtų prie pranešimų. lentos skelbimų nuorodoms skelbti. The Turingo testas , pavadintas matematiko Alano Turingo vardu, apima intelekto matavimą, kai kompiuteris bando apsimesti tikru asmeniu.



Tekstinės CAPTCHA yra geras būdas atskirti žmones ir šiukšlių robotus, nes iškraipytas raides ir skaičius gali lengvai perskaityti tikri žmonės (dažniausiai), tačiau kompiuteriams jas velniškai sunku iššifruoti. Tačiau kompiuterių mokslininkai jau seniai laikė CAPTCHA įdomiu AI iššūkiu. Tekstinių CAPTCHA kūrėjai palaipsniui įvedė daugiau iškraipymų, kad mašinos negalėtų jų išspręsti. Tačiau jie turi suderinti saugumą ir patogumą naudoti: didėjant iškraipymui, net tikriems žmonėms CAPTCHA yra sunku iššifruoti.

Anksčiau šiais metais, Džefas Janas Niukaslio universiteto (JK) mokslininkas atskleidė programą, galinčią užbaigti tekstinius CAPTCHA, naudojamus Microsoft Hotmail, MSN ir Windows Live paslaugoms apsaugoti, su 60 procentų sėkmės rodikliu. Tai gali atrodyti mažai, bet tai svarbu, nes kompiuteris kiekvieną minutę gali išbandyti ataką tūkstančius kartų. Yanas sulaikė popierių, kol „Microsoft“ turėjo galimybę pakoreguoti savo CAPTCHA, kad juos būtų sunkiau nulaužti. Tačiau pas ACM kompiuterių ir ryšių saugumo konferencija Aleksandrijoje, VA, vėliau šį mėnesį Yanas pateiks informaciją apie kitą programą, kuri, jo teigimu, gali nulaužti dar plačiau naudojamus tekstinius CAPTCHA.

Taigi alternatyva yra paprašyti vartotojų išspręsti įvairių rūšių galvosūkius. Tačiau kitame pranešime, kuris bus pristatytas toje pačioje konferencijoje, aprašomas algoritmas, kuris gali sukelti problemų dar naujesniems CAPTCHA.



Philippe'as Golle'is iš Palo Alto tyrimų centro sukūrė programą, kuri gali tinkamai perduoti vaizdais pagrįstą CAPTCHA, vadinamą Asirra, kurią sukūrė „Microsoft“. „Asirra“ prašo vartotojų teisingai klasifikuoti kačių arba šunų vaizdus, ​​naudojant gyvūnų gelbėjimo organizacijų pateiktą trijų milijonų vaizdų duomenų bazę. Ši užduotis kompiuteriams turėtų būti dar sunkesnė nei atpažinti vingiuotas raides, tačiau Golle programa gali teisingai identifikuoti Asirros rodomas kates ar šunis 83 procentus laiko.

Golle apmokė savo programą naudodamas 8000 vaizdų, surinktų iš tos pačios svetainės. Per bandymus ir klaidas jo programinė įranga palaipsniui išmoko atskirti kates ir šunis, remdamasi statistine kiekvienos nuotraukos spalvos ir tekstūros analize. Rožinė šunų liežuvio spalva ir žalia kačių akių spalva suteikė tvirtų užuominų, sako Golle, tačiau tik ištyrus spalvų ir tekstūros informaciją iš daugybės vaizdų, jo programa gali išspręsti problemą. Mašinų mokymasis labai gerai padeda kaupti informaciją, sako Golle.

Tačiau nors kiekviena atskira nuotrauka buvo atpažįstama 83 procentus laiko, pilnam CAPTCHA testui vienu metu reikia identifikuoti 12 nuotraukų, todėl ataka iš tikrųjų veikia tik 10,3 procento laiko.



Golle sako, kad Asirrai būtų paprasta atsakomoji priemonė pateikti daugiau nuotraukų, o tai dar labiau sumažintų atakos sėkmės rodiklį. „Microsoft“ neatsakė į mūsų prašymus komentuoti.

Nepaisant visos šios pažangos, neaišku, ar tikri šiukšlių siuntėjai šiuo metu naudoja AI atakas prieš tikrus CAPTCHA. „Websense Security Labs“ San Diege išleido ataskaitas apie nepageidaujamų el. pašto siuntėjus, nulaužančius CAPTCHA, tačiau dažnai tai reiškia, kad mažai apmokamų darbuotojų reikia tiesiog rankiniu būdu išspręsti CAPTCHA.

Luisas von Ahnas, kompiuterių mokslininkas iš Carnegie Mellon universiteto, padėjęs sukurti terminą CAPTCHA, sako, kad nėra aišku, kad realiame pasaulyje mašinos atakos sulaužė įprastus CAPTCHA. Nežinau nė vieno, kuris galvoja atsikratyti CAPTCHA, nes jis neveikia, sako jis.



Tačiau von Ahn pažymi, kad žmonių naudojimas kainuoja. Net jei darbuotojams mokama tik 3 USD už 1000 CAPTCHA, tai yra brangu, sako jis, ypač todėl, kad dauguma įsilaužtų žiniatinklio pašto paskyrų netrukus bus uždarytos po to, kai pradės siųsti šlamštą. Taigi tikrai automatizuota ataka sumažintų šiukšlių siuntėjų išlaidas ir labai padidintų sėkmingų atakų, kurias jie galėtų sau leisti, skaičių, sako jis.

Tačiau kol kompiuteriai taps daug išmanesni, CAPTCHA kūrėjai visada galės atlikti keletą paprastų patobulinimų, kad CAPTCHA būtų daug sunkesnis. Manau, kad ateis diena, kai iš esmės CAPTCHA bus nenaudingos, sako von Ahn. Bet nemanau, kad tai šiais ar kitais metais.

paslėpti