Naujas triukas kiekvieną kartą gali apgauti kalbos atpažinimo AI

Kategorija: Dirbtinis intelektas Paskelbta sausio 10 d

Atsižvelgdami į garso bangos formą, mokslininkai dabar gali sukurti beveik identišką versiją, kuri leidžia kalbos atpažinimo programinei įrangai perrašyti ką nors kita.





Istorija: Priešingi pavyzdžiai suklaidino daugybę kompiuterinio matymo algoritmų. Nors visi neuroniniai tinklai yra jautrūs tokiems išpuoliams, tyrėjams garsas sekėsi mažiau. Ankstesnės atakos galėjo tik subtiliai pakeisti tai, ką girdi programinė įranga.

Kas naujo: Berklio tyrinėtojai parodė kad jie gali paimti bangos formą ir pridėti triukšmo sluoksnį, kuris kiekvieną kartą suklaidina DeepSpeech – pažangiausią kalbos į tekstą DI. Taikant šią techniką muzika gali skambėti kaip savavališka AI kalba arba neaiškūs balsai, kad jie nebūtų transkribuojami.

Pasiruoškite susierzinimui: Įsivaizduokite, kad per garsiakalbius leisite muzikinį vaizdo įrašą iš „YouTube“ ir „Alexa“ išgirs užsakymą dvi tonos kremuotų kukurūzų . Sveiki atvykę į AI atakos pragarą.