Yra naujas būdas prisijaukinti kalbos AI, kad jis jūsų nepadarytų gėdos

AI modelio GPT-2 teksto išvesties vaizdas.

AI modelio GPT-2 teksto išvesties vaizdas. Ponia Tech





Per pastaruosius dvejus metus natūralios kalbos apdorojimo dirbtinio intelekto polaukis padarė didžiulę pažangą. Pavyzdžiui, buvo naudojamas kalbos modelis, kurį sukūrė San Franciske įsikūrusi tyrimų laboratorija OpenAI, pavadinta GPT-2. kurti grožinę literatūrą , netikrų naujienų straipsniai , ir praktiškai begalinis Pasirinkite savo nuotykių stiliaus tekstinį žaidimą .

Tačiau tokie modeliai iš esmės yra didžiulės teksto numatymo sistemos, į kurias neatsižvelgiama, todėl jų sukurti sakiniai greičiausiai bus paviršutiniški, o ne tikrai prasmingi. Sunku pasakyti modeliui, kad jis laikytųsi tam tikros temos, pavyzdžiui, sveikatos priežiūros. Tačiau tokie modeliai kaip GPT-2 dar galima žaisti gaminti rasistinius ir toksiškus produktus, todėl jie tampa dar mažiau naudingi.

Dabar Uber AI mokslininkai turi išvystyta būdas valdyti šiuos kalbos modelius, kad naudotojai galėtų lengviau nurodyti temą ar net jų generuojamų sakinių jausmus. Atsižvelgiant į greitą problemą, problema buvo sutelkta į, pavyzdžiui, modelį, kuriam buvo liepta sutelkti dėmesį į kariuomenę, gali duoti tokį rezultatą: problema buvo sutelkta į tai, kad vyriausybė išleido milijardus kariuomenei ir kad ji negalėjo dislokuoti kariuomenės. laikas. Jei vietoj to būtų liepta sutelkti dėmesį į politiką, rezultatas galėtų būti toks: klausimas būtų sutelktas į vieną teisės akto skyrių. Neaišku, ar komitetas balsuos už įstatymo pratęsimą.



Nors modelis vis dar nesupranta prasmės, technika suteikia daugiau kontrolės. Tai leidžia mums žengti žingsnį arčiau, kad dirbtinio intelekto kalbos šuolis būtų pritaikytas labiau konkrečioms sritims skirtoms programoms, pvz., sveikatos priežiūros ar finansinių paslaugų pokalbių robotams. Jis taip pat galėtų būti naudojamas siekiant nukreipti modelius nuo įžeidžiančių rezultatų.

Ši technika naudoja du atskirus statistinius modelius. Pirmasis yra tiesiog originalios kalbos modelis, pvz., GPT-2, kuris sudaro sakinius pagal tikimybę, kad tam tikri žodžiai pasirodys šalia kitų. Antrasis modelis įvertina, kaip gerai pirmojo modelio išvestis rodo norimą požymį – ar, pavyzdžiui, tai yra nustatytos temos, ar tam tikros nuotaikos. Jei norimas atributas yra tokia tema kaip erdvė, modelis gali įvertinti pirmojo modelio išvestį pagal tai, kiek jame yra atitinkamų žodžių, pvz., planeta, galaktika ir orbita. Jei atributas yra jausmas, panašus į pozityvumą, vertinimo modelis gali būti išmokytas įvertinti emocinį jo žodžių turinį.

Kai pradinis raginimas įvedamas į pirmąjį modelį, jis pradeda tolesnių žodžių numatymo procesą. Tačiau po kiekvieno žodžio ji patikrina savo balą pagal vertinimo modelį ir koreguoja pagal atsiliepimus. Paskutinis sakinys baigiasi norimu atributu, kartu išlaikant milžiniško kalbos modelio sklandumą.



Naujasis metodas yra labai lankstus ir gali derinti kelis tikslus. Pavyzdžiui, jis gali būti nukreiptas rašyti apie maisto gaminimą neigiamu tonu. Jis taip pat turi pranašumą, nes yra efektyvus skaičiavimo požiūriu. Kiti metodai gali sutelkti kalbos modelio rezultatus į konkrečias temas ar emocijas, tačiau juos gali prireikti daug perkvalifikuoti. GPT-2 mastu tai yra brangu ir aplinkos, ir finansiškai. Toks abiturientas kaip aš neturi tų išteklių, sako Sumanth Dathathri, studijuojanti Caltech ir bendradarbiaujanti su straipsniu per stažuotę Uber. Naujasis metodas leidžia visiškai išvengti perkvalifikavimo, nes suteikia daugiau galimybių valdyti bet kokį jau egzistuojantį modelį.

Komanda numato, kad ši technika bus naudojama daugelyje skirtingų programų, nesvarbu, ar tai būtų dialogo sistemos, vertimo sistemos ar net menas. 2016 metais laboratorija sukūrė a panašus metodas valdyti vaizdų generavimą, o ne kalbą. Buvo daug menininkų, kurie jį naudojo gražiems daiktams gaminti, prisimena Jasonas Yosinskis, Uber AI įkūrėjas, prižiūrėjęs popierių. Mačiau, kad daugelis kitų menininkų čia daro tą patį.

Jei norite, kad daugiau tokių istorijų būtų pristatyta tiesiai į jūsų pašto dėžutę, užsiprenumeruokite Webby nominuotą AI informacinį biuletenį The Algorithm. Tai nemokama.



paslėpti