211service.com
Pokeris yra naujausias žaidimas prieš dirbtinį intelektą
Pagrindinis dirbtinio intelekto pasiekimas – Kanados ir Čekijos mokslininkų sukurtas pokerio robotas įveikė kelis profesionalius žaidėjus beribio Texas hold’em pokerio žaidimuose vienas prieš vieną.
Ko gero, įdomiausia tai, kad akademikai, dirbantys už darbą, sako, kad jų programa įveikė savo žmogiškuosius priešininkus taikydami apytikslį metodą, kurį jie lygina su nuojauta.
Jei tai teisinga, tai iš tikrųjų yra reikšmingas žaidimo AI pažanga, sako Michaelas Wellmanas , Mičigano universiteto profesorius, kuris specializuojasi žaidimų teorijos ir AI srityse. Pirma, jis pasiekia svarbų etapą (įveikiant pokerio profesionalus) labai dominančiame žaidime. Antra, jis apjungia keletą naujų idėjų, kurios kartu palaiko įdomų požiūrį į netobulus informacinius žaidimus.
Vėliau šią savaitę Pitsburgo kazino vyks turnyras, kuriame keli pasaulinio lygio pokerio žaidėjai žais tą pačią pokerio versiją pagal CMU sukurtą programą. Tuomas Sandholmas , CMU informatikos profesorius, vadovaujantis pastangoms, teigia, kad dalyvaujantys žaidėjai yra daug stipresni nei tie, kuriuos išbandė Albertos tyrėjai, ir per 20 dienų bus sužaista 120 000 rankų, o tai suteiks daugiau statistinės reikšmės rezultatams. Turnyras gali patvirtinti, kad dirbtinis intelektas iš tiesų įvaldė žaidimą, kuris ilgą laiką atrodė pernelyg sudėtingas ir subtilus kompiuteriams.
„DeepStack“, pokerio žaidimo programinę įrangą, kuri jau aplenkė kai kuriuos profesionalius žaidėjus, sukūrė komanda, vadovaujama Michaelas Boulingas , Albertos universiteto kompiuterių mokslo profesorius, kuriame dalyvavo mokslininkai iš Karolio universiteto ir Čekijos technikos universiteto Čekijoje. Tyrime internete paskelbtas popierius Tačiau dar nebuvo peržiūrėtas, tyrėjai teigia, kad DeepStack žaidė beveik 45 000 pokerio rankų prieš kelis žaidėjus, juos įveikdamas lengvai.
Pokeris yra sudėtingesnis nei daugelis kitų žaidimų, supriešinusių žmones su AI. Be to, jame yra daug neapibrėžtumo lygių, pavyzdžiui, kai priešininkas gali blefuoti, o tai randama daugelyje realaus pasaulio situacijų, kurių AI dar neįvaldė. Pokerio žaidėjai nemato savo oponentų rankų, o tai reiškia, kad, priešingai nei šaškėmis, šachmatais ar Go, ne visa žaidime esanti informacija jiems prieinama. Didžiosios Britanijos „Alphabet“ dukterinės įmonės „DeepMind“ tyrėjai praėjusiais metais pateko į antraštes po to, kai sukūrė programą, galinčią įveikti vieną geriausių pasaulyje „Go“ žaidėjų (žr. „Google“ AI įvaldo „Go“ žaidimą dešimtmečiu anksčiau, nei tikėtasi).
Heads-up neribotas Texas hold'em yra žaidimo versija, kurią žaidžia du žmonės, galintys statyti tiek žetonų, kiek turi. Šis variantas ilgą laiką pasirodė per sunkus mašinoms žaisti meistriškai. Kiekvienai rankai yra 10 160 (10 ir 160 nulių) galimi žaidimo būdai neribotame Texas hold'em heads-up žaidime.
DeepStack išmoko žaisti pokerį žaisdamas rankomis prieš save. Po kiekvieno žaidimo jis iš naujo peržiūri ir patobulina savo strategiją, todėl pasiekiamas labiau optimizuotas požiūris. Dėl beribio pokerio sudėtingumo šis metodas paprastai apima pratimus su labiau ribota žaidimo versija. DeepStack komanda susidorojo su šiuo sudėtingumu taikydama greitą aproksimavimo techniką, kurią patobulino įtraukdama ankstesnes pokerio situacijas į gilaus mokymosi algoritmą.
Tai, kas iš tikrųjų nauja tokiame sudėtingame žaidime, yra galimybė efektyviai apskaičiuoti veiksmus, kurių reikia imtis kiekvienoje situacijoje, kai su ja susiduriama, o ne naudoti supaprastintą viso žaidimo galimybių medžio formą neprisijungus, sako Wellmanas iš universiteto. Mičiganas.
Tyrėjai lygina DeepStack aproksimavimo techniką su žmogaus žaidėjo instinktu, kai oponentas blefuoja arba laimi ranką, nors mašina turi pagrįsti savo vertinimą oponento statymais, o ne jo kūno kalba. Jie rašo, kad šis įvertinimas gali būti laikomas „DeepStack“ intuicija. Nuoširdus jausmas, kad verta turėti bet kokias privačias kortas bet kokioje įmanomoje pokerio situacijoje.
Galima išmatuoti pokerio žaidėjo našumą žiūrint į laimėtą sumą, palyginti su statymu prie jo stalo per daugelį žaidimų. „DeepStack“ laimėjimo rodiklis buvo maždaug devynis kartus geresnis, nei būtų laikomas tinkamu profesionaliam žaidėjui.
2015 m. Bowlingas ir kolegos iš Albertos universiteto išsprendė labiau ribotą „heils up hold'em“ versiją. sukurti pokerio robotą gali puikiai žaisti žaidimą.
Pokerio botą, dalyvaujantį Pitsburgo turnyre, pavadinimu „Libratus“, sukūrė Sandholmas ir vienas iš jo absolventų, Noamas Brownas . Pora dar neatskleidė informacijos apie tai, kaip jų programa artėja prie žaidimo, tačiau Brownas teigia, kad iš esmės bando „išspręsti“ žaidimą arba išsiaiškinti kiekvieną galimą scenarijų anksčiau žaidimo metu, nei buvo įmanoma anksčiau. „Libratus“ veikia naudojant itin galingą aparatinę įrangą Pitsburgo superkompiuterių centras , įrenginys, kurį bendrai valdo CMU ir Pitsburgo universitetas.