211service.com
„DeepMind“ AI dabar nukonkuravo beveik visus „StarCraft II“ žaidėjus
AlphaStar (Zerg, raudona) ginanti ankstyvą agresiją, kai priešininkas pastatė dalį bazės netoli AlphaStar bazės. „DeepMind“ sutikimu
Šių metų sausį „DeepMind“ paskelbė, kad pasiekė etapą siekdama dirbtinio bendro intelekto. Jis sukūrė AI sistemą, pavadintą AlphaStar, kuri įveikė du profesionalius žaidėjus StarCraft II – populiariame vaizdo žaidime apie galaktinį karą. Tai buvo nemažas žygdarbis. „StarCaft II“ yra labai sudėtingas – kiekvienam judesiui yra 1026 pasirinkimai. Tai taip pat netobulos informacijos žaidimas – nėra aiškių strategijų, kaip laimėti. Šis pasiekimas pažymėjo naują mašinų intelekto lygį.
Dabar „DeepMind“, „Alphabet“ dukterinė įmonė, išleidžia atnaujinimą. „AlphaStar“ dabar lenkia didžiąją daugumą aktyvių „StarCraft“ žaidėjų, demonstruodama daug tvirtesnį ir pakartojamesnį gebėjimą kurti strategiją skrydžio metu nei anksčiau. Rezultatai, paskelbtas žurnale Nature šiandien gali turėti svarbių pasekmių programoms, pradedant mašininiu vertimu ir baigiant skaitmeniniais asistentais ar net kariniu planavimu.
StarCraft II yra realaus laiko strateginis žaidimas, dažniausiai žaidžiamas vienas prieš vieną. Žaidėjas turi pasirinkti vieną iš trijų žmonių arba ateivių rasių – Protoss, Terran arba Zerg – ir pakaitomis rinkti išteklius, kurti infrastruktūrą ir ginklus bei pulti priešininką, kad laimėtų žaidimą. Kiekvienos lenktynės turi unikalių įgūdžių rinkinių ir apribojimų, kurie turi įtakos laimėjimo strategijai, todėl žaidėjai dažniausiai pasirenka ir įvaldo žaisti su jais.
AlphaStar naudojo pastiprinimo mokymąsi , kai algoritmas mokosi per bandymus ir klaidas, kad išmoktų žaisti su visomis lenktynėmis. Tai tikrai svarbu, nes tai reiškia, kad tokio paties tipo metodai iš esmės gali būti taikomi ir kitose srityse, sakė Davidas Silveris, pagrindinis DeepMind mokslininkas. AI taip pat pasiekė reitingą, viršijantį 99,8% aktyvių žaidėjų oficialioje internetinėje lygoje.

AlphaStar, žaidžiantis kaip Protossas (žalia spalva), atremdamas Zerg žaidėjo ataką. „DeepMind“ sutikimu
Siekdama tokio lankstumo, „DeepMind“ komanda pakeitė dažniausiai naudojamą techniką, žinomą kaip savarankiškas žaidimas, kai sustiprinimo mokymosi algoritmas žaidžia prieš save, kad greičiau mokytųsi. „DeepMind“ puikiai panaudojo šią techniką treniruodamas „AlphaGo Zero“ – programą, kuri be jokio žmogaus indėlio išmoko įveikti geriausius žaidėjus senoviniame „Go“ žaidime. Laboratorija taip pat naudojo jį preliminarioje „AlphaStar“ versijoje.
Paprastai žaidžiant savarankiškai, abi algoritmo versijos yra užprogramuotos taip, kad padidintų savo galimybes laimėti. Tačiau mokslininkai išsiaiškino, kad tai nebūtinai lėmė patikimiausius algoritmus. Tokiam neribotam žaidimui iškilo pavojus, kad algoritmas bus perkeltas į konkrečias strategijas, kurios veiks tik tam tikromis sąlygomis.
Pasisemę įkvėpimo iš to, kaip profesionalūs StarCraft II žaidėjai treniruojasi vienas su kitu, mokslininkai vietoj to užprogramavo vieną iš algoritmų, kad atskleistų kito trūkumus, o ne padidintų savo šansus laimėti. Tai tarsi prašymas draugo žaisti prieš jus, sakė Oriol Vinyals, pagrindinis projekto tyrėjas. Šie draugai turėtų parodyti jums, kokios yra jūsų silpnybės, kad galiausiai galėtumėte tapti stipresni. Šis metodas sukūrė daug labiau apibendrinamus algoritmus, kurie galėtų prisitaikyti prie įvairesnių žaidimų scenarijų.
Tyrėjai mano, kad AlphaStar strategijos kūrimo ir koordinavimo įgūdžiai gali būti pritaikyti daugeliui kitų problemų. „StarCraft“ pasirinkome [...], nes jautėme, kad tai atspindi daugybę iššūkių, kurie iš tikrųjų kyla naudojant realias programas, sakė Silveris. Šios programos gali apimti skaitmeninius asistentus, savarankiškai važiuojančius automobilius ar kitas mašinas, kurios turi sąveikauti su žmonėmis, sakė jis.
„StarCraft“ sudėtingumas daug labiau primena mastą, kurį matome realiame pasaulyje, sakė Silveris.
Tačiau AlphaStar taip pat demonstruoja reikšmingus AI apribojimus. Pavyzdžiui, norint pasiekti tokį patį įgūdžių lygį, jam vis tiek reikia daug daugiau treniruočių duomenų nei žaidėjui. Be to, tokia mokymosi programinė įranga dar toli nuo jos pavertimo sudėtinga robotika ar realiomis programomis.
Jei norite, kad daugiau tokių istorijų būtų pristatyta tiesiai į jūsų pašto dėžutę, užsiprenumeruokite Webby nominuotą AI informacinį biuletenį The Algorithm. Tai nemokama.