Naujasis „DeepMind“ dirbtinis intelektas pirmą kartą įveikė geriausius žaidėjus „Starcraft II“.

Kategorija: Dirbtinis intelektas Paskelbta sausio 25 d

„DeepMind“, „Alphabet“ dukterinė įmonė, kuri daugiausia dėmesio skiria dirbtinio intelekto šalinimui, paskelbė apie naują orientyrą šiose didžiosiose paieškose: žmonių įveikimas galaktikos kare.

Naujienos: AlphaStar , naujausias kompanijos mokymosi algoritmas, pirmą kartą nugalėjo profesionalius Starcraft II žaidėjus, pelnęs 10 pergalių ir vieną pralaimėjimą prieš profesionalus, vadinamus TLO ir MaNa. Populiarieji realaus laiko strateginis žaidimas apima žaidėjus, kurie varžosi kaip viena iš trijų lenktynių statant konstrukcijas ir kovojančius didžiuliame mūšio lauke.

Praktika, praktika: AlphaStar išmoko žaisti aplinkoje, vadinamoje AlphaStar lyga. Didelis neuroninis tinklas pirmą kartą stebėjo ekspertų žmonių žaidimų pakartojimus. Tada jis buvo supriešinamas su savo versijomis, naudojant mašininio mokymosi techniką, vadinamą sustiprinimo mokymusi, kad laikui bėgant tobulėtų. Svarbu tai, kad programos veiksmo greitis ir vaizdas į mūšio lauką buvo apriboti, kad ji neturėjo nesąžiningo pranašumo prieš žmones.

Kas duoda Zergą? AlphaStar turėjo parodyti naujos rūšies intelektą, kad galėtų įvaldyti žaidimą. Žaidimui sukurti sukurti metodai gali būti naudingi daugelyje praktinių situacijų, kai reikia sudėtingos strategijos: pagalvokite apie prekybą ar net karinį planavimą.

Aukštesnis balas: Starcraft II yra ne tik labai sudėtingas. Tai taip pat netobulos informacijos žaidimas, o tai reiškia, kad žaidėjai ne visada mato, ką daro jų priešininkai. Taip pat nėra vienos geriausios žaidimo strategijos. Ir reikia laiko, kol paaiškėja žaidėjo veiksmų rezultatai, todėl algoritmui sunkiau išmokti per patirtį. „DeepMind“ komanda naudojo labai specializuotą neuroninio tinklo architektūra spręsti šias problemas.

Žaidimo teorija: „DeepMind“ labiausiai žinomas tuo, kad sukūrė programinę įrangą, kuri išmoko įveikti geriausius pasaulio „Go“ ir šachmatų žaidėjus. Tačiau prieš tai įmonė sukūrė kelis algoritmus, išmokusius žaisti paprastus Atari žaidimus. Žaisti vaizdo žaidimus yra puikus būdas įvertinti dirbtinio intelekto pažangą ir palyginti kompiuterius su žmonėmis. Tačiau tai taip pat labai siauras testas – „AlphaStar“, kaip ir jo pirmtakai, gali atlikti tik vieną užduotį, nors ir neįtikėtinai gerai.