„DeepMind“ novatoriškas „AlphaGo Zero AI“ dabar yra universalus žaidėjas

Kategorija: Dirbtinis intelektas Paskelbta Gruodžio 06 d

Nenuginčykite šio algoritmo stalo žaidimui. Nes didelė tikimybė, kad per dieną jis išmoks jus pergudrauti.





Anksčiau šiais metais pranešėme, kad „Alphabet“ mašininio mokymosi dukterinė įmonė „DeepMind“ padarė didžiulę pažangą. Naudodamas dirbtinio intelekto metodą, žinomą kaip sustiprinimo mokymasis, „AlphaGo“ programinė įranga leido ugdyti antžmogiškus „Go“ žaidimo įgūdžius, nereikalaujant žmonių duomenų. Apsiginklavęs tik žaidimo taisyklėmis, AI galėjo žaisti atsitiktinai, kol sukūrė čempionų įveikimo strategijas. Naujoji programinė įranga buvo pavadinta AlphaGo Zero, nes jai nereikėjo jokio žmogaus įvesties.

Dabar, į dokumentas, paskelbtas arXiv , DeepMind komanda praneša, kad programinė įranga buvo apibendrinta, kad galėtų mokytis kitų žaidimų. Jame aprašomi du nauji pavyzdžiai, kuriuose AlphaGo Zero buvo paleistas šachmatų ir shogi – japoniško žaidimo, panašaus į šachmatus – žaidimuose. Abiem atvejais programinė įranga sugebėjo išsiugdyti antžmogiškus įgūdžius per 24 valandas ir įtikinamai nugalėjo pasaulio čempionų programą.

Turbūt nenuostabu, kad dirbtinis intelektas taip greitai sugebėjo įgyti žudikų įgūdžių dviejose partijose: ir šachmatai, ir šogis yra mažiau sudėtingi nei Go. Tačiau „DeepMind“ gebėjimas apibendrinti programinę įrangą, kad ji galėtų valdyti įvairius žaidimus, rodo vis labiau pritaikomus mašinų intelekto tipus.



Be to, vis dar yra žaidimų, kurių AI dar neįvaldė. Bene didžiausias iššūkis, kurį DeepMind jau dirba, yra didžiuliai sudėtingi internetiniai strateginiai žaidimai, tokie kaip Starcraft, kuriuos žmonės vis dar pranašesni. Kaip paaiškinome praeityje, mašinos turės lavinti naujus įgūdžius, tokius kaip atmintis ir planavimas, kad pavogtų tą karūną. Tačiau nesitikėkite, kad tai užtruks per ilgai.