MIT, Carnegie Mellon, New York ve Stanford Üniversitelerinden araştırmacılar, eksik bilgiye dayalı masa oyunu Stratego'da insan ustalığını geride bırakan "Ataraxos" adlı yapay zeka sistemini geliştirdi. Sonuçları Nature dergisinde yayımlanan çalışmada Ataraxos, dört kez dünya şampiyonu olan Pim Niemeijer ile yaptığı 20 maçlık seride 15 galibiyet, 1 mağlubiyet ve 4 beraberlik elde etti. Sistem ayrıca turnuva oyuncularına karşı oynadığı gösteri maçlarında 38-2'lik üstünlük kurdu.
Satranç ve Go gibi tüm hamlelerin görülebildiği oyunların aksine Stratego, taşların gizlendiği ve 10³³'ü aşan başlangıç dizilimi içeren yapısıyla yapay zeka için aşılması güç bir eşikti. Ataraxos, DeepMind'ın DeepNash sistemine kıyasla yüzde birden daha az eğitim verisi kullanarak 8.000 doların altındaki bir bütçeyle eğitildi. Model, pekiştirmeli öğrenmeyi rakibin taşlarını gerçek zamanlı tahmin eden üretici bir mimariyle birleştiriyor.
Algoritma, Hanabi ve Dou dizhu gibi farklı kurallara sahip eksik bilgili oyunlarda da başarı gösterdi. Araştırmacılar, karar anı planlamasına dayanan bu yöntemin siber güvenlik savunmaları, ticari müzakereler, finansal piyasalar ve askeri taktik planlama gibi belirsizlik içeren kriz senaryolarında karar vericilere stratejik modelleme desteği sunabileceğini kaydediyor.
KAYNAK: arstechnica.com