Ataraxos: AI Pertama yang Kuasai Stratego, Tundukkan Manusia di Permainan Informasi Tersembunyi
Baca dalam 60 detik
- Tim peneliti dari MIT, Carnegie Mellon, NYU, dan Stanford menciptakan Ataraxos, AI yang mengalahkan pemain Stratego terbaik dunia pada 2025.
- Model ini dilatih dengan self-play reinforcement learning dan algoritma DeepNash, meniru keseimbangan Nash untuk menghadapi informasi tersembunyi.
- Keberhasilan Ataraxos membuka jalan bagi AI yang lebih tangguh dalam pengambilan keputusan di dunia nyata yang penuh ketidakpastian.

Kecerdasan buatan kembali mencatatkan tonggak sejarah. Setelah Deep Blue menaklukkan catur pada 1997 dan AlphaGo menguasai Go pada 2016, kini giliran Stratego—permainan papan perang dengan informasi tersembunyi—yang berhasil ditundukkan oleh AI. Ataraxos, model yang dikembangkan kolaborasi peneliti dari MIT, Carnegie Mellon University, New York University, dan Stanford University, dilaporkan mampu mengalahkan pemain manusia terbaik pada 2025. Temuan ini dipublikasikan dalam jurnal Nature pada 30 September, mengungkap arsitektur dan strategi di balik kecerdasan buatan tersebut.
Stratego berbeda fundamental dari catur dan Go. Jika kedua permainan sebelumnya memiliki kondisi papan yang sepenuhnya transparan, Stratego menyembunyikan identitas setiap bidak dari lawan. Pemain hanya bisa menebak kekuatan dan posisi unit musuh, menciptakan lapisan ketidakpastian yang selama ini menjadi penghalang utama bagi AI. "Pengambilan keputusan di dunia nyata umumnya melibatkan informasi tersembunyi, yaitu informasi yang tidak diketahui oleh satu agen tetapi dimiliki oleh agen lain," tulis para peneliti dalam makalah mereka. "Sayangnya, keberadaan informasi tersembunyi dalam jumlah besar membuat pendekatan pembelajaran penguatan dan pencarian yang mapan menjadi tidak efektif."
Untuk mengatasi tantangan tersebut, para insinyur menerapkan metode self-play reinforcement learning. Dalam pendekatan ini, AI memainkan sejumlah besar pertandingan melawan dirinya sendiri, mempelajari pola, termasuk kemampuan menggertak dan strategi psikologis. Hasilnya, Ataraxos tidak hanya unggul dalam perhitungan, tetapi juga dalam pengambilan risiko yang terukur. "Ataraxos pandai menghitung risiko dengan cara yang tidak dilakukan manusia," ujar Gabriele Farina, asisten profesor di Departemen Teknik Elektro dan Ilmu Komputer MIT, seperti dikutip MIT News. "Seorang manusia mungkin panik jika bidak berharganya terekspos, tetapi bot bisa tetap tenang. Ia tidak bereaksi berlebihan dan membocorkan rahasianya."
Nama Ataraxos sendiri diambil dari konsep Yunani kuno ataraxia, yang berarti ketenangan atau kebebasan dari gangguan. Filosofi ini tercermin dalam kemampuan AI menjaga emosi—sesuatu yang sering menjadi kelemahan manusia. Menariknya, desain Ataraxos banyak dipengaruhi oleh matematikawan John Nash, yang terkenal dengan teori keseimbangan Nash. Algoritma DeepNash memanfaatkan dinamika Nashian untuk bersaing dengan manusia. Secara teknis, Ataraxos adalah penerus DeepNash, namun dengan model yang berbeda. Keduanya belajar melalui permainan mandiri, dan hasilnya terbukti efektif.
"Keberhasilan pendekatan ini di berbagai permainan adversarial, kooperatif, dan tim membentuk pola desain untuk pembelajaran penguatan dan pencarian yang efektif di bawah informasi tersembunyi dalam jumlah besar, sebuah tujuan lama di bidang pengambilan keputusan strategis."
— Para penulis makalah di Nature
Selain Stratego, para ilmuwan juga telah merancang AI untuk permainan kompleks lain seperti Hanabi, permainan kartu kooperatif asal Prancis, dan Dou Dizhu, permainan kartu dari Tiongkok. Hanabi menantang AI karena pemain tidak bisa melihat kartu sendiri dan harus memberi petunjuk terbatas, sementara Dou Dizhu melibatkan kerja sama dan kompetisi simultan. Keberhasilan di berbagai permainan ini menunjukkan bahwa AI semakin mahir menangani informasi tersembunyi, meskipun masih ada batas kemampuan yang belum seragam—sebuah fenomena yang oleh Ethan Mollick disebut sebagai "jagged frontier".
Di ranah poker, AI juga telah lama mengalahkan manusia. Libratus dari Carnegie Mellon mengalahkan profesional dalam Texas Hold'em pada 2017, disusul Pluribus pada 2019 yang menguasai permainan enam pemain. Sejak itu, kemampuan AI terus meningkat. Bagi Indonesia, perkembangan ini bukan sekadar hiburan. Teknologi di balik Ataraxos berpotensi diterapkan pada sektor-sektor yang menghadapi ketidakpastian tinggi, seperti negosiasi dagang, keamanan siber, dan pengambilan kebijakan publik. Kemampuan AI membaca informasi tersembunyi dan mengambil keputusan rasional di tengah ketidakpastian bisa menjadi alat bantu strategis bagi pembuat kebijakan dan pelaku usaha.
Ke depan, pertanyaannya bukan lagi apakah AI bisa mengalahkan manusia dalam permainan papan, tetapi seberapa cepat kemampuan ini ditransfer ke domain nyata. Jika Ataraxos dapat menguasai Stratego dengan informasi tersembunyi, bukan tidak mungkin AI berikutnya akan membantu manusia menavigasi kompleksitas dunia nyata—dari perundingan diplomatik hingga deteksi dini krisis keuangan. Namun, tantangan etis dan regulasi tetap membayangi. Sejauh mana kita siap memberikan kendali kepada mesin yang tak pernah panik dan tak pernah mengumbar rahasia?



