寶可夢卡牌已悄然變成 AI 新戰場,數千支隊伍花了兩個多月時間訓練 AI 打寶可夢卡牌,總獎金逾 30 萬美元。
(前情提要:LLM西洋棋賽落幕:OpenAI o3 奪冠,xAI Grok 4 沒贏一盤被完封)
(背景補充:林上倫律師專文》寶可夢卡牌逆勢創新高,AI 產品的護城河要往線下埋)
你知道嗎?全球現在已經有超過六千支隊伍,花了兩個多月時間訓練 AI 打寶可夢卡牌。決賽預計在 2026 年末以後,總獎金逾 30 萬美元。讓寶可夢卡牌,成為繼西洋棋、將棋、圍棋之後,AI 的下一個新戰場。
誰在教 AI 打牌?
這場比賽的官方全名是 Pokémon Trading Card Game AI Battle Challenge,日文社群簡稱「ポケカABC」,寶可夢官方競賽站今年 6 月 16 日公告開賽,由 Kaggle 主辦,共同主辦包括 The Pokémon Company、松尾研究所與 HEROZ,技術支撐則來自 Google、Google Cloud 與 NVIDIA。
官方在公告裡寫下:西洋棋、將棋、圍棋這些棋盤遊戲都已經被 AI 一一攻克,寶可夢卡牌是下一關。
比賽分成兩個部門。模擬部門在 Kaggle 開跑,時間是 6 月 16 日到 8 月 17 日,參賽者可上傳 AI agent 讓程式自動對戰,每隊每天最多提交五次,依即時戰績排名,這個部門沒有獎金,純粹是練兵場。
策略部門則從 6 月 16 日開放到 9 月 14 日,每隊僅能交一次策略報告,說明 AI agent 的設計邏輯,評分同時看 AI 穩定性、牌組概念與模擬部門的戰績。前八名各拿 3 萬美元、晉級決賽,晉級隊伍每位成員再拿 3,000 美元 Google Cloud 額度。
決賽時間官方寫的是 2026 年末以後,地點另行公告,會在 YouTube 官方頻道直播,賽制是三戰兩勝、每局 30 分鐘超時判負(第一輪單局只有 10 分鐘),卡池會加入新卡,冠軍 5 萬美元、亞軍 3 萬美元。
不完全資訊的難題
西洋棋、將棋、圍棋有一個共同點:棋盤上的一切都攤在雙方眼前,沒有秘密。這類「完全資訊」遊戲,AI 只要算得夠深、夠快,就能找到最優解,AlphaGo 的勝利本質上是暴力計算加深度學習的勝利。
不過寶可夢卡牌完全是另一回事,官方稱它是「不完全資訊」遊戲。簡單來說就是,手牌看不到,抽牌是隨機的,對手的牌組要靠場上出過的卡去反推,得憑出牌節奏去猜對手手上還藏著什麼。這意味著這場比賽的技術路線,不是 AlphaGo 那條線的延伸,反而更靠近撲克,也就是德州撲克那類需要處理機率、唬人與資訊不對稱的問題。
卡池規模也拉高了難度。官方說法是要從超過 1,000 張卡牌中構築一副 60 張的牌組(外媒估算近 2,000 張,屬第三方估算),排列組合的空間遠比一副圍棋棋盤複雜。
更棘手的是,環境不是靜態的,參賽者的牌組彼此牽制,形成一個持續變動的生態。這也是為什麼策略部門要求交出報告解釋「為什麼這樣打會贏」,而不只看模擬部門的分數。
兩個月的牌組興衰
根據日本社群媒體 pokebros.net 的兩個月社群觀測(第三方統計,非官方公布),開賽時報名隊伍是 2,671 支,到 8 月 15 日已經衝到 6,835 支,約 2.5 倍,參賽者橫跨日本、韓國、中國、越南、印尼、義大利、俄羅斯等地。
榜首幾乎每週換人:6 月 22 日首任榜首是 keidroid,之後 ShumpeiNomura、Majkel1337 輪流坐莊,前五名的評分幾乎並行,一路纏鬥到最後。單夜排名劇變是常態,有隊伍從第 3,213 名衝進前 60 名,也有隊伍從第 4,889 名衝到第 349 名。
牌組組合的變化也很有趣。7 月中,「胡地」(フーディン)牌組使用率一度超過 33%;7 月下旬,「瑪俐的黑目大王 ex」(マリィのオーロンゲ ex)一週內從 27% 衝到 51%,過半數隊伍都在用同一套牌;到了 8 月上旬,這套牌使用率又回落到 32%,胡地反攻,「Dragapult ex」(ドラパルト ex)開始崛起。
另一個更誇張的例子是「メガミミロップ ex」(超級長尾怪手 ex),兩週內從使用率僅 0.85% 的冷門卡,爬升到 12%,躍居環境第三。
📍相關報導📍
世界第一的韓國棋王對決開源 AI KataGo,首戰讓兩子仍落敗

