黒が盤の中央付近に一手打ちました。白には今すぐ止めるべき四連はありませんが、互いに近づいていく2本の斜めの線が見えます。エンジンは、その交点から離れた守りの手を上位に挙げました。目先の棋形だけを見ていると、何を見抜いたのか気になるかもしれません。
探索が止まった局面は、誰が評価するのでしょうか
エンジンは候補手から先の変化を探索し、双方の応手を調べます。例えばalpha-beta探索では、調べ続ける必要のない枝を一部省けます。それでも、すべての枝を終局まで読むことはできません。
探索がある局面で止まると、評価関数がその末端局面に点数を付け、手を比較する材料にします。例えば、黒の斜めの線がまだ直接の脅威になっていなくても、その後は白が両側に対応しにくくなると評価する場合があります。探索はその点数を手がかりに、変化をさらに追うか決めます。
点数は現在の局面についての推定です。勝敗はその後の着手によって決まります。探索が早い段階で止まるほど、評価には、まだ形になっていなくても後の選択を左右する石同士のつながりを見分ける力が求められます。
手作業の棋形表には何が見えるのでしょうか
従来の方法では、活三(かつさん)や四追いなどの形を見つけ、あらかじめ決めた重みで点数を合計します。判断基準は明快です。四追いへの対応は通常、攻めるまでに準備が必要な棋形への対応より急ぐため、エンジンは守りの手を先に調べられます。
15×15の自由ルールで白番の局面を考えてみましょう。左上にある黒の斜めの棋形と、右側にある横向きの棋形が、どちらも空いている天元へ伸びています。白が天元に打てば、両方を同時に止められます。手作業の棋形表が2つの形に別々に加点し、それぞれに守りが必要だと見なすと、防御にかかる負担を二重に数え、黒を過大評価してしまいます。また、手作業の表で認識できる形は、作成者が事前に定義したものに限られます。探索で見落としを補える場合もありますが、関連する枝をまず調べなければなりません。評価によって重要な候補が早々に外されると、そこに計算資源が割かれないこともあります。
手作業のルールから学習型評価へ
NNUEは「効率的に更新できるニューラルネットワーク」の略称です。将棋エンジン「やねうら王」とNNUEの起源に関する公開資料によると、2018年にYu Nasuが考案し、最初に将棋エンジン「やねうら王」で使われました。名前には日本の伝説に登場する「鵺」の読みも重ねられています。着手後に学習済みの評価をすばやく更新できるため、局面を繰り返し評価する探索に適しています。
参考になるのがチェスでの事例です。Stockfish NNUEに関する公開記録によると、2020年8月時点で探索速度は約半分になったものの、従来の評価を使った場合より棋力は少なくとも80 Elo高く、その後、公式エンジンに採用されました。探索が遅くなっても、末端局面をより適切に評価できれば成果につながる場合があります。
評価の方法が変わっても、変化を確かめるのは探索です
学習した判断も、一手ずつ確かめる必要があります
学習型評価は大量の局面から棋形の組み合わせを学べますが、その判断も推定です。白に必ず対応すべき四追いがあれば、余裕があるように見えた黒の位置的な優位は、すぐに失われるかもしれません。エンジンは、その強制的な変化を実際に読み進める必要があります。
探索方法にもそれぞれ役割があります。PVSは最有力手をまず十分に探索し、ほかの手は狭いウィンドウで調べ、必要なら探索し直します。モンテカルロ木探索は、追う価値のある枝により多くのシミュレーションを割り当てます。VCTのように脅威が連続する場面では、必然的な攻め筋があるかを証明数探索で別途調べるエンジンもあります。
つまり、ある手が評価によって候補に入り、その後、具体的な応手が見つかって退けられることもあります。エンジンの判断が変わったら、前後の点数だけを比べるのではなく、どの一手で脅威の関係が変わったかを探してみてください。
2026年の大会で見られた多様な組み合わせ
Gomocup 2026公式大会ページのエンジン更新情報には、さまざまな組み合わせが紹介されています。Figridはalpha-beta探索とNNUE評価を併用し、脅威キャッシュと継続履歴も使って着手順を決めています。Chlorisは、約300万のStandard-15局面で独自のNNUEを学習させ、探索とは別に強制手のチェックと緊急防御の仕組みを設けています。
同じGomocup 2026公式大会ページによると、TKGomokuは手作業の棋形評価を残しつつ、軽量なNNUE、方策ファイル、定跡データベースを使っています。DDQK-ConquerもNNUEに似たアルゴリズムを採用しています。また、Starpointはモンテカルロ木探索とtransformerによる評価を組み合わせ、内部では証明数探索でVCTに対応すると記されています。学習型の判断はさまざまな構成に取り入れられていますが、使い方は一様ではありません。
大会の結果を、特定の評価方式だけの成果と考えることもできません。Gomocup 2026公式大会ページの結果によると、RAPFIは2026年に20×20自由ルールの王座を守り、15×15自由ルールと早指しでも優勝しました。初参加のKATAGOMOは自由ルールの両部門で2位となり、15×15部門では差はわずか9 Eloでした。エンジンの指し方は、評価だけでなく探索や時間配分にも左右されます。
意外な推奨手をどう読み解くか
エンジンがすぐに三を作る手より静かな一手を上位に置くのは、その手が後の2つの進路を同時に制限するからかもしれません。着手直後には手作業の棋形表で高得点になる形が見えなくても、学習型評価はそうした局面の関係を高く評価する場合があります。妥当な判断かどうかは、探索で見つかる応手を確かめる必要があります。
点数を読むときは、その前提も忘れないでください。ルール、探索深度、持ち時間、評価方式によって結果は変わります。同じ局面でも、エンジンが違えば点数の尺度や着手の順位が異なることがあります。まず推奨手の後に双方がどう指すかを見て、それから点差が安定しているか確認しましょう。
点数を盤面の変化に結びつけましょう
棋譜を振り返るときは、まず応じなければならない脅威を探し、その後、エンジンが離れた場所にある石同士のつながりをどう扱うか見てみましょう。ある手がすぐには四追いを作らなくても、次の相手の手を片側の守りに限定するなら、その制約がどの一手から生まれたか記録してみてください。
評価関数は、エンジンが局面を選び、測る方法を変えました。一方、具体的な変化を確かめる役割は探索が担い続けます。両者を分けて見れば、見慣れない推奨手にも「何を評価し、どこまで読んだのか」と、より具体的に問いかけられます。
まず強制的な変化を確かめ、それから局面の点数を読みましょう