将棋AIの進捗その50（メモリ使用量削減）

dlshogi コンピュータ将棋

dlshogiは、1ノードにつき平均2KBのメモリを消費する（局面の平均合法手を80とした場合）。通常GPU 1枚で探索した場合、NVIDIA RTX 3090で最大4.5万NPS程度なので、5分探索したとすると、探索ノード数は1350万ノードで、約27GBのメモリを消費する。複数枚GP…

2020-12-06

将棋AIの進捗その49（並列化の課題）

dlshogi コンピュータ将棋

dlshogiでは、複数GPUを使用して並列化した場合に、ノードの衝突が発生しやすくなりNPSが1/3近くになる場合がある。例として、電竜戦でA100×8使用した時、以下の局面でNPSが初期局面に対して1/3近くなっていた。局面 NPS 初期局面 342985 position startpos…

2020-11-28

AobaZeroの棋譜の加工

dlshogi コンピュータ将棋 AobaZero

GCTでは、AobaZeroの棋譜を、事前学習に使用し、また、dlshogiの強化学習データに混ぜて使用している。アンサンブル効果の仮説 dlshogiの強化学習データと混ぜて使用したという部分が強さに影響しているのではないかという仮説を立てている。dlshogiは、デ…

2020-11-28

GCT、dlshogi、二番絞りの比較

コンピュータ将棋 dlshogi GCT

電竜戦の決勝リーグに進んだ、dlshogiを使用している3ソフト(GCT, dlshogi, 二番絞りプレミアム生)の比較を行った。「二番絞りプレミアム生」（以下、二番絞り）は、48先生からモデルファイルを提供いただいて、探索部には最新のdlshogiを使用して測定した…

2020-11-26

GCTの学習に使用したデータセットとノートブックを公開します

GCT dlshogi コンピュータ将棋

GCTの学習に使用したデータセットと、Google Colabのノートブックを公開します。colab.research.google.com データセットについてデータセットには、以下を含みます。 floodgateの棋譜からhcpe形式に変換したもの elmo_for_learnで生成したデータ AobaZero…

2020-11-25

「GCT電竜」とdlshogi(NVIDIA GPU非搭載PC対応版)の公開

GCT電竜 dlshogi コンピュータ将棋

「GCT電竜」とdlshogi(NVIDIA GPU非搭載PC対応版)を公開します。ダウンロード Release 世界将棋AI 電竜戦バージョン（「GCT電竜」同梱） · TadaoYamaoka/DeepLearningShogi · GitHubNVIDIA GPUに対応したTensorRT版と、NVIDIA GPU非搭載のWindows PCでも動…

2020-11-22

【電竜戦】チームdlshogiのGCTが決勝リーグで優勝しました

コンピュータ将棋電竜戦 dlshogi

本日開催されたコンピュータ将棋の大会「電竜戦」で、チームdlshogiのGCTが決勝リーグで優勝しました！コンピュータ将棋の大会でディープラーニングを使用したソフトが優勝するのは初です。 2017年からdlshogiの開発を始めてやっと優勝までたどり着きました…

2020-11-21

【電竜戦】dlshogiライブラリ使用の3ソフトが2日目決勝リーグに進出します

コンピュータ将棋電竜戦 dlshogi

本日、コンピュータ将棋のオンライン大会「電竜戦」の1日目が開催されました。私が開発しているdlshogiは、56チーム中10位で、2日目のA級リーグ（決勝）に進出します。他にもdlshogiライブラリを使用しているソフトが合計で3チーム決勝リーグ進出します！第…

2020-11-07

dlshogiをAWSのNVIDIA A100インスタンスで動かす

dlshogi AWS コンピュータ将棋

AWSのEC2に、NVIDIA A100のインスタンスが追加されたので、dlshogiでどれくらNPSが向上するか測定してみた。個人としてはAWSを使っていなかったので、AWSのアカウントを作成して、vCPUの上限緩和申請するところから行った。 P4dインスタンスは、vCPUが96なの…

2020-09-12

dlshogiのINT8対応

dlshogi コンピュータ将棋 TensorRT INT8

前回の記事にも書いたが、dlshogiは、V100のTensorCoreがINT8に対応していないため、INT8対応を行っていなかった。しかし、AWSのG4インスタンスでは、NVIDIA T4 Tensor Core GPUが利用できるため、INT8に対応することにした。また、今後クラウドでA100が提…

2020-09-06

電竜戦(予行演習3)の結果報告

電竜戦 dlshogi コンピュータ将棋

昨日開催された電竜戦(予行演習3)にdlshogiも参加し、結果は34チーム中4位でした。第1回コンピュータ将棋オンライン電竜戦予行演習3 勝敗表 DL勢同士の対局 CrazyShogi CrazyShogiのとの対局は、危なげなく勝ちました。第1回電竜戦棋譜中継(単一棋譜) Ao…

2020-08-29

Likelihood of superiorityについて

cshogi コンピュータ将棋

昨日の記事でcshogiに、2つのプログラム間の連続結果からLOS(Likelihood of superiority)の算出を実装したことを書いたが、その計算式は、チェスで使用されている式をそのまま適用した。 LOSについて測定された勝率がどれくらい確からしいかを表したのがLOS…

2020-08-28

cshogiにElo rating測定機能を追加

cshogi コンピュータ将棋

Cythonを使った高速なPythonの将棋ライブラリcshogiに、Elo rating測定機能を追加した。誤差とLOS 連続対局を行い、Elo ratingと誤差(95%信頼区間)をレポートする。何%の確率で強いと言えるかを表すLOS(Likelihood of superiority)も表示する。 LOSが95%を…

2020-08-23

将棋AIの実験ノート：Mask-AttentionでAIの着目点を可視化する

dlshogi コンピュータ将棋

深層強化学習でAIが着目している箇所を可視化するという以下の論文の手法（Mask-Attention）を、将棋AIでも試してみたい。 http://mprg.jp/data/MPRG/F_group/F20200610_itaya.pdf Mask-Attention 方策ヘッドに、位置情報をAttentionとして乗算する。 Attent…

2020-08-18

dlshogiにおける思考時間と強さの関係更新

dlshogi コンピュータ将棋

先日記事にしたdlshogiにおける思考時間と強さの関係について、思考時間8秒、16秒の結果と、水匠2のスレッド数を8にした場合の結果が測定できたので記事にする。測定条件は前回と同じである。 dlshogi vs 水匠2(1000万ノード固定)の測定結果思考時間(秒) 勝…

2020-08-16

将棋AIの実験ノート：活性化関数Swishを試す続き

dlshogi コンピュータ将棋

先日試したSwishについて、推論速度がどれくら低下するのかと、精度が上がった代わりに速度が低下した場合に強さにどう影響するのかが気になったので調べてみた。精度先日は、8サイクル分学習した時点の結果を記したが、今回は16サイクル分学習したモデル…

2020-08-14

将棋AIの実験ノート：活性化関数Swishを試す

dlshogi コンピュータ将棋

画像認識で高い精度を達成しているEfficientNetで使われている活性化関数Swishが将棋AIでも効果があるか試してみた。EfficientNetでは、残差ブロックにMBConvというアーキテクチャが使用されており、その中の活性化関数にSwishが使用されている。 MBConvにつ…

2020-08-10

dlshogiにおける思考時間と強さの関係

dlshogi コンピュータ将棋

MCTSと思考時間と強さの関係について、dlshogiのデータが知りたいという要望があったので測定してみた。測定条件対戦相手は、最新のやねうら王をUbuntu 18.04のclangでビルドしたもの+水匠2の評価関数で、1000万ノード固定とする。dlshogiは、最新のソース…

2020-08-05

dlshogiのdf-pnのテスト方法

コンピュータ将棋 dlshogi

dlshogiのdf-pnだけを動かす手順を書いておきます。テスト局面追加 testプロジェクトのtest.cppの「// DfPnテスト」と書いてあるところのmain()の vector<string> sfens = { // 詰み "9/9/+N8/p1p4p1/6p1p/1P7/3k3PP/2+p5L/6+rGK w R2B2G3Sgs3n3l9p 1", "1n1g3+Pl/</string>…

2020-08-04

df-pnの関連記事

コンピュータ将棋 dlshogi

TLでdf-pnの話が上がっていたので、以前書いた記事のリンクをまとめておきます。局面ループ周りの処理はガチで発狂するレベルで面倒でdf-pnが凄いと言い張ってる人が本当にこの問題を解決できてるのかを少し疑うレベルで面倒なんすよね orz— Ryoto_Sawada⛅Qh…

2020-08-02

dlshogiでMagic Bitboardを有効にする

dlshogi コンピュータ将棋

やねうら王が飛車と角の利きに、PEXTの代わりにMagic Bitboardを使用することで、Threadripperで高速化できたとのことなので、dlshogiでも高速化できるか試してみた。dlshogiは合法手生成にAperyのソースを使用しており、AperyはMagic Bitboardを実装してい…

2020-07-23

【将棋AI】N駒関係をMulti-Head Self-Attentionで学習する続き3

コンピュータ将棋

前回、入力特徴量の与え方でMulti-Head Self-Attentionの精度を向上できることを確認したが、DCNN(Resnet 10ブロック)に比べて精度がでないことが分かった。今回は、Multi-Head Self-Attentionの出力をDCNNに入力して、Multi-Head Self-AttentionとDCNNを組…