今回の大会(第5回 将棋電王トーナメント)でのやねうら王は、定跡をdepth 34で掘った。
投稿者「やねうらお」のアーカイブ
本大会のやねうら王は究極のリゼロ系
今回のやねうら王は、学習時に人間の棋譜を用いていない。いわゆるリゼロ系である。学習時に人間の定跡も用いていない。初期局面から何手かランダムムーブさせた局面からdepth 10で対局させたものを教師局面として用いている。
評価関数のブレンドに関する知られざること
今回の大会、決勝に進出した12チームのうち、Ponanza、Apery、Seleneを除く9チームがやねうら王チルドレン。
KKPPに関する知られざること
第5回 将棋電王トーナメント決勝日の朝にこの記事を書いています。
KKPP型評価関数について、あまり知られていないこと、知っていると有利なことをざっと書いておきます。
コンピュータ将棋開発者がAWSで機械学習を回すには?
電王トーナメント直前ですが、AWSを使って機械学習で使う教師局面を生成してみようと思い、昨日実際にやってみたので、そのノウハウを書いておきます。ノウハウというか、たぶんLinuxに慣れているような人なら誰でも知っているはずのことで、誰得記事ではあるのですが、私は大いに躓いたので記録として残しておきます。
BonaPiece inverse hackとは何か?
BonaPiece inverse hackという新しいアイデアを思いついたので簡単に書いておきます。
続きを読む
KPP interleaveとは何ですか?
銀座でelmoの瀧澤さんなどSDT5の参加予定の開発者でミニオフ会をしたのですが、集合までに時間があったのでドワンゴ本社の会議室を使わせてもらって、Qhapaqの澤田さん相手に、私が考えたKPP interleaveという技法を解説していました。
やねうら王、KPP_KKPT型評価関数に対応しました
Q) KPP_KKPT型評価関数とは何ですか?
A) KPPT型に比べて、KPPの手番は用いないことにしたものです。評価関数ファイルのサイズが約半分になります。
eta可変絞りについて
SDT5に向けて徐々に手持ちの情報を公開していきます。
やねうら王の学習部はAdaGradを用いている。勾配をgとして、gの二乗を足し合わせたものを記憶しておき、これを基準にwを更新する。
過去5年間の将棋ソフトの変遷
今年のSDT(将棋電王トーナメント)の開催日が発表になりましたね。11月の11,12日だそうです。参加予定の皆さんの開発は捗っているでしょうか?やねうら王はまだ1㍉も強くなってませんが。