【オセロ,将棋】ボードゲーム Part2【囲碁,War】

[過去ﾛｸﾞ] 【オセロ,将棋】ボードゲーム Part2【囲碁,War】 (1002ﾚｽ)
上下前次1-新
抽出解除ﾚｽ栞

このｽﾚｯﾄﾞは過去ﾛｸﾞ倉庫に格納されています｡
次ｽﾚ検索歴削→次ｽﾚ栞削→次ｽﾚ過去ﾛｸﾞﾒﾆｭｰ

8: 535 [sage] 2017/10/19(木) 00:44:02.75 ID:NEwsyYTL(1/2) AAS
気が散ってほかのことをしてしまうorz.
先延ばし先延ばしにしてしまうorz.

116: 310 [sage] 2017/12/06(水) 21:37:40.75 ID:fJiMVswg(1/2) AAS
今見たorz

夢想段階にあったものをことごとく圧倒的な力量でやられてしまふ。
そのうち、５分でオセロ作ったよとか言われるんだろうなぁ。

学習と評価の実行が完全に二分された今となっては、
学習に使用するハード性能は正義だと思い知らされる。

154: 535 [sage] 2017/12/13(水) 21:57:53.75 ID:3yqEn+ak(1/2) AAS
ID違うと思うけど535です。
DBがTXTで1.7GBに。
実行時7GB程になりました。
std::mapを別のコレクションに変えたらメモリ使用量減らないかな〜？

350: 310 [sage] 2018/05/03(木) 20:31:46.75 ID:EAR7zekO(1/3) AAS
なんか順調でうらやましい。
俺もやっぱGPU付きのPC買うべかな。

一般的にLRでは、学習率は発散しない限界まで大きくするのが良いらしく、
昔は、最初大きく、試行回数増えるごとにだんだん小さくみたいな事をしてました。
NNではRMSPropとかADAMとかで自動調整する流れだと当時理解していました。
ただ、Googleの論文読むと、普通に学習率固定っぽく読めてしまうんですよね。
強化学習だと学習率固定が良いのかも知れません。

表現力大きいからあんまり問題ない気がするのですが、学習率は小さくすると
学習に時間がかかる代わりに、収束しやすくなります。局所解には陥りやすく
なるのではないかと愚考しますが、強化学習における局所解と、教師付学習に
おける局所解は現象が違うから、よくわかりません。

597: 535 [sage] 2019/01/12(土) 22:30:56.75 ID:I11IVt9R(5/5) AAS
うーんせっかく３連休なのに捗らないな。
これだというアイディアが湧くまでこねくり回すしかないか。

717: 310 [sage] 2019/02/23(土) 17:22:38.75 ID:XSOOC+yB(1) AAS
>>715

715(1): 310 [sage] 2019/02/22(金) 00:24:39.77 ID:e/VjvE/W(1) AAS
ようやく評価関数が安定してきたのか、遡り記譜作成の速度が上がってきた気がする。

暇なので、mctsでも組んどこうかと考え始めたら、置換表の新アイデアが。

今までは、unordered_mapにとらわれていましたが、もともと探索木は文字通り
ツリー構造なので、その形のまんま置換表にして、探索しながら木を同時並行
でたどっていけば、置換表内で「探す」必要が無い上に、着手リストがそのまま
ノードとして存在しているので、反復系の探索の時に何度もmobility関数を呼ぶ
必要が無い。

結構大掛かりな修正になりましたが、とりあえず基礎的な探索まではできるように
なりました。速度計測はこれから。

あと、shared_ptr使った事で、不要な置換表データを自動削除できるので、minMaxで
AIを組んだ時に、置換表を縮小しながら再利用できるかなと。
あ、mctsはどこに行ってしまったんだろう（汗

の続き

良く考えたら、ツリー構造で自分の値を残しておくという意味で、mtd(f)や
反復深化の系統には効果あるけど、同じ局面を見つける事ができないので
そもそも置換表ではありませんねorz

その代り、並列探索でも排他制御をしなくて良い事になります。
メモリー使用量も少なくて済みます。

速度については、今のところ微妙。
棋譜作成が一段落したらPCリセットしてクリーンな状態で再計測の予定。

821: 535 [sage] 2019/05/08(水) 21:43:00.75 ID:c2FYdM3E(1/2) AAS
来たっ
262勝 248敗勝率51.4%
誤差の範囲かもしれないけど嬉しいっ

上下前次1-新書関写板覧索設栞歴

ｽﾚ情報赤ﾚｽ抽出画像ﾚｽ抽出歴の未読ｽﾚ AAｻﾑﾈｲﾙ

ぬこの手ぬこTOP 0.597s*