Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
Move Evaluation in Go Using Deep Convolutional ...
Search
Sponsored
·
Your Podcast. Everywhere. Effortlessly.
Share. Educate. Inspire. Entertain. You do you. We'll handle the rest.
→
Masanori YANO
July 22, 2019
Science
900
1
Share
Move Evaluation in Go Using Deep Convolutional Neural Networks
論文LT会で作成した、CNNで囲碁の打ち手を予測する論文の説明資料です。
Masanori YANO
July 22, 2019
More Decks by Masanori YANO
See All by Masanori YANO
Novelty Detection Via Blurring
msnr
0
560
Y-Net: Joint Segmentation and Classification for Diagnosis of Breast Biopsy Images
msnr
0
600
Pyramid-Based Fully Convolutional Networks for Cell Segmentation
msnr
0
610
Free-Form Image Inpainting with Gated Convolution
msnr
0
1.1k
Memorizing Normality to Detect Anomaly: Memory-augmented Deep Autoencoder for Unsupervised Anomaly Detection
msnr
0
740
AlphaX: eXploring Neural Architectures with Deep Neural Networks and Monte Carlo Tree Search
msnr
0
1.2k
Towards Understanding Chinese Checkers with Heuristics, Monte Carlo Tree Search, and Deep Reinforcement Learning
msnr
0
540
SRCNN: Image Super Resolution Using CNN
msnr
0
810
One-Class Convolutional Neural Network
msnr
0
1.4k
Other Decks in Science
See All in Science
Non-Gaussian, nonlinear causal discovery with hidden variables and application
sshimizu2006
0
110
アクシズを探せ! 各勢力の位置関係についての考察
miu_crescent
PRO
1
260
Lean4による汎化誤差評価の形式化
milano0017
1
490
AI(人工知能)の過去・現在・未来 —AIは人間を超えるのか—
tagtag
PRO
1
270
機械学習 - K-means & 階層的クラスタリング
trycycle
PRO
0
1.3k
KH Coderチュートリアル(スライド版)
koichih
1
61k
Accelerating operator Sinkhorn iteration with overrelaxation
tasusu
0
300
Conversation is the New Dashboard: 属人性を排除する第4世代BIツールの勢力図
shomaekawa
1
540
Endel Tulvingとエピソード記憶
rmaruy
0
100
なぜエネルギーは保存する? 〜自由落下でわかる“対称性”とネーターの定理〜
syotasasaki593876
0
110
人生を変えた一冊「独学大全」のはなし / Self-study ENCYCLOPEDIA: The Book Which Change My Life #独学大全 #EM推し本
expajp
0
150
SpatialRDDパッケージによる空間回帰不連続デザイン
saltcooky12
0
210
Featured
See All Featured
Put a Button on it: Removing Barriers to Going Fast.
kastner
60
4.2k
Practical Tips for Bootstrapping Information Extraction Pipelines
honnibal
25
1.9k
It's Worth the Effort
3n
188
29k
Max Prin - Stacking Signals: How International SEO Comes Together (And Falls Apart)
techseoconnect
PRO
0
150
What Being in a Rock Band Can Teach Us About Real World SEO
427marketing
0
220
RailsConf & Balkan Ruby 2019: The Past, Present, and Future of Rails at GitHub
eileencodes
141
35k
The Mindset for Success: Future Career Progression
greggifford
PRO
0
310
Future Trends and Review - Lecture 12 - Web Technologies (1019888BNR)
signer
PRO
0
3.5k
RailsConf 2023
tenderlove
30
1.4k
Reality Check: Gamification 10 Years Later
codingconduct
0
2.1k
Unsuck your backbone
ammeep
672
58k
Save Time (by Creating Custom Rails Generators)
garrettdimon
PRO
32
2.9k
Transcript
画像処理&機械学習 論文LT会 #5 Move Evaluation in Go Using Deep Convolutional
Neural Networks 2019年7月22日(月) 矢農 正紀 (Masanori YANO)
論文 2 Move Evaluation in Go Using Deep Convolutional Neural
Networks 論文のURL: https://arxiv.org/abs/1412.6564 ⇒ CNNで「KGS Go Server」の打ち手を予測した論文 著者の所属は、トロント大学・Google Brain/DeepMind 選んだ理由 ・AlphaGoやAlphaZeroの手法の応用に関心あり ・CNNへの入力とするための「状態の表現」に関心あり (囲碁や将棋は、基本的なルールを把握している程度)
Google DeepMindメンバーの囲碁研究 3 [0] ICLR 2015の論文: CNNで「KGS Go Server」の打ち手を55%予測 https://arxiv.org/pdf/1412.6564.pdf
[1] AlphaGo Fan: 「KGS Go Server」の棋譜データでプロ棋士に勝利 https://storage.googleapis.com/deepmind-media/alphago/AlphaGoNaturePaper.pdf [2] AlphaGo Lee: トップクラスのプロ棋士に勝利 [3] AlphaGo Master: ネット碁で、プロ棋士に無敗 [4] AlphaGo Zero: 棋譜データを使わずに強く https://deepmind.com/documents/119/agz_unformatted_nature.pdf [5] AlphaZero: 囲碁に加えて、チェスと将棋でも強く https://deepmind.com/documents/260/alphazero_preprint.pdf ⇒ AlphaZeroで、Google DeepMindの「囲碁研究は」終了 論文に関心ある場合は、赤字の論文からが読みやすいかも 今回取り上げる論文
コンピュータ囲碁のアプローチ 4 2006年以降、MCTS(モンテカルロ木探索)が主流 ・現在の状態から、乱数を含めて終局までシミュレーション ・シミュレーションするための評価関数は、MCTSでも重要 ⇒ AlphaGoは、CNN評価関数+強化学習+MCTS CNN評価関数の入力 ・サイズは、囲碁の盤面と同じく19×19 ・チャネルは、現在の状態と、それに関連する特徴量
(例) 現在の局面: 黒/白で2チャネル、空きで1チャネル CNN評価関数の出力 [1] 現在の状態の評価値(その局面が、有利か不利か) [2] 次に取るべき行動(どの手を打つべきか)
本論文のアプローチ 5 現在の状態を「36チャネル×19×19」で表現 [参考] AlphaGoは48チャネルと、13/15チャネル(対戦用) AlphaGo ZeroとAlphaZero(の囲碁)は17チャネル 対象とした「KGS Go Server」参加者のランク:
初段~9段 ⇒ 9チャネルのうち一つの19×19を全て1とし、他を全て0 CNNはゼロパディング+最初だけ5×5で、以降は全て3×3 教師データ数は27.4 millionで、テストデータ数は2 million
本論文の主な結果(1/2) 6 CNNのレイヤー数を変えたときの、棋譜との一致率 ・中間層のチャネル数は128で、比較用に3レイヤーは16も ・横軸のは、CNNの出力のうちtop-(上位の手まで)
本論文の主な結果(2/2) 7 CNNのレイヤー数を変えたときの、一致率と強さ ・中間層のチャネル数は128で、比較用に3レイヤーは16も ⇒ 12レイヤーのCNNの「55.2%」が最高 ・囲碁プログラムのGnuGoと対戦させたときの勝率も評価 ・CNNを使った既存研究や、2014年の「彩」より高い精度 ・KGSで6段の、GnuGoには完勝する打ち手と同等の精度
まとめ 8 本論文は、CNNにより高い精度で人が打つ手を予測 ・テストデータで、最高55%の精度(top-1) ・論文には、CNNの出力だけでMCTSに勝利した棋譜も ・AlphaGoの伏線でCNN+MCTSの評価も 所感 ・この時点では、入力に特徴量も多い ・CNNの最近の手法も、少し効果あるかも (AlphaGo
Zero以降はResNet) ・「画像+特徴情報」の可能性に期待 - PFNのPaintsChainer(初期) 1チャネル+色塗りヒント3チャネル - 筑波大学の飯塚さんのGLCIC 3チャネル+マスク1チャネル