Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Sign up for free
Menu
Search
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Pricing
Search
Sign in
Sign up for free
[論文紹介] Chip Placement with Deep Reinforcement L...
Search
tt1717
April 29, 2024
Research
140
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
[論文紹介] Chip Placement with Deep Reinforcement Learning
PDFファイルをダウンロードすると,スライド内のリンクを見ることができます.
tt1717
April 29, 2024
More Decks by tt1717
See All by tt1717
[勉強会] Decision Transformer
tt1717
0
98
[論文サーベイ] Survey on Google DeepMind’s Game AI 2
tt1717
0
80
[論文サーベイ] Survey on Google DeepMind’s Game AI
tt1717
0
65
[論文サーベイ] Survey on VLM for Video Game Quality Assurance
tt1717
0
63
[論文サーベイ] Survey on Pokemon AI 3
tt1717
0
100
[論文サーベイ] Survey on Pokemon AI 2
tt1717
0
100
[論文サーベイ] Survey on Pokemon AI
tt1717
0
130
[論文サーベイ] Survey on Minecraft AI in NeurIPS 2024
tt1717
0
160
[論文サーベイ] Survey on GPT for Games
tt1717
0
110
Other Decks in Research
See All in Research
EIRによる不正端末のブロッキング 5G時代におけるデバイス識別と不正対策の進化
stellarcraft
0
130
敵対生成プロンプト同時探索による内省型プロンプト最適化
kinoue_smarthr
0
410
コーディングエージェントとABNを再考
hf149
2
860
Using our influence and power for patient safety
helenbevan
0
420
CDCL を用いた MILP の厳密解法
imai448
0
240
高性能計算機クラスタを用いた大規模点群処理による森林の単木抽出と構造解析
kentaitakura
1
130
大規模言語モデルは誰を覚えているか / Who Do Large Language Models Memorize?
upura
0
170
Sleuthcon Keynote - How Cybercriminals (ab)use AI
fr0gger
0
320
NLP colloquium: AI Safety Survey
kanekomasahiro
2
1.1k
J-STAGEの現況と全文XML登載必須化について
xspa2012
0
210
LA-Bench 2025:実験指示から実行可能手順を生成するためのデータセット/LA-Bench 2025: A Dataset for Generating Executable Experimental Procedures from Experimental Instructions
stktu
0
150
[CV勉強会@関東 CVPR2026] PSDesigner: Automated Graphic Design with a Human-Like Creative Workflow / kantocv 67th CVPR 2026
shunk031
0
290
Featured
See All Featured
State of Search Keynote: SEO is Dead Long Live SEO
ryanjones
0
270
SERP Conf. Vienna - Web Accessibility: Optimizing for Inclusivity and SEO
sarafernandez
2
1.6k
Improving Core Web Vitals using Speculation Rules API
sergeychernyshev
21
1.6k
HU Berlin: Industrial-Strength Natural Language Processing with spaCy and Prodigy
inesmontani
PRO
0
690
Claude Code どこまでも/ Claude Code Everywhere
nwiizo
67
58k
<Decoding/> the Language of Devs - We Love SEO 2024
nikkihalliwell
1
320
New Earth Scene 8
popppiees
3
2.5k
How to Align SEO within the Product Triangle To Get Buy-In & Support - #RIMC
aleyda
2
1.8k
The Cult of Friendly URLs
andyhume
79
7k
How People are Using Generative and Agentic AI to Supercharge Their Products, Projects, Services and Value Streams Today
helenjbeal
1
310
Building Applications with DynamoDB
mza
96
7.2k
Gemini Prompt Engineering: Practical Techniques for Tangible AI Outcomes
mfonobong
2
520
Transcript
・チップの各コンポーネントを構成要素のグラフとして表現し,こ のグラフを効率的にチップのキャンバス上に配置する方策ネット ワークを訓練する. ・従来のチップ配置では多くが人間の専門家の介入を必要としてい た. ・提案した学習ベース手法では経験を積むことで性能が向上し,新 しいチップ配置を高速に生成できる. ・チップ配置を強化学習問題として扱う新たなアプローチを提案. ・提案手法では過去のチップ配置経験から学習し,未知のチップブ ロックに対して最適化された配置を高速に生成する能力があること
を示した. どんなもの? 先行研究と比べて何がすごい? 技術の手法や肝は? どうやって有効だと検証した? ・実際のAIアクセラレータチップ(Google TPUなど)に対して提案 手法を用いてチップ配置を行い,既存のベースライン(人間の専門 家の配置や他の自動配置ツール)と比較することで検証した. ・配置後のPPA(パワー,パフォーマンス,面積)の最適化を評価し た. Chip Placement with Deep Reinforcement Learning (arXiv 2020) Azalia Mirhoseini et al., Google Research. https://arxiv.org/abs/2004.10746 2024/04/28 論文を表す画像 被引用数:224 1/7
❖ 強化学習エージェントがマクロを一つずつ配置する様子を示す ❖ すべてのマクロ配置後,部品は力学的方法(力指向メソッド)を用い て配置される ➢ 力指向メソッド:互いに関連する部品は近くに配置され,関係のない部品 は離れた場所に配置されるようにすること ❖ 報酬はワイヤ長と輻輳の組み合わせで計算され,エージェントが次の
イテレーションでそのパラメータを最適化するために使用する ➢ ワイヤ長:チップの上で部品をつなぐワイヤの長さを推測する方法 ➢ 輻輳:あるエリア内に多くのワイヤが集中してしまう状態 提案手法 2/7
❖ 電子回路の構成要素 (ネットリスト) をGNNで処理 ❖ エッジ埋め込みの処理 ➢ ネットリスト内の異なるコンポーネント間の接続の強さや特性を表現 ❖ マクロ埋め込みの処理
➢ マクロ(大きな回路要素)の特性をベクトル形式で表現 ❖ 方策ネットワークによる処理 ➢ ネットリストの情報を基に,各マクロの配置における「行動」を選択する 提案手法 3/7
❖ CPUのチップ配置結果を視覚化したもの ➢ 左:事前学習済みの方策ネットワークによるゼロショット配置 ➢ 右:ファインチューニング後の方策ネットワークによる配置 ❖ ファインチューニング後の結果は配置が綺麗に揃っている 実験結果 4/7
❖ 強化学習とSA (焼きなまし法) によるサンプル効率の比較 ❖ ワイヤ長 (Wirelength) と輻輳 (Congestion)は低い方が良い ❖
強化学習を使用した提案手法がSAと比較して最適な配置をしていると 解釈できる 実験結果 5/7
❖ 強化学習を使用したチップ配置の最適化手法を提案した ❖ SA (焼きなまし法) と比較して最適配置を達成した まとめ 6/7
❖ チップにおける最適配置問題を強化学習で解こうとするアイデアが面 白かった ❖ 報酬設計の部分や実装コードがどのようになっているのか理解したい 感想 7/7