Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
NeurIPS 2021 論文読み会: How Modular should Neural M...
Search
Atsushi Takayama
January 25, 2022
Technology
0
130
NeurIPS 2021 論文読み会: How Modular should Neural Module Networks Be for Systematic Generalization?
Atsushi Takayama
January 25, 2022
Tweet
Share
More Decks by Atsushi Takayama
See All by Atsushi Takayama
最高の開発者体験の追求が開発生産性を改善し続ける文化を生み出した話
edvakf
3
1k
8年物のJavaのシステムをKotlinに変えていく選択に至るまで
edvakf
2
1k
ピクシブ社内のImageFlux利用事例紹介
edvakf
1
2.7k
学びの文化を育む社内読書会のススメ
edvakf
0
220
フルCDNアーキテクチャでサービス設計した話
edvakf
5
3.7k
Goでバイナリを読む+α
edvakf
1
890
お前はこれまでに作ったAPIの数を覚えているのか?
edvakf
0
2.4k
「ふつうのRailsアプリケーション」についての考え方
edvakf
2
760
ggplot.galleryというお遊びウェブアプリケーションを作った話
edvakf
0
370
Other Decks in Technology
See All in Technology
ずっと昔に Star をつけたはずの思い出せない GitHub リポジトリを見つけたい!
rokuosan
0
150
20241214_WACATE2024冬_テスト設計技法をチョット俯瞰してみよう
kzsuzuki
3
610
権威ドキュメントで振り返る2024 #年忘れセキュリティ2024
hirotomotaguchi
2
760
スタートアップで取り組んでいるAzureとMicrosoft 365のセキュリティ対策/How to Improve Azure and Microsoft 365 Security at Startup
yuj1osm
0
230
社内イベント管理システムを1週間でAKSからACAに移行した話し
shingo_kawahara
0
190
社外コミュニティで学び社内に活かす共に学ぶプロジェクトの実践/backlogworld2024
nishiuma
0
270
【re:Invent 2024 アプデ】 Prompt Routing の紹介
champ
0
150
マルチプロダクト開発の現場でAWS Security Hubを1年以上運用して得た教訓
muziyoshiz
3
2.4k
なぜCodeceptJSを選んだか
goataka
0
160
非機能品質を作り込むための実践アーキテクチャ
knih
5
1.5k
生成AIのガバナンスの全体像と現実解
fnifni
1
200
Amazon VPC Lattice 最新アップデート紹介 - PrivateLink も似たようなアップデートあったけど違いとは
bigmuramura
0
200
Featured
See All Featured
Bootstrapping a Software Product
garrettdimon
PRO
305
110k
VelocityConf: Rendering Performance Case Studies
addyosmani
326
24k
[Rails World 2023 - Day 1 Closing Keynote] - The Magic of Rails
eileencodes
33
2k
Rails Girls Zürich Keynote
gr2m
94
13k
Designing for Performance
lara
604
68k
[RailsConf 2023 Opening Keynote] The Magic of Rails
eileencodes
28
9.1k
Writing Fast Ruby
sferik
628
61k
個人開発の失敗を避けるイケてる考え方 / tips for indie hackers
panda_program
95
17k
Building Applications with DynamoDB
mza
91
6.1k
Design and Strategy: How to Deal with People Who Don’t "Get" Design
morganepeng
127
18k
Speed Design
sergeychernyshev
25
670
実際に使うSQLの書き方 徹底解説 / pgcon21j-tutorial
soudai
169
50k
Transcript
How Modular should Neural Module Networks Be for Systematic Generalization?
高山温 @ NewsPicks (Uzabase group) NeurIPS 2021 論文読み会 2022/01/25
自己紹介 • Atsushi Takayama / 高山温 • 2020年からNewsPicksでCTOをしていまし たが、今年からFellowしてます ◦
データ基盤、データ分析、レコメンドエンジン、検 索エンジンなどのチームを率いています • 大学中退 → 大学院中退 → 大学院生(イマココ) ◦ 元々物理をやっていましたが、今はコンピュータサ イエンスを勉強中 • 宣伝: ユーザベースはエンジニアの多様な キャリアと多様な成長を応援する会社です
Table of Contents • VQAとは • この研究の位置付け • 研究内容 •
結果 • 所感
VQA (Visual Question Answering) • since 2015 ◦ 画像を与えられて質問に答える問題 •
2021年に人間並みの精度になった ◦ Microsoft, Alibabaなど ▪ pre-trained attention-based models 人間 95.49 80.84 67.89 80.78
この研究の位置付け 1 • SOTAとは別方向で、「少ない例で学習して、 どれだけ類似の質問に答えられるか」という 問題設定がある • 右のような例で、人間なら少し学習しただけ で類似の質問にも答えられる ◦
Systematic Generalizationという
この研究の位置付け 2 NMN: Neural Modular Networks 質問文をパースしてネットワークを構築 →少し学習しただけでそこそこ強い FiLM: End-to-Endで微分可能なネットワーク
→大量に学習しないと強くない
この研究の位置付け 3 • NMNを詳しく研究したら何かおもしろいことがわかるのでは? ◦ 例えば、End-to-Endのモデルで「質問文の構造」を学習するような機構を取り入れられな いか、とか ◦ VQAだけでなく画像認識でも Systematic
Generalizationを上げるにはどうすればいい か、とか
• 下のような画像と質問1〜3があるとする ◦ 1と2は色に関する質問、 3は文字に関する質問 • 論文のタイトル “How Modular Should
Neural Networks Be” は次 のようなイメージ ◦ 左: 全部の質問に対応できるネットワークを学習する (最もModularityが低い) ◦ 中央: 色とカテゴリーというグループごとにネットワークを学習する ◦ 右: 各質問ごとに別々のネットワークを学習する (最もModularityが高い) 研究内容 1
研究内容 2 • 少し複雑な質問でも、同様にsub-taskに分解して、Modularityが高い ネットワークから低いネットワークまでのパターンを作る
結果 1 • グラフ(a)〜(d) ◦ 質問の種類 • 横軸 ◦ 全体の何割のデータで学
習したか • 縦軸 ◦ 学習に登場しなかった類 似の質問の正答率 • 4色のバー ◦ 右に行くにつれて Modularityが高い
結果 2 • 他にも色んなデータセットで検証 • やっぱりModularityは効く (結果は割愛)
所感 • ここまで書いていて、富士通さんのテックブ ログに解説が載ってるのに気づきました • 実はまったく知らない分野でしたが、締め切 り駆動で10本ぐらい読んでみると多くのこと が学べました。誘っていただき感謝 https://blog.fltech.dev/entry/2021/12/09/neurips2021-ja