Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Sign up for free
Menu
Search
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Pricing
Search
Sign in
Sign up for free
【論文解説】KAN: Kolmogorov-Arnold Networks
Search
Sponsored
·
Your Podcast. Everywhere. Effortlessly.
Share. Educate. Inspire. Entertain. You do you. We'll handle the rest.
→
tamoharu
June 11, 2024
Research
1.1k
1
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
【論文解説】KAN: Kolmogorov-Arnold Networks
KANの理論的な解説を簡単にまとめました
tamoharu
June 11, 2024
Other Decks in Research
See All in Research
JICA QUEST 共創×革新プログラム Impact Report(海ノ向こうコーヒー)
ontheslope
0
560
Cross-Media Human-Information Interaction
signer
PRO
0
230
AIエージェント時代のLLM-jpモデルのあるべき姿
k141303
0
620
Sleuthcon Keynote - How Cybercriminals (ab)use AI
fr0gger
0
320
クラウド・AI 時代の研究開発 DX / R&D Digital Transformation
hariby
0
140
「AIとWhyを深堀る」をAIと深堀る
iflection
0
610
[Fishers] DIVER OSINT CTF 2026 特化AIエージェントハーネスで挑戦するOSINT CTF
analokmaus
0
560
Apache Gravitinoで実現する Icebergカタログ統合とアクセスの一元化
matsumooon
0
500
多様なデータを許容し学習し続ける模倣学習 / Advanced Imitation Learning for VLA
prinlab
0
300
SAKURAONE:An Open Ethernet-based AI HPC System And Its Observed Workload Dynamicsin a Single-Tenant LLM Development Environment
yuukit
1
590
最先端NLP勉強会2026 論文紹介:Reasoning with Sampling: Your Base Model is Smarter Than You Think (ICLR 2026 paper)
kogoro
4
600
PGDM: Physically Guided Diffusion Model for L Downscaling
satai
3
470
Featured
See All Featured
Reflections from 52 weeks, 52 projects
jeffersonlam
356
21k
Why Our Code Smells
bkeepers
PRO
340
58k
From π to Pie charts
rasagy
0
360
Leveraging Curiosity to Care for An Aging Population
cassininazir
1
490
Design and Strategy: How to Deal with People Who Don’t "Get" Design
morganepeng
133
19k
DevOps and Value Stream Thinking: Enabling flow, efficiency and business value
helenjbeal
1
380
The #1 spot is gone: here's how to win anyway
tamaranovitovic
3
1.2k
Lightning Talk: Beautiful Slides for Beginners
inesmontani
PRO
2
680
Leo the Paperboy
mayatellez
9
2.3k
Introduction to Domain-Driven Design and Collaborative software design
baasie
1
980
First, design no harm
axbom
PRO
2
1.3k
How to make the Groovebox
asonas
2
2.4k
Transcript
KAN: Kolmogorov-Arnold Networks ⽥本 晴輝 京都⼤学 理学部 3年
Kolmogorov-Arnold表現定理を背景に、従来の 多層パーセプトロン(MLP)に変わる新たな ニューラルネットワークを提案。 MLPはエッジの線形変換を学習するのに対して、 KANはエッジの⾮線形変換を学習する。 概要 ポイント • 微分⽅程式を解くタスクにおいてMLPに対して 100倍のパラメータ効率を達成
→ 次元の呪いを克服 (?) • ⾮線形変換を学習するため、解釈可能性に 優れる → ブラックボックス化の解消 MLP KAN
ニューラルネットワークとは? 𝒙 𝒚 𝒇 ⼊⼒ 出⼒ NN • ⼊⼒を受け取って出⼒を計算するモデルである。 •
データから“学習”することによって理想的な関数 に近似する → 連続関数を表現できればNNを構築できるのでは? 普遍性定理 Kolmogorov-Arnold表現定理 MLP KAN • 線形変換 𝐰 と特定の⾮線形変換 𝜎 を組み合わせ ることで任意の連続関数を近似できるという定理 • 𝐰 はエッジの線形変換、 𝜎 はノードの活性化関数 に相当 • 1変数連続関数 Φ, 𝜙 の重ね合わせによって任意の 多変数連続関数を完全に表現できるという定理 • Φ, 𝜙 はエッジの⾮線形変換、Σはノードの加算操作 に相当 (従来のNN)
1. 各変数 𝑥! に対してn個の内部関数 𝜙",! 𝑥! を作⽤させる 2. その結果を各 𝑞
について⾜し合わせる 3. 内部関数の和を 2n + 1 個の外部関数 Φ" にそれぞれ⼊⼒ 4. 最後にその結果を全て⾜し合わせる KANの理論 式の⾒⽅ これは2層のKANに相当する Kolmogorov-Arnold表現定理 KANへの拡張 外部関数を多層に重ね合わせることでMLPの強みを取り⼊れることに成功し、表現⼒が⾶躍的に向上した。 1層⽬ 2層⽬ ここが本論⽂の新規性! しかし、実際はあまり上⼿くいかなかった… 2層⽬ 1層⽬ 任意の多変数連続関数は1変数連続関数から構成できる
sin π𝑥 𝑦$ exp • + exp sin π𝑥 +
𝑦$ の学習例 解釈可能性 • 学習後に重要でないノードを刈り 取った結果を描画している。 • 𝑥, 𝑦 の⼊⼒から出⼒までの計算過程 が⾒事に可視化されている。 忘却の回避 • KANはデータを新たに与えても以前 の学習過程が保存されている • MLPでは追加学習によって既存の 情報が書き換えられてしまうが、 KANはその局所性によって遠くの 情報は保持される
まとめ • KANは関数近似タスクにおいてMLPを⼤きく上回る結果を出した • 現実世界のタスクでも上⼿くいくかどうかは検証の余地あり • その他にも、MLPが抱える問題を解決しうる期待感がある