Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Sign up for free
Menu
Search
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Pricing
Search
Sign in
Sign up for free
論文紹介:Language Model Inversion
Search
Toma Tanaka
December 18, 2023
Technology
340
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
論文紹介:Language Model Inversion
Toma Tanaka
December 18, 2023
More Decks by Toma Tanaka
See All by Toma Tanaka
2026年度 人工知能学会全国大会「AIおよび機械学習分野における継続運用のための 自動研究システムの開発」
fuyu_quant0
3
840
AI研究の自動化に向けたOSSの開発
fuyu_quant0
0
220
大規模言語モデルの論理構造の把握能力と予測モデルの生成
fuyu_quant0
0
260
Evolutionary Optimization of Model Merging Recipes
fuyu_quant0
4
2.9k
Inductive-bias Learning: 大規模言語モデルによる予測モデルの生成
fuyu_quant0
0
280
Solving olympiad geometry without human demonstrations
fuyu_quant0
4
810
量子コンピュータとデータサイエンティスト
fuyu_quant0
0
480
スライド用GPTを使った 「量子コンピュータ」の スライド作成
fuyu_quant0
0
35k
Other Decks in Technology
See All in Technology
オブザーバビリティを高める AI エージェント体験を考える / Designing AI Agent Experiences That Enhance Observability
aoto
PRO
2
300
[2026 Oracle Technical Deep Dive] Apache Iceberg × Oracle AI Database -Oracle Autonomous AI Lakehouseが実現するAI時代のデータ基盤- (2026年9月17日開催)
oracle4engineer
PRO
0
110
全人類(ほぼ)AWS Organizations の上でAWSを利用している、その世界を知る話
htan
0
110
使いこなすために知っておきたい Azure SRE Agent アンチパターン
torumakabe
2
340
The seven pitfalls of AI (revised version)
ufried
0
260
SREでアラート疲れを 解決しよう!
kairim0
1
200
AI時代に必要な脅威モデリング― 変化の速度に負けない理解とリスク判断
masakane55
4
950
自主式軟體工廠
philipz
0
220
[2026 Oracle Technical Deep Dive] AI時代のデータベース基盤をどう選ぶ? Exadata Database Serviceの選択肢と使い分け (2026年9月17日開催)
oracle4engineer
PRO
0
220
生成AIと進める探索的データ分析(2026.10.03 第122回Tokyo.R勉強会)
tatamiya
2
1.4k
[2026 Oracle Technical Deep Dive] AI時代のアプリケーションを支えるCloud NativeとJava EEモダナイゼーション (2026年9月17日開催)
oracle4engineer
PRO
0
120
オンラインゲームのシステム全体像 - コロプラ 2026年度 新卒研修
colopl
0
450
Featured
See All Featured
Code Review Best Practice
trishagee
74
20k
ReactJS: Keep Simple. Everything can be a component!
pedronauck
666
130k
Helping Users Find Their Own Way: Creating Modern Search Experiences
danielanewman
31
3.4k
StorybookのUI Testing Handbookを読んだ
zakiyama
31
7k
Highjacked: Video Game Concept Design
rkendrick25
PRO
1
470
Navigating the Design Leadership Dip - Product Design Week Design Leaders+ Conference 2024
apolaine
2
460
The SEO Collaboration Effect
kristinabergwall1
1
590
GraphQLの誤解/rethinking-graphql
sonatard
75
12k
GitHub's CSS Performance
jonrohan
1033
470k
Evolution of real-time – Irina Nazarova, EuRuKo, 2024
irinanazarova
9
1.6k
Designing for humans not robots
tammielis
254
26k
Crafting Experiences
bethany
1
370
Transcript
田中 冬馬
株式会社ブレインパッド データサイエンティストとしてマーケティング分析,広告文の自動生成などの自然 言語処理の業務に従事 Autores 松尾研究室の研究の自動化プロジェクト その他の活動 LLM 関連で論文執筆 Inductive-bias Learning:
Generating Code Models with Large Language Model Data Science wiki データ分析手法,AI 関連の技術に関する民主化を目指しているサイトの作成 Qiita の執筆 LLM のプロンプト技術まとめ 自己紹介
LLM Input Output 論文紹介:Language Model Inversion 論文:https://arxiv.org/abs/2311.13647 LLM の出力から入力プロンプトを復元する技術 復元
LLM とは Large Language Model( 大規模言語モデル) のこと Transoformer というアーキテクチャが使われているディープラーニングのモデル であり,ChatGPT
のサービスで使われているGPT-4 やGPT-3.5-turbo などの総称
私 は AI で す LLM の入出力 LLM のベースは Transformer
decoder
私 は X1 x2 x3 p(x1 |私,は) = 猫 天才
だ で す AI し を ・ ・ ※厳密に条件付き確率を計算しているわけではなく 確率値を返すような関数を近似したものです の中身の合計は1 ( 確率なので) 0.001 0.0004 0.0...1 0.0...3 0.0...4 0.01 0.0...2 0.0...7 ・ ・ ← 最も高い はモデルが出力で きる全トークン数 のベクトル ※ トークン... 文章を分割する際の最小単位 (LLM を作成する際に決めている) ※GPT-4 は約50,000 のトークン数で表現 BPE という手法を使っている
私 は AI x2 x3 p(x2 |私,は,AI) = 猫 天才
だ で す AI し を ・ ・ 0.0...8 0.0...5 0.0001 0.003 0.0...4 0.0...1 0.0...2 0.0007 ・ ・ ← 最も高い
私 は AI で x3 p(x3 |私,は,AI ,で) = 猫
天才 だ で す AI し を ・ ・ 0.0...2 0.0...1 0.0...1 0.0...3 0.004 0.0...6 0.002 0.0..7 ・ ・ ← 最も高い
私 は AI で す LLM は確率分布を出力し 最も確率値が高い言葉( トークン) を選び続けて文章生成が行われる
→入力された文章の情報が確率分布に残されていれば復元できる ※ 温度パラメータが0 の場合 最も確率値が高いもの以外を選ぶ方法もある
機械学習を勉強するのが好き LLM 確率分布 です 機械学習を学ぶのが好き LLM 確率分布 です 検証 異なるか
文章の一部を類似している言葉に置き換えLLM に入力した時の確率分布を比較する
KL ダイバージェンス... 確率分布全体の形状はそこまで差がない 似ている文章を入力しているため当然 ハミング距離... 何単語後も正確に確率分布が一致しているわけではない 最初の入力の違いがずっと伝播している 確率分布のKL ダイバージェンスとハミング距離を比較 検証
確率値から文章を復元するモデルを学習 確率分布の数値から文章を再現するモデルを学習( 赤い部分) モデルのベースはT5 を使ったそうです
実験結果 元の入力した文章をある程度再現できている
まとめ 論文:Language Model Inversion LLM の出力の確率分布には今まで入力された文章の情報が含まれている 確率分布だけから元の入力を再現することができる 今回説明していないが論文で説明されていたこと 確率分布が分からなくても何度か出力が得られれば確率分布を再現できる. つまり,文章の出力しかなくても入力情報を再現できる
社会的な意義 LLM の出力だけから元の入力を再現できるため,セキュリティやプライバシーの 観点でも検討する必要がある
ご清聴ありがとうございました