Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Sign up for free
Menu
Search
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Pricing
Search
Sign in
Sign up for free
ローカル大規模言語モデル いまどこまで動く? 2026年6月版
Search
ayane
July 08, 2026
Technology
53
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
ローカル大規模言語モデル いまどこまで動く? 2026年6月版
2026年6月18日のGenAIge Cafe #8「
https://genaige.connpass.com/event/396761/
」で話した資料です
ayane
July 08, 2026
More Decks by ayane
See All by ayane
GenAIge Cafe #11|AIが止まったら、あなたはどうしそう?
blueb
0
21
Hermes Agentで、AIが調べて記事を書くブログを作った話
blueb
0
110
GenAIge Cafe #10 生成AIとここまで、これから。
blueb
0
52
GenAIge Cafe #9 - AIエージェントって何?
blueb
0
79
えっ!?まだ生成AIを24時間動かしてないんですか?
blueb
0
160
GenAIge cafe 4 :1年前のAI_覚えてますか
blueb
0
160
GenAIge Cafe #3 : 5分でわかる 最近のAI動向ミニニュース(2025年12月)
blueb
0
43
NotebookLMの動画解説機能で_この1年を振り返るLT用動画を作ってみた
blueb
0
240
GenAI Cafe#2:最近のAI動向情報(5分ミニトーク)
blueb
0
54
Other Decks in Technology
See All in Technology
AIエージェントを安全で速い現場監督にする:Jev・Obsidian・メタハーネス
x5gtrn
PRO
0
110
開発投資の期待値を上げるプロダクトロードマップづくり ~プロダクトエンジニアが越境して事業を伸ばす~
kekekenta
1
250
C#未経験の僕がAIに読めるコードを書かせるまで
maguroalternative
0
290
AIに書かせて、プラットフォームで縛る ― EKSプラットフォームで実践した責任境界と権限設計
elmodev09
0
480
Vibe Coding で作ったプロダクトをどう安全に動かすか / How to Safely Run Products Built with Vibe Coding
glidenote
0
570
Oracle Base Database Service 技術詳細
oracle4engineer
PRO
16
120k
CI/CDではもう遅い - 人とAIが迂回しないDevSecOps Verify基盤の再設計 -
kintotechdev
0
190
あけおめLINE 傾向とその対策
nasa9084
0
330
Genieを崇めよ
kameitomohiro
0
170
ボードゲームの遊び相手をFoundation Modelsで作る / iOSDC Japan 2026
genda
0
180
ほんとうの信頼性はヒーローが死んでからはじまる / True reliability begins after the hero dies
vtryo
0
120
AI 時代のスタートアップエコシステ厶から考究する技術的負債との向き合い方
m3m0r7
PRO
3
2.7k
Featured
See All Featured
The browser strikes back
jonoalderson
0
1.7k
Discover your Explorer Soul
emna__ayadi
2
1.3k
SEO in 2025: How to Prepare for the Future of Search
ipullrank
3
3.8k
A Guide to Academic Writing Using Generative AI - A Workshop
ks91
PRO
1
490
Getting science done with accelerated Python computing platforms
jacobtomlinson
2
480
Designing Experiences People Love
moore
143
24k
[Rails World 2023 - Day 1 Closing Keynote] - The Magic of Rails
eileencodes
38
3k
Typedesign – Prime Four
hannesfritz
42
3.2k
16th Malabo Montpellier Forum Presentation
akademiya2063
PRO
0
390
Keith and Marios Guide to Fast Websites
keithpitt
413
23k
Navigating Team Friction
lara
192
16k
Primal Persuasion: How to Engage the Brain for Learning That Lasts
tmiket
0
490
Transcript
ローカル⼤規模⾔語モデル いまどこまで動く? ⼿元のパソコンで⽣成AIを動かすための、 ざっくり現実ライン(2026年6⽉版) 2026年6⽉18⽇ GenAIge Cafe #8 綾祢
まず結論!「動くか」から「快適か」の時代へ ⼩さめモデル 個⼈のパソコンでも現実的に動き ます。「動くかどうか」から「快 適か」を楽しむ時代へ。 カギは「ビデオメモリ」 気持ちよく使うにはグラフィック 処理装置のメモリが重要! 2026年6⽉は24GB〜32GBが実⽤ ラインです。
巨⼤モデルは別世界 とても⼤きなモデルは、個⼈⽤パ ソコンというより⾼性能ワークス テーションやサーバーの世界で す。
「ローカル⼤規模⾔語モデル」とは? インターネットの向こう側(クラウド)ではなく、⼿元のパソコン で直接動かす⽣成AIのことです。 メリット インターネットに繋がっていなくても試せる(場合があ る)。⾃分のデータを外に出さずに遊べる。 注意点 パソコン側に「がんばる⼒」が必要。また、使い⽅次第 で安全性は変わるため「必ず安全」とは限りません。
なぜ「ビデオメモリ」が⼤事なの? 「パソコン本体のメインメモリが24GBあればいい」…というわけ ではありません! ビデオメモリ グラフィック処理装置の専⽤メモリ。 例え:「机の上の作業スペース」(超⾼速!) メインメモリ パソコン本体のメモリ。 例え:「部屋の作業台」(机よりは遅い) ストレージ
保存場所。 例え:「本棚」(しまう場所)
2026年6⽉時点の、現実的な3つの層 モデルの規模 (例え:本の厚さ) ⽬安 必要なビデオメモリ感 初⼼者向けの理解 7B 〜 8B 前後
⼩さめ 6GB〜8GBから動き始める (12GB〜16GBあると安⼼) まず試すならここ! 24B 〜 32B 前後 中くらい 24GB〜32GBが実⽤ライン かなり実⽤的で⾯⽩い 70B 以上 ⼤きい 48GB〜80GB以上など (または複数台の連携が必要) 個⼈の趣味を超え、 ワークステーションやサーバー寄り
⽇本語でゆるく試すなら、この3つ! Qwen 3 系 公式情報で、119の⾔語と⽅⾔を サポート。多⾔語に強いモデルと して世界的に⼈気です。 Gemma 4 系
公式情報で140以上の⾔語をサ ポート。様々なサイズがあり、環 境に合わせて選びやすいです。 Mistral Small 3.2 公式のモデル説明で「⽇本語対 応」を明記。中くらいのサイズ で、バランスの良さが光ります。
どんなパソコンなら楽しめる?(ざっくり⽬安) ※情報を少し圧縮して軽くする「4ビット量⼦化」を⾏った場合の⽬安です。利⽤ソフト等で快適さは変わります。 1 まず試す ⼩さめのモデル(7B〜 8B)を⼿元で動かして みる⼊⾨編。 2 ちゃんと楽しむ ⼩さめモデルは快適。
中くらい(24B前後) も⼯夫次第で試せま す。 3 本格的に遊ぶ Gemma 4 26B A4B QATなど中くらいが視 野に。例: RTX 4090, RTX 5090等 4 別世界‧⼤型 70B以上や、複雑な専 ⾨家連携モデル向け。 例: Radeon PRO W7900等
⼀次情報URL⼀覧 モデル公式‧モデルカード 実⾏環境‧量⼦化 / ハードウェア仕様 Meta Llama 4 公式ブログ https://ai.meta.com/blog/llama-4-multimodal-intelligence/
Llama 3.1 8B Instruct model card https://huggingface.co/meta-llama/Llama-3.1-8B-Instruct Llama 3.3 70B Instruct model card https://huggingface.co/meta-llama/Llama-3.3-70B-Instruct Mistral Small 3.2 24B https://huggingface.co/mistralai/Mistral-Small-3.2-24B-Instruct-2506 Gemma 4 26B A4B https://huggingface.co/google/gemma-4-26B-A4B Gemma 4 26B A4B QAT https://lmstudio.ai/models/google/gemma-4-26b-a4b-qat Qwen 3 公式ブログ https://qwenlm.github.io/blog/qwen3/ Qwen3.6 27B https://huggingface.co/Qwen/Qwen3.6-27B Qwen3 30B-A3B model card https://huggingface.co/Qwen/Qwen3-30B-A3B llama.cpp 公式GitHub https://github.com/ggml-org/llama.cpp vLLM hardware support https://docs.vllm.ai/en/v0.9.2/features/quantization/supported_hardware.html Transformers bitsandbytes docs https://huggingface.co/docs/transformers/quantization/bitsandbytes PyTorch Gemma 3 27B INT4 benchmark https://huggingface.co/pytorch/gemma-3-27b-it-INT4 NVIDIA Llama 3.1 8B ONNX INT4 page https://huggingface.co/nvidia/Meta-Llama-3.1-8B-Instruct-ONNX-INT4 Ollama MLX performance https://ollama.com/blog/mlx-performance NVIDIA GeForce RTX 4090 specs https://www.nvidia.com/en-us/geforce/graphics-cards/40-series/rtx-4090/ AMD Radeon PRO W7900 specs https://www.amd.com/en/products/graphics/workstations/radeon-pro/w7900.html NVIDIA ⽐較 GeForce グラフィックス カード https://www.nvidia.com/ja-jp/geforce/graphics-cards/compare/