Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
ローカル大規模言語モデル いまどこまで動く? 2026年6月版
Search
ayane
July 08, 2026
Technology
43
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
ローカル大規模言語モデル いまどこまで動く? 2026年6月版
2026年6月18日のGenAIge Cafe #8「
https://genaige.connpass.com/event/396761/
」で話した資料です
ayane
July 08, 2026
More Decks by ayane
See All by ayane
GenAIge Cafe #10 生成AIとここまで、これから。
blueb
0
26
GenAIge Cafe #9 - AIエージェントって何?
blueb
0
57
えっ___まだ生成AIを24時間動かしてないんですか_.pdf
blueb
0
150
GenAIge_cafe__4_1年前のAI_覚えてますか_.pdf
blueb
0
150
GenAIge Cafe #3 : 5分でわかる 最近のAI動向ミニニュース(2025年12月)
blueb
0
39
AGI福岡第8回_NotebookLMの動画解説機能で_この1年を振り返るLT用動画を作ってみた_.pdf
blueb
0
230
GenAI Cafe#2:最近のAI動向情報(5分ミニトーク)
blueb
0
52
AIミートアップ by ayatabi.net vol.2 at CIC Fukuoka
blueb
0
44
第5回_ぬか炊きLT-AI時代の夏の自由研究
blueb
0
77
Other Decks in Technology
See All in Technology
会社紹介資料 / Sansan Company Profile
sansan33
PRO
24
430k
Flutter × BLE Centralを自前Pluginで実装する設計パターン - MethodChannel / EventChannelで作る双方向ブリッジの実践 / Building Custom Flutter BLE Central Plugins: Bidirectional Bridging with Method & Event Channels
bitkey
PRO
0
170
AIにブラウザを触らせて、E2EテストをPlaywrightで書く
koji_kawamura
0
170
JavaScript 研修 (2026)
recruitengineers
PRO
2
660
AI開発に用いられるHPC技術について
gpuunite_official
0
150
LLM Internals: 언어 모델의 계보와 알고리즘 진화 (2023~2026)
inureyes
PRO
1
780
Genie Codeハンズオン応用編
taka_aki
0
130
Bill One 開発エンジニア 紹介資料
sansan33
PRO
7
20k
Kiro入門|仕様駆動開発で変わるAI時代の開発スタイル
cmkudo
0
220
DDDのエッセンスを取り入れたAIでの開発
ak2ie
0
160
研究開発部の紹介 / Sansan R&D Profile
sansan33
PRO
4
24k
国家プロジェクトを支える「さくらONE」 大規模LLM開発におけるGPU障害を乗り越えるクラスター運用戦略
gpuunite_official
0
120
Featured
See All Featured
Java REST API Framework Comparison - PWX 2021
mraible
34
9.7k
Why You Should Never Use an ORM
jnunemaker
PRO
61
10k
Helping Users Find Their Own Way: Creating Modern Search Experiences
danielanewman
31
3.3k
Information Architects: The Missing Link in Design Systems
soysaucechin
1
1.1k
Design of three-dimensional binary manipulators for pick-and-place task avoiding obstacles (IECON2024)
konakalab
0
550
Bioeconomy Workshop: Dr. Julius Ecuru, Opportunities for a Bioeconomy in West Africa
akademiya2063
PRO
1
260
The Pragmatic Product Professional
lauravandoore
37
7.4k
Ruling the World: When Life Gets Gamed
codingconduct
0
300
Refactoring Trust on Your Teams (GOTO; Chicago 2020)
rmw
35
3.8k
The Cult of Friendly URLs
andyhume
79
7k
Paper Plane
katiecoart
PRO
2
53k
Leveraging Curiosity to Care for An Aging Population
cassininazir
1
470
Transcript
ローカル⼤規模⾔語モデル いまどこまで動く? ⼿元のパソコンで⽣成AIを動かすための、 ざっくり現実ライン(2026年6⽉版) 2026年6⽉18⽇ GenAIge Cafe #8 綾祢
まず結論!「動くか」から「快適か」の時代へ ⼩さめモデル 個⼈のパソコンでも現実的に動き ます。「動くかどうか」から「快 適か」を楽しむ時代へ。 カギは「ビデオメモリ」 気持ちよく使うにはグラフィック 処理装置のメモリが重要! 2026年6⽉は24GB〜32GBが実⽤ ラインです。
巨⼤モデルは別世界 とても⼤きなモデルは、個⼈⽤パ ソコンというより⾼性能ワークス テーションやサーバーの世界で す。
「ローカル⼤規模⾔語モデル」とは? インターネットの向こう側(クラウド)ではなく、⼿元のパソコン で直接動かす⽣成AIのことです。 メリット インターネットに繋がっていなくても試せる(場合があ る)。⾃分のデータを外に出さずに遊べる。 注意点 パソコン側に「がんばる⼒」が必要。また、使い⽅次第 で安全性は変わるため「必ず安全」とは限りません。
なぜ「ビデオメモリ」が⼤事なの? 「パソコン本体のメインメモリが24GBあればいい」…というわけ ではありません! ビデオメモリ グラフィック処理装置の専⽤メモリ。 例え:「机の上の作業スペース」(超⾼速!) メインメモリ パソコン本体のメモリ。 例え:「部屋の作業台」(机よりは遅い) ストレージ
保存場所。 例え:「本棚」(しまう場所)
2026年6⽉時点の、現実的な3つの層 モデルの規模 (例え:本の厚さ) ⽬安 必要なビデオメモリ感 初⼼者向けの理解 7B 〜 8B 前後
⼩さめ 6GB〜8GBから動き始める (12GB〜16GBあると安⼼) まず試すならここ! 24B 〜 32B 前後 中くらい 24GB〜32GBが実⽤ライン かなり実⽤的で⾯⽩い 70B 以上 ⼤きい 48GB〜80GB以上など (または複数台の連携が必要) 個⼈の趣味を超え、 ワークステーションやサーバー寄り
⽇本語でゆるく試すなら、この3つ! Qwen 3 系 公式情報で、119の⾔語と⽅⾔を サポート。多⾔語に強いモデルと して世界的に⼈気です。 Gemma 4 系
公式情報で140以上の⾔語をサ ポート。様々なサイズがあり、環 境に合わせて選びやすいです。 Mistral Small 3.2 公式のモデル説明で「⽇本語対 応」を明記。中くらいのサイズ で、バランスの良さが光ります。
どんなパソコンなら楽しめる?(ざっくり⽬安) ※情報を少し圧縮して軽くする「4ビット量⼦化」を⾏った場合の⽬安です。利⽤ソフト等で快適さは変わります。 1 まず試す ⼩さめのモデル(7B〜 8B)を⼿元で動かして みる⼊⾨編。 2 ちゃんと楽しむ ⼩さめモデルは快適。
中くらい(24B前後) も⼯夫次第で試せま す。 3 本格的に遊ぶ Gemma 4 26B A4B QATなど中くらいが視 野に。例: RTX 4090, RTX 5090等 4 別世界‧⼤型 70B以上や、複雑な専 ⾨家連携モデル向け。 例: Radeon PRO W7900等
⼀次情報URL⼀覧 モデル公式‧モデルカード 実⾏環境‧量⼦化 / ハードウェア仕様 Meta Llama 4 公式ブログ https://ai.meta.com/blog/llama-4-multimodal-intelligence/
Llama 3.1 8B Instruct model card https://huggingface.co/meta-llama/Llama-3.1-8B-Instruct Llama 3.3 70B Instruct model card https://huggingface.co/meta-llama/Llama-3.3-70B-Instruct Mistral Small 3.2 24B https://huggingface.co/mistralai/Mistral-Small-3.2-24B-Instruct-2506 Gemma 4 26B A4B https://huggingface.co/google/gemma-4-26B-A4B Gemma 4 26B A4B QAT https://lmstudio.ai/models/google/gemma-4-26b-a4b-qat Qwen 3 公式ブログ https://qwenlm.github.io/blog/qwen3/ Qwen3.6 27B https://huggingface.co/Qwen/Qwen3.6-27B Qwen3 30B-A3B model card https://huggingface.co/Qwen/Qwen3-30B-A3B llama.cpp 公式GitHub https://github.com/ggml-org/llama.cpp vLLM hardware support https://docs.vllm.ai/en/v0.9.2/features/quantization/supported_hardware.html Transformers bitsandbytes docs https://huggingface.co/docs/transformers/quantization/bitsandbytes PyTorch Gemma 3 27B INT4 benchmark https://huggingface.co/pytorch/gemma-3-27b-it-INT4 NVIDIA Llama 3.1 8B ONNX INT4 page https://huggingface.co/nvidia/Meta-Llama-3.1-8B-Instruct-ONNX-INT4 Ollama MLX performance https://ollama.com/blog/mlx-performance NVIDIA GeForce RTX 4090 specs https://www.nvidia.com/en-us/geforce/graphics-cards/40-series/rtx-4090/ AMD Radeon PRO W7900 specs https://www.amd.com/en/products/graphics/workstations/radeon-pro/w7900.html NVIDIA ⽐較 GeForce グラフィックス カード https://www.nvidia.com/ja-jp/geforce/graphics-cards/compare/