Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Sign up for free
Menu
Search
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Pricing
Search
Sign in
Sign up for free
20260930_Gemma4_Hands-on
Search
tsho
September 30, 2026
Technology
110
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
20260930_Gemma4_Hands-on
tsho
September 30, 2026
More Decks by tsho
See All by tsho
Benchmarking Vector Databases: pgvector vs. LanceDB
tsho
0
170
Google IO 2026で進化をとげた Google AI Studio
tsho
0
31
20260321_エンベディングってなに?RAGってなに?エンベディングの説明とGemini Embedding 2 の紹介
tsho
0
280
AI Agentにおける評価指標とAgent GPA
tsho
1
570
Scale SciPy with jax.shard_map - jax.shard_mapで SciPy をスケール
tsho
0
170
Developer Advocate / Community Managerなるには?
tsho
0
880
25/04/12 - Build with AI Hands-on Appendix
tsho
1
110
Unit testしてますか?
tsho
1
700
Other Decks in Technology
See All in Technology
20260929_AmazonGuardDutyの検出通知メールにAWS DevOpsAgentの調査結果を追加する
yhana
1
360
PQC移行の今 -- IETF からみた現在地
satokan
4
620
Kiro Meetup #8 Kiro アップデート (2026/3/21〜2026/9/24)
katzueno
1
300
Goodbye ShellScript, Hello File-based App
shunsock
0
1.3k
Antigravity SDK for the Java Developer
glaforge
0
230
The kernel report
ennael
PRO
1
130
TiDBファミリーにDWHが新登場!! TiDB最新情報 / TiDB update 202609
yoshiakiyamasaki
0
150
音声コミュニティを守るAI監視基盤_ 90%以上の入力削減を支えたServerless設計と運用判断
shuheioka123
0
110
Azure Serverless 2026:Production-ready な AI エージェント基盤 / Azure Serverless 2026: Production-Ready AI Agent Platform
miyake
2
660
Swap and Memory Reclaim - Squeezing Out More RAM
ennael
PRO
1
850
AIに賢く動いてもらうためのコンテキスト〜Snowflake女子会 vol.8
snowwmn0824
0
200
猫でもわかるKiro Web
kentapapa
1
150
Featured
See All Featured
Prompt Engineering for Job Search
mfonobong
0
460
From Legacy to Launchpad: Building Startup-Ready Communities
dugsong
0
340
sira's awesome portfolio website redesign presentation
elsirapls
0
430
Navigating Weather and Climate Data
rabernat
0
540
A Guide to Academic Writing Using Generative AI - A Workshop
ks91
PRO
1
500
AI Search: Where Are We & What Can We Do About It?
aleyda
0
8k
Why Our Code Smells
bkeepers
PRO
340
58k
svc-hook: hooking system calls on ARM64 by binary rewriting
retrage
2
590
Getting science done with accelerated Python computing platforms
jacobtomlinson
2
490
Designing Powerful Visuals for Engaging Learning
tmiket
1
580
Thoughts on Productivity
jonyablonski
76
5.4k
How to build a perfect <img>
jonoalderson
1
6k
Transcript
Gemma 4 でローカルLLMハンズオン in 大阪 DevFest Meetup #3
tsho / 田中 翔 (Sho Tanaka) - Lead Developer Advocate
@ Snowflake - ex-Google gTech Ads, ML/Data MLOps community 運営 Google Developer Expert, AI/ML. TPU Builder OSS conf 登壇 (AI/ML/Data) (一部予定) - Devoox, SciPy Conf, PyCon Gr, TW, Apache Code over Community etc Linkedin.com/in/tsho
ローカルLLMとは?
ローカル LLMとは? ローカルLLMとは、LLMのモデル本体や重みを自分のPC・サーバーなどに保 存し、クラウドAPIへプロンプトを送信せず、手元のマシン上で推論(文章生成 など)を実行できるLLMのこと Source: xxxxx
ローカル LLM の定義比較 用語 重みの公開 学習データ・コード 商用利用・用途制限 原則公開 データ情報・完全な学 習
/ 推論コード等が 必要 原則として任意目的 で利用可能(ライセン ス条件あり) Open Weight Model 公開 非公開または一部公 開が多い モデルごとに異なる。 商用利用や用途制限 があり得る Open Data 付き Open Weight Model 原則公開 学習データは公開、 ソースは非公開 Open Source Model モデルによる 一部引用: ローカルLLMでどこまでコードが書けるか -LLM基礎知識
昨今のローカル LLM 需要急増の背景 1 (個人的な感想 ) 引用 https://news.yahoo.co.jp/expert/article s/d32796504b93fb1c462ad699724f70 6aed402cfb
昨今のローカル LLM 需要急増の背景 2 (個人的な感想 ) 引用 https://www.cnbc.com/2026/07/07/chinese-ai-models-costs-us-openai-anthro pic.html
まとめ:ローカル LLM のメリット コスト管理 セキュリティ 減価償却 vs 従量課金
/定額 ・学習データに使われない 設備投資による計画的な減価償却と、 従量課金リスクの回避・コスト予測可 能性の向上。 フロンティアモデルも flagをoffにすれ ば使われない....認識.... ・情報が外にでない オンプレミス/ローカル環境内で機密 データの処理が完全に完結。 Source: xxxxx
サービング方法
ローカル LLMの入手元 モデルの配布元としてはHugging faceが最も有名。Github, それぞれの公式 ページからダウンロード可能。 3大クラウド、それ以外のSnowflakeをはじめとしたプラットフォームでもREST APIとして可能だがそれも従量課金となる Source: xxxxx
ローカル LLMのサービング 高スループット・プロダクション型 ローカル・デスクトップ手軽実行型 サーバー運用・複数APIリクエストの高速処理向け PCローカル環境・手軽な動作確認・UI操作向け ▪ vLLM ▪ llama.cpp
・PagedAttention技術によりKVキャッシュを効率化 ・高い連続バッチ処理能力と圧倒的な推論速度 ・大規模プロダクション環境の標準的選択肢 ▪ SGLang ・複雑なLLMプログラム・プロンプトの高速実行 ・RadixAttentionによる複数呼び出し間のキャッシュ共 有 ・構造化出力 (JSON等) やエージェント処理に最適化 Source: Local LLM Serving Tools Comparison Source: xxxxx ・C/C++による軽量実装。GGUF量子化モデルを CPU/GPUで高速実行 ▪ Ollama ・llama.cppを内蔵し、CLIでDocker感覚でモデルを簡単 管理・REST API提供 ▪ LM Studio ・GUI付きデスクトップアプリ。検索・DL・チャット・ローカル サーバー化が完結
Gemma 4
Gemma4 4 モデルサイズ E2B, E4B, 26B, 31B 256K トークン 最大コンテキスト長
📱 Edge Models (E2B / E4B) Apache 2.0 商用利用可能なオープンライセンス Gemini 3 と共通の研究・技術を基盤に開発 💻 Workstation Models (26B / 31B) • オンデバイス最適化: スマホやIoT機器で効率的な実行に 最適化 • 高い推論性能: ローカル環境で高度な推論能力を発揮 • 効率的アーキテクチャ: MoE (26B A4B) & Dense (31B) • マルチモーダル: テキスト、画像、音声入力に対応。出力 はテキスト • 高度な理解力: 画像・動画理解とコード生成:可変解像度 の画像と動画フレームに対応 • 新技術: PLEによるパラメータ効率化と、 KVキャッシュ共有 によるメモリ削減 • コンテキスト: 256Kトークン対応 • コンテキスト: 128Kトークン対応 🚀 主要機能と拡張機能 🧠 思考モード (Thinking) 🛠 エージェント & ツール利用 🌐 多言語 & コーディング 回答前に段階的な推論を行い、複雑な問題に対応 Native Function Callingサポートで自律型エージェ ントの構築に対応 140以上の言語で事前学習。コード生成・修正に対応 し、コーディング性能も向上
ハンズオン
ハンズオン part 1 - 初心者編 gemma4-handson-colab.ipynb Source: xxxxx
ハンズオン part 2 - 中級者以上 https://github.com/tsho/gemma4-local-handson Source: xxxxx
Thank you DevFest Meetup #3
参考
参考 ローカルLLMでどこまでコードが書けるか -LLM基礎知識 / How much code can be written
on a local LLM - fundamental knowledge Speaker Deck Source: xxxxx