Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Sign up for free
Menu
Search
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Features
All features
Private URLs
Password Protection
Custom URLS
Scheduled publishing
Remove Branding
Restrict embedding
Deck Collections
Notes
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Explore
Featured decks
Featured speakers
Programming
Technology
Storyboards
Pricing
Search
Sign in
Sign up for free
現場のトークンマネジメント
Search
dak2
June 25, 2026
Technology
280
1
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
現場のトークンマネジメント
2026/6/25 AIオブザーバビリティ スペシャル#1 スポンサーLT
https://aid.connpass.com/event/397141/
dak2
June 25, 2026
More Decks by dak2
See All by dak2
特殊変数大全
dak2
0
13
登壇その後 - ZJIT への興味とハック
dak2
0
12
KaigiEffect.new(name: "dak2").generate
dak2
1
110
No Types Needed, Just Callable Method Check
dak2
1
8.9k
MCP Security Best Practices に見るセキュリティリスクとmodelcontextprotocol/ruby-sdk の authorization の現在地
dak2
0
70
自然言語で ActiveRecord を操作する試み
dak2
0
65
DoD x RBS
dak2
0
35
Other Decks in Technology
See All in Technology
ADKで始める業務改善 - AIエージェント開発時の考えと設計
harappa80
2
110
AIネイティブプロダクトで顧客価値を最大化するプロダクトエンジニアとFDEの協働
righttouch
PRO
0
310
あるけみー式LTスライド作成術
alchemy1115
1
210
AI de Idea
kawaguti
PRO
2
110
すぐできる衛星通信対応 あとは山奥に行くだけ
tatetate55
0
130
Issue 駆動でスペシャリストの意図を届ける、AI 実装のアクセシビリティ向上
thkt
0
110
「守り」で活用するオンデバイスLLM 〜写ってはいけないを総力戦で防ぐ〜 / iOSDC Japan 2026
nakamuuu
0
160
AI 時代のスタートアップエコシステ厶から考究する技術的負債との向き合い方
m3m0r7
PRO
2
2.1k
アプリをもっと"iOSアプリっぽく"する小さな工夫 / Small Touches That Make Your App Feel More Like an iOS App
matsuji
1
900
Minecraft JavaのMODをSwiftで作る
1mash0
0
160
株式会社シーエーシー エンジニア向け会社紹介資料
cac
0
57k
負債のメタファと2026年 / Debt Metaphor in Agentic Engineering Age 202609 Edition
twada
PRO
8
3k
Featured
See All Featured
Unlocking the hidden potential of vector embeddings in international SEO
frankvandijk
0
940
Fantastic passwords and where to find them - at NoRuKo
philnash
52
3.8k
Utilizing Notion as your number one productivity tool
mfonobong
4
590
Large-scale JavaScript Application Architecture
addyosmani
515
110k
Accessibility Awareness
sabderemane
1
210
XXLCSS - How to scale CSS and keep your sanity
sugarenia
250
1.3M
End of SEO as We Know It (SMX Advanced Version)
ipullrank
3
4.4k
How to train your dragon (web standard)
notwaldorf
97
6.8k
職位にかかわらず全員がリーダーシップを発揮するチーム作り / Building a team where everyone can demonstrate leadership regardless of position
madoxten
69
65k
The Power of CSS Pseudo Elements
geoffreycrofte
82
6.6k
State of Search Keynote: SEO is Dead Long Live SEO
ryanjones
0
280
Kristin Tynski - Automating Marketing Tasks With AI
techseoconnect
PRO
0
520
Transcript
現場のトークンマネジメント ~ Tokenmaxxing is over ~ AIオブザーバビリティ スペシャル#1 | 2026-06-25
Daichi Kamiyama (@_dak2_)
1会場案内・自己紹介
始める前に 喫煙所は地下になります
自己紹介 Daichi Kamiyama(@_dak2_) • 株式会社タイミー • バックエンド / 新規事業開発 •
W杯観戦しながらトークンを消費していま す!!!
2 本編
本日のお品書き • トークンマネジメントの事例(Claude Code) • 弊社のモニタリング環境 • 研究事例の紹介
AI 使ってますか? (多分みなさん使ってると思います)
トークンの使用率 気になってますか?
最近 https://www.businessinsider.jp/article/2606-amazon-ai-leaderboard-tokenmaxxing/
最近 https://news.yahoo.co.jp/articles/e568aedd8390e2c0e881b60dfbac36930999c29d
以前 \どんどん AI を使おう/
最近 \トークン上限内で使おう/
Tokenmaxxing is over
AI の性能を劣化させな いためのトークン効率 以前
AI の性能を劣化させな い + コスト増への対応 これから
弊社の現状
弊社の現状 トークン上限が設けられて おり、適切に管理
弊社で使える Coding Agents • Claude Code • Cursor • Devin
現場のトークン削減 Tips
トークン削減 Tips *Claude Code メイン Tips です 🙏
トークン削減 Tips • モデルを使い分ける /model ◦ 設計は Opus ◦ 実装は
Sonnet https://code.claude.com/docs/ja/costs#choose-the-right-model
トークン削減 Tips • 新しい作業を始める時は /clear する ◦ 古いコンテキストはトークン消費する ▪ /rename
でセッション名をつけておくと /resume で探しやすくて便利 https://code.claude.com/docs/ja/costs#manage-context-proactively
トークン削減 Tips • コンテキストを要約 /compact ◦ トークンの圧縮になります ◦ CLAUDE.md でコンパクションの動作を指示できる
https://code.claude.com/docs/ja/costs#manage-context-proactively
トークン削減 Tips • 不要な MCP を disable する ◦ /context
を実行してどのくらいのトークンを消費する か確認 https://code.claude.com/docs/ja/costs#reduce-mcp-server-overhead
トークン削減 Tips • 不要な Skills / Plugin も disable する
◦ /context を実行してどのくらいのトークンを消費する か確認 ◦ 入れたけどあまり使っていないものありません?
トークン削減 Tips • Extended thinking の調整 /effort ◦ 計画立案やアイディア発散の場合は、high or
xhigh ◦ 実装時には low or medium で使い分ける https://code.claude.com/docs/ja/costs#adjust-extended-thinking
• CLAUDE.md を薄く保つ ◦ PR レビューやデータベース移行などの特定のワークフ ロー用の詳細な指示は載せない。概要だけ ◦ 特定ワークフローの指示は Skill
化する https://code.claude.com/docs/ja/costs#move-instructions-from-claude-md- to-skills トークン削減 Tips
• subagent に詳細な操作を任せる ◦ テスト実行やドキュメントの取得、ログファイルの処 理は結構コンテキストを食うので、subagent に任せる https://code.claude.com/docs/ja/costs#delegate-verbose-operations-to-su bagents トークン削減
Tips
• プロンプトを具体的に ◦ これはよく言われることですね https://platform.claude.com/docs/ja/build-with-claude/prompt-engineering /claude-prompting-best-practices トークン削減 Tips
• 知見を集めた skills を作っておく https://tech.timee.co.jp/entry/2026/02/24/100702 トークン削減 Tips
• Agents を使い分ける ◦ トークン上限が来たら別の Agent を使う ◦ コードの仕様調査は Devin
にほぼ全てを任せ、設計 / 開発は Claude Code に トークン削減 Tips
• LSP Plugins ◦ あまり使えてないけど精度高いものなのか ◦ 有識者求 • Hooks への処理のオフロード
◦ プライベートでは Linter の実行を設定をしていたりします ◦ ただ、重すぎる操作は応答速度に関わるので注意です 他にも
• いらない機能は作らない / 不要なら削除してい くというのも地味に推していきたいポイント ◦ 当たり前の話 ◦ ただ、AI で作る量の増加に対して認知負荷(=コンテキ
スト)も増加している中で、ちゃんと線引きできていま すかというのは問ていきたい 他にも
• こんなこと気にしなくてもいい感じにトークン 消費抑えてほしい!!!!!!!!! • ただ、メタ的に見ると対人コミュニケーション と同じだなと思えてくるので、AI とやり取り をする上では必要だなあと思う 個人的には
• 一度にいろんなことをやらせない ◦ これはどの Agent を使っていても共通する ことかなと思います 要は
とはいえ
計測ですよ
トークン消費を定期的にウォッチして調 整していくのが大事 とはいえ
弊社の取り組み
弊社の取り組み • 鋭意改善中ではあるものの、モニタリングをし ながら個々人が調整をできるような環境が整備 されています
ccusage https://github.com/c cusage/ccusage 個人的に使っている OSS
研究事例
論文 • Token-Budget-Aware LLM Reasoning ◦ https://arxiv.org/abs/2412.18547 ◦ プロンプトに「トークン予算」を提示し動的に長さを 調整するフレームワーク「TALE」を用いることで、精
度低下を最小限に抑えつつトークンコストを平均67% 削減 ▪ *マルチモーダル非対応だったり精度低下が大きく なるケースも
論文 • SKILLREDUCER: A Less-Is-More Approach to LLM Agent Context
Management ◦ https://arxiv.org/html/2603.29919v1 ◦ スキルから不要な情報を削ぎ落とし、必要な知識だけを段階的に開示する 「SKILLREDUCER」の提案 ▪ *ルールと例が暗黙的に入り組んで記述されているスキルの場合、自 動分離によって必要な依存関係が切り離され、逆にパフォーマンスが 低下するケースも
論文 • GenericAgent: A Self-Evolving LLM Agent ◦ https://arxiv.org/abs/2604.17091 ◦
長期的に動作するLLMエージェントにおいて、重要なのはコンテキスト の長さではなく「情報密度」であると主張しています。最小限のツール、 階層型メモリ、過去の軌跡を再利用可能なSOP(手順書)に圧縮する自 己進化メカニズムを備え、圧倒的に少ないトークン消費で高いタスク完了 率を達成 ▪ *1回の実行ラウンド数に上限(30ラウンド)があるため、非常に複 雑なタスクは複数のセッションに分割する必要があり、その際の連続 性は手動でのレポート等に依存。また、自己改善ログの整理やスキル ツリーの再構築といった高度なメンテナンスは、現在手動で行う必要
論文 • Compressing Sequences in the Latent Embedding Space: K-Token
Merging ◦ https://arxiv.org/abs/2604.15153 ◦ 連続するK個のトークンを軽量エンコーダで1つの潜在的埋め込み (Embedding)にマージすることで、性能低下を抑えながら入力長を最 大75%圧縮し、計算コストを大幅に削減する手法を提案 ▪ *「入力トークン」のみを圧縮しており、モデルが生成する出力トー クンには圧縮を適用していないため、出力が非常に長くなるタスクで は効率化の恩恵薄れる
まとめ
まとめ • Tokenmaxxing は終わり、トークンコストを より気にする時代へ • 一度にいろんなことをやらせない • 多くの論文で研究されている •
トークンコストを管理してプロダクト開発を楽 しんでいきましょう
最後に
カジュアル面談はこちらから!