Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
タスクの複雑さでモデルを選ぶ ── Thompson Samplingで動かす“トークン/コス...
Search
satoh-y-0323
July 14, 2026
Technology
1.3k
3
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
タスクの複雑さでモデルを選ぶ ── Thompson Samplingで動かす“トークン/コスト最適化
Claude Code で動くマルチエージェントの個人OSS C3
タスクごとにどのモデルを使うか自体を学習させる というアプローチ
satoh-y-0323
July 14, 2026
More Decks by satoh-y-0323
See All by satoh-y-0323
Issue の起票者に、 聞いてはいけない質問がある タスク自走ハーネスの“質問の宛先”設計
satohy0323
3
730
Other Decks in Technology
See All in Technology
制約理論(ToC)入門 2026版
recruitengineers
PRO
2
290
ブラウザ研修 2026
recruitengineers
PRO
3
360
AIエージェントの知識表現と推論に なぜグラフが使われるのか - 記号的AIの復権とニューラルAIとの統合
yohei1126
1
280
データ組織の転換期 一足飛びしない段階的戦略
leveragestech
PRO
0
150
Flutterをカメラで動かしたかった話
sony
0
120
【CEDEC2026】コードレビュー支援ツール開発から学ぶ:LLMを用いた業務システムの実践的な運用設計と誤出力対策
cygames
PRO
0
520
AIは実装を速くする。では、私たちは何を今作るべきか?-立場を越えてリリースに向き合ったチーム開発の実践 / 20260801 Hiromi Nakaya and Naoki Takahashi
shift_evolve
PRO
3
370
Atlassian Cloudサポート業務でのAIエージェント活用事例
smt7174
0
400
AI エージェント時代のデジタルアイデンティティ
fujie
3
1.4k
AI ネイティブな組織に Gemini Enterprise Agent Platform がなぜ必要なのか
asei
1
170
AIQAのナレッジ構築について
qatonchan
1
160
最高のシステムプロンプトを作るためにフィードバック機能を導入した話
alchemy1115
1
320
Featured
See All Featured
What Being in a Rock Band Can Teach Us About Real World SEO
427marketing
0
1.1k
Balancing Empowerment & Direction
lara
6
1.2k
Principles of Awesome APIs and How to Build Them.
keavy
128
18k
Highjacked: Video Game Concept Design
rkendrick25
PRO
1
420
Bridging the Design Gap: How Collaborative Modelling removes blockers to flow between stakeholders and teams @FastFlow conf
baasie
0
630
How to Think Like a Performance Engineer
csswizardry
28
2.7k
Site-Speed That Sticks
csswizardry
13
1.4k
How to train your dragon (web standard)
notwaldorf
97
6.7k
30 Presentation Tips
portentint
PRO
1
360
Git: the NoSQL Database
bkeepers
PRO
432
67k
技術選定の審美眼(2025年版) / Understanding the Spiral of Technologies 2025 edition
twada
PRO
119
120k
Conquering PDFs: document understanding beyond plain text
inesmontani
PRO
4
2.9k
Transcript
タスクの複雑さでモデルを選ぶ Thompson Sampling で動かす“ トークン/ コスト最適化” @satoh_y_0323 / 個人OSS C3
(Claude Code Conductor)
モデル選び、結局“ 勘” になっていませんか 「簡単そうだから安いモデルでいいか」は 毎回人間が判断 判断基準が 言語化されていない ので引き継げない 「本当にそのモデルで精度は足りていたか」は 検証されないまま
トークン節約術 Night - TECH BATON - 2
C3 の tier-routing :3 段階で“ 選ぶ理由” を作る 複雑度を推定 ▶ Thompson
Sampling で学習 ▶ 拮抗時は安い方(cost-aware ) 人の勘ではなく、過去の承認/ 否認の実績でモデルを選ぶ トークン節約術 Night - TECH BATON - 3
実際に溜まったデータ(自分のOSS 開発ログ) c3 tier stats で複雑度×Tier 別に 成功率・トークン・実コスト が見える ※個人開発ログの実測値(収集期30
試行を卒業済み・履歴には failure もそのまま残る) トークン節約術 Night - TECH BATON - 4
推奨止まり→ 適用したら、次の問題が見えた これまで 「実行時に変更不可」 と 思い込み 推奨を表示するだけ → 誰も従わない ➜
検証→ 即実装 呼び出し時の明示指定 で 切り替え可能と判明 その日に適用まで実装 → 推奨が実際に効く ➜ 適用で見えた罠 安いモデルが一度失敗 すると二度と選ばれな い デッドロックが発覚 → 失敗の定義を再設計 トークン節約術 Night - TECH BATON - 5
持ち帰り(ツールが何でも真似できる) モデル選びは 言語化して検証できる状態 にする 「簡単/ 複雑」の判定と「選んだ結果」を 両方記録する(記録は消さず、集計ル ールだけ変える) 失敗に数えるのは 客観的な事象だけ(テスト不合格・スタック)
拮抗したら 安い方を選ぶ、というルールだけでも十分効く 最適化は 適用して初めて次の問題が見える ── 測る→ 適用→ また測る トークン節約術 Night - TECH BATON - 6
今日のひとこと モデル選びを“ 勘” から、 “ 実データに基づく学習” に。 C3 ─ pip
install claude-code-conductor / @satoh_y_0323 / つまずき報告がいちばんあ りがたいです 7