Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
週末にAI-DLCを本気で回したら$1,600溶けた
Search
Atsushi Shimizu
August 27, 2026
Programming
100
0
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
週末にAI-DLCを本気で回したら$1,600溶けた
Atsushi Shimizu
August 27, 2026
Other Decks in Programming
See All in Programming
【デモ】Kiroで体験する仕様駆動開発|設計からコーディングまでAIと進める開発フロー
cmkudo
0
540
Jindong: Introducing Declarative Haptics in Compose Multiplatform
l2hyunwoo
0
140
ハーネス設計入門 〜プロンプト、コンテキストの次〜
kinopeee
49
31k
DroidKaigi 2026 「個人開発という実験場: Android エンジニアが手にする4つの自由」
slashnephy
0
160
業務時間外もAIに働いてもらう話
colorful12
3
9.5k
Go 1.27 における memory allocation の高速化
andpad
0
360
新人はどこまで自力でやり、どこからAIに頼るべきか/エンジニア育成に向き合う_先輩たちの悩みと知見共有会
toppan_digital_dev
1
380
【DroidKaigi 2026】「アクセシビリティを利用するとき、 アクセシビリティもまたこちらを利用している」 〜マルウェアによる攻撃と防衛について〜
halunoyo
0
130
typoなんかねぇよ
raspython3
0
640
思考垂れ流し開発 ~音声入力 × AIエージェント × 開発ハーネスによる試行錯誤~
npostring
0
610
Go 1.27からのGODEBUG / Go 1.27 リリースパーティ #go127party
mazrean
0
270
片田舎のおっさん、 Swift Buildのダイアモンド問題解決の不具合修正PRを出すが、解決方法がキャッシュをしないようにすることであり、ビルド時間が伸びると言われてマージされないので高速化もする/swiftbuild
yimajo
0
340
Featured
See All Featured
The Illustrated Guide to Node.js - THAT Conference 2024
reverentgeek
1
460
Navigating Weather and Climate Data
rabernat
0
500
DBのスキルで生き残る技術 - AI時代におけるテーブル設計の勘所
soudai
PRO
68
57k
Responsive Adventures: Dirty Tricks From The Dark Corners of Front-End
smashingmag
254
22k
Rails Girls Zürich Keynote
gr2m
96
14k
[Rails World 2023 - Day 1 Closing Keynote] - The Magic of Rails
eileencodes
38
3k
Navigating Algorithm Shifts & AI Overviews - #SMXNext
aleyda
1
1.6k
Mind Mapping
helmedeiros
PRO
1
340
My Coaching Mixtape
mlcsv
0
300
Taking LLMs out of the black box: A practical guide to human-in-the-loop distillation
inesmontani
PRO
3
2.4k
Breaking role norms: Why Content Design is so much more than writing copy - Taylor Woolridge
uxyall
1
390
30 Presentation Tips
portentint
PRO
1
380
Transcript
A I - D LC v 1 P R A
C T I C E R E P O R T 週末にAI-DLCを 本気で回したら $1,600溶けた 速さだけでは測れない、AIチームの生産性 2026/8/27 株式会社HBA 清水厚志 @shimizuxa
国内事例で語られるのは「速さ」 日立産業制御ソリューションズ様 東京海上日動システムズ様 約530人時 → 約70人時 2〜3か月 → 1.5日 7名・2日間でプロトタイプを構築
10名で周辺Webシステムの初期版を構築 ※対象・参加人数・完成条件は事例ごとに異なる 出典1: https://aws.amazon.com/jp/blogs/news/ai-dlc-unicorn-gym-hitachi-ics-202601/ 出典2: https://aws.amazon.com/jp/blogs/news/tokio-marine-ai-dlc/ 2
「圧倒的な速さ」は見つかる でも、AI利用料は? 私が調べた範囲では、具体額まで公開した国内事例は見つけにくかった 3
1行プロンプトから始めた話ではない 100 + 1 万行+ 複数 要求・設計・知識文書 整理済みMarkdown 外部システム境界 複雑なPoC:
未合意契約・状態・冪等性・複数Agent・品質証跡 4
週末の結果 約66 時間 4 Unit $1,607 相当 開始から中断まで 実装+品質証跡 160,734
AI Credits換算 workspace全体で1,000件超のテストケースがPASS 注意: 利用量のドル換算であり、実際の追加請求額とは限らない 5
でも、$1,600で 話は終わらなかった LT申込後もAI-DLCを継続 → 費用はその後も増加 6
止まらなければ、課金も止まらない 従量計測 超過利用 → Copilot CLIも → 組織・Enterpriseは AI Credits対象
既定で利用可能 予算上限 → 機能あり/今回は未設定 今回の要因: 予算上限を設定せず、超過利用可能な構成で継続した 7
費用の山は、実装後半の品質ループ 80.9 % 61.4 % 74.7 % 最初の週末 背景Agent 最初の週末
入力200K token超 継続セッション review中心区間 AI Credits構成比。※最初の週末の2指標は分類軸が異なり、重複を含む 高かった処理: 品質を「作る・確かめる・説明する」ための再読と反復 8
ある真面目すぎるAIプロジェクトチーム Manager AI M AI語 R 「closureは0件に」 Planner AI P
AI語 「進行Gateにも」 人間語 「最後は指摘ゼロに」 人間語 「開始前の必須条件にも」 Reviewer AI 修正担当AI AI語 「固定roundはstale」 人間語 「前回の合格はもう古い」 F AI語 「Minorも全部修正」 人間語 「小さな指摘も全部直す」 当時の私: この会話で「止まる条件」が厳しくなったと気づけなかった 9
品質目標が「ローカル規程」になった日 AI語は読める でも、これがルール変更? 進⾏ルール M 「closureは0件に」 closure = 0 /
0 / 0 Blocking / Major / Minor の指摘件数 ? Manager AI 実⾏前 Gate にも適⽤ P Planner AI 「進⾏Gateにも」 開始前の必須条件へ⼀般化 最新 review = 0 / 0 / 0 変更のたびに合格を取り直す R Reviewer AI 「固定roundはstale」 監督役:⼈間 AI-DLC指⽰でもユーザー指⽰でもなく、AI⽣成のローカルpolicyとして整備されてしまった 10
全員が正しく働くほど、仕事が増える Reviewer AI 指摘を⾒つける RELEASE / ROLLBACK PLAN 独⽴監査AI 最初から読む
修正担当AI 1.3K → 6.8K lines review × 15 まだ 全部直す 「品質向上中」 だと思っていた… Planner AI 計画を更新する 11
そして、ファイルを1枚移動した 1 質問ファイルを移動 Q&A 2 鮮度確認が反応 3 巨⼤計画を再レビュー inventory 55
→ 56 PLAN PASS 6.8K⾏ 1 file 正しい⽂書領域 変更は、たった1ファイル 0/0/0 直前の合格が失効 Re-review 14:1 / 2 / 0 ⼈間がようやく STOP 12
AI語を「ルール変更」として読めなかった AIチーム 監督役 品質目標を忠実に守る AI-DLC初挑戦の私 品質目標をローカル規程化 会話の意味はおおむね読めた 小変更でも全量レビュー でも、進行ルールの変更と見抜けなかった 従量課金に予算上限なし
優秀なAIチームを率いるには、 AI語を習得するしかない? 13
AI語を覚えるより「境界」を先に決める 1 Review boundary 差分+関連契約へ絞る 2 Test boundary 変更影響で回帰testを選ぶ 4
Model / Cost boundary 難易度・usage・budgetで分業 5 Plan / Stop boundary 複雑度とreview回数に上限 3 Context boundary 有効な意思決定だけを配る 仕組みで監督: 全会話を追わず、境界を超えたら人間判断へ戻す 14
5つの境界を実装し、使い始めた R Review 有望 差分review+安全fallback T Test 変更影響+targeted test 方式見直し
routing規約+usage/budget計測 P Plan / Stop 有望 C Context M Model / Cost 有望 complexity check+review回数上限 採用見直し decision manifest+context packet 初期観測: 3施策は有望 / Contextは採用見直し / Model-Costは方式見直し 15
品質確認は減らさない 境界が明確 未知・曖昧・情報が古い・高リスク 必要な範囲へ絞る 全量に戻す 差分レビュー・影響テスト・必要な文脈に 全量レビュー・全回帰・人間判断へ戻す 絞る 現在地: 施策は選別中
/ 全量へ戻す安全策は維持 16
QCDで測るAI-DLCの生産性 Q Quality:品質 何を守れたか 今回の焦点 C Cost:AI利用料 いくら使ったか D Delivery:開発期間
何人月 → 何日 最初に目が行くのはD。 今回はCから「止め方」を学んだ 17
今回のキーメッセージ 予算と停止線は、 人間が決め、仕組みで守る AIチームに仕事を渡しても、境界を決める責任は渡さない
T H R E E-W E E K P OST
M O RT E M 週末に 3週間、 AI-DLCを本気で回したら $1,600 $X,XXX 溶けた 予算と停止線は、人間が決め、仕組みで守る Thank you @shimizuxa