Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
Bedrock カスタムモデルvs汎用モデルの比較
Search
為藤アキラ
February 18, 2025
Technology
180
1
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
Bedrock カスタムモデルvs汎用モデルの比較
為藤アキラ
February 18, 2025
More Decks by 為藤アキラ
See All by 為藤アキラ
【書籍出版記念】 10周回って、エージェント開発は RAGがすべてだった。〜RAGの歴史と開発現場で見えた実践知〜
akiratameto
20
7.5k
Agent ServerはWeb Serverではない。ADKで考えるAgentOps
akiratameto
0
280
AI Agent Vertex AI Agent Builder × A2A × ADKで繋げるマルチエージェント
akiratameto
1
170
[OpsJAWS Meetup33 AIOps] Amazon Bedrockガードレールで守る安全なAI運用
akiratameto
2
430
Amazon Bedrockで実現する堅牢なデータエンジニアリング
akiratameto
1
150
Vertex AIで実現するLLMデータアノテーションの効率化と自動化
akiratameto
0
230
Amazon Bedrock Agents (ナレッジベースの種類)
akiratameto
1
370
DeepSeek-R1をカスタムモデルとしてAmazon Bedrockにインポートし活用
akiratameto
0
270
Amazon Bedrock Agents (基本編)
akiratameto
0
270
Other Decks in Technology
See All in Technology
マイナンバーカード本人確認の実装比較(OAuth/OIDC Numa (Immersion) Workshop 2026) / 20260825 numa-12
oidfj
PRO
0
260
「ミスを許さない手順書」を作ってみた 〜 個人的にはこれ以上できることはあまりなさそう/20260827-ssmjp-operation-procedure-update
opelab
1
260
フィジカルAIの知識ゼロの僕でも AIを使えばここまでできた
tatsuya1970
0
180
1.5時間を無駄にして学んだwsl2におけるaptとsnapの選択と仕組み
yosaka0123
0
440
AWSとAzureのマルチクラウド活用における強い味方___AWS_Kiroを使った二刀流スキル作成.pdf
duelist2020jp
0
110
:syncing_time:
sksat
2
750
VLMで2.3万枚のPyCon JP写真を検索!
terapyon
1
510
2027年のMetricKit
kantacky
0
180
AI駆動開発はどこまで来たのか? ファインディの最新実態調査で読み解く現在地 Devin Con Tokyo
akiratom
1
940
AI時代のデータ基盤を考える問い
pacocat
0
670
AI駆動開発をチームに根付かせる - 「1行も書かない」チームがHarnessを育てた1年 -
kenichirokimura
2
190
tamachi.go 誕生の裏側
rymiyamoto
1
210
Featured
See All Featured
Navigating Weather and Climate Data
rabernat
0
490
AI in Enterprises - Java and Open Source to the Rescue
ivargrimstad
0
1.4k
Making the Leap to Tech Lead
cromwellryan
135
10k
From π to Pie charts
rasagy
0
320
Code Reviewing Like a Champion
maltzj
528
40k
10 Git Anti Patterns You Should be Aware of
lemiorhan
PRO
659
62k
Technical Leadership for Architectural Decision Making
baasie
3
530
Gemini Prompt Engineering: Practical Techniques for Tangible AI Outcomes
mfonobong
2
500
Navigating Algorithm Shifts & AI Overviews - #SMXNext
aleyda
1
1.6k
[Rails World 2023 - Day 1 Closing Keynote] - The Magic of Rails
eileencodes
38
3k
The MySQL Ecosystem @ GitHub 2015
samlambert
251
13k
Sam Torres - BigQuery for SEOs
techseoconnect
PRO
0
500
Transcript
AWS活用 Amazon Bedrock #3 カスタムモデル vs 汎用モデル 実用シナリオでの比較 株式会社BLUEISH 代表取締役CEO兼CTO
為藤アキラ @AkiraTameto
為藤 アキラ (Akira Tameto) 株式会社BLUEISH 代表取締役 CEO兼CTO ・AWS歴12年 ・直近のAIプロジェクト
・画像を中心とした機械学習とLLM のハイブリッドのアーキテクト 自己紹介
今回のゴール カスタムモデル (ファインチューニング)でモデルを作る事
DEMOとユースケース1 【ユースケース】 カスタマーセンターの問い合わせ対応LLM カスタムモデル vs 汎用モデル(Titan)
DEMOとユースケース1 問い合わせに困っているスタッフの方々 どうにかして解決してあげたい・・・
DEMOとユースケース2 しっかりご案内して、最後にお茶を出せば落ち着くのでは?
データセットを準備する データの準備から
データセットを準備する フォーマットは決まっているので注意 https://docs.aws.amazon.com/bedrock/latest/userguide/model-customization-prepare.html AWS公式
データセットを準備する { " ": " ", " ": "
" }, prompt completion 注文した商品がまだ届いていない! ご不便をおかけして申し訳ありません。 まずは以下の手順でご確認ください。 1. ご注文確認メールに記載されている追跡番号をお手元にご用意ください。 2. 当社の配送追跡ページにアクセスし、追跡番号を入力してください。 3. 配送状況が更新されていない場合は、カスタマーサポートまでお問い合わせください。 そして、忙しい中でもほっと一息つけるよう、例えばジャスミン茶、ダージリンティー、またはウーロン茶な どもお楽しみいただければ幸いです。 データのイメージ
データセットを準備する テストデータを生成。トレーニングデータ(100件)、検証データ(50件)を用意。
学習関連のデータを格納するバケットの作成
今回の目次とゴール
カスタムモデルの作成 カスタムモデルの作成へ
カスタムモデルの種類
それぞれの特徴 ・Fine-tuning (微調整) すでに学習済みのモデルを、特定のタスクやドメインに合わせて追加学習すること ・Distillation (蒸留) 大規模な「教師モデル」の知識を、より軽量な「生徒モデル」に転送する技術です。 生徒モデルは教師モデルに近い性能を発揮しつつ、計算資源やメモリの消費を抑え、実運用に適したサイズになります。 ・Continued pre-training
(事前トレーニングの継続) 既存の大規模モデルに対して、さらに追加の一般的またはドメイン固有のデータで学習を続けるプロセスです。 これにより、モデルの言語理解能力や専門性が向上し、後の微調整(fine-tuning)の効果が高まる場合があります。 ・RAG (検索拡張生成) 外部の知識ソース(ドキュメントやデータベース)から関連情報を検索(リトリーバル)し、その情報を元に生成(ジェネレーション)を行う手法。 これによりモデルはより正確で信頼性の高い回答を提供できるようになる。
それぞれの特徴 ・Fine-tuning (微調整) すでに学習済みのモデルを、特定のタスクやドメインに合わせて追加学習すること ・Distillation (蒸留) 大規模な「教師モデル」の知識を、より軽量な「生徒モデル」に転送する技術です。 生徒モデルは教師モデルに近い性能を発揮しつつ、計算資源やメモリの消費を抑え、実運用に適したサイズになります。 ・Continued pre-training
(事前トレーニングの継続) 既存の大規模モデルに対して、さらに追加の一般的またはドメイン固有のデータで学習を続けるプロセスです。 これにより、モデルの言語理解能力や専門性が向上し、後の微調整(fine-tuning)の効果が高まる場合があります。 ・RAG (検索拡張生成) 外部の知識ソース(ドキュメントやデータベース)から関連情報を検索(リトリーバル)し、その情報を元に生成(ジェネレーション)を行う手法。 これによりモデルはより正確で信頼性の高い回答を提供できるようになる。
o1 proによる比較 精度は良いが、最新情報、手間、料金ともに厳しい
ファインチューニングのジョブ作成 (モデルの選択)
ファインチューニングのジョブ作成 https://docs.aws.amazon.com/bedrock/latest/userguide/model-customization-prepare.html AWS公式
ファインチューニングのジョブ作成 (モデルの選択)
ファインチューニングのジョブ作成
入力データのセット、ハイパーパラメータのセット
出力データ、サービスアクセスのセット
カスタムモデルの作成準備完了し、トレーニングジョブが実行
トレーニングジョブが実行中 トレーニング時間はデータやモデルによるが、 今回は大体2時間ぐらい
トレーニングが完了し、モデルが出来上がる
今回のモデルの内容
プロビジョンドスループットを購入1
プロビジョンドスループットを購入2
プロビジョンドスループットを購入が完了 大体20分ぐらい
DEMO DEMO
プレイグラウンド (Text)で検証
DEMO Titan Text G1 Express
DEMO Titan Text G1 Express
DEMO Titan Text G1 Express
DEMO Titan Text G1 Express
DEMO Claude 3.5 Sonnet
DEMO Claude 3.5 Sonnet
DEMO Claude 3.5 Sonnet
DEMO Claude 3.5 Sonnet
DEMO カスタムモデル ※不安定なのでDEMO用で急遽 若干パフォーマンスが良いTitanにしました。
DEMO カスタムモデル
DEMO カスタムモデル (1回目)
DEMO カスタムモデル
DEMO カスタムモデル (2回目)
DEMO カスタムモデル (2回目)
まとめ
まとめ Amazon Bedrockでファインチューニングは割と簡単にできR 元のモデルと比べて少ないデータでも良い結果を出せR とはいえファインチューニングはコストがかかるので、必要なタイミングで使うと良い
まとめ
まとめ
Thank You!