Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
会社の公開ページとKnowledge Base for Amazon Bedrockを使ってRAG作ってみた
Search
そのだ
February 19, 2024
Technology
0
160
会社の公開ページとKnowledge Base for Amazon Bedrockを使ってRAG作ってみた
【Doorkeeper】
JAWS-UG沖縄 生成AI特集! 2024年02月
https://jaws-ug-okinawa.doorkeeper.jp/events/167464
そのだ
February 19, 2024
Tweet
Share
More Decks by そのだ
See All by そのだ
RAG構築におけるKendraとPineconeの使い分け
sonoda_mj
2
250
検索拡張生成(RAG)をAWSで作る方法
sonoda_mj
0
61
BedrockのToo Many Request解決してみた
sonoda_mj
1
1.1k
AmazonBedrockを使用した自作RAGの作り方
sonoda_mj
1
480
knowledge base fot amazon bedrockを使って、格安でRAG作ってみた
sonoda_mj
1
520
Step Functionsを使ってノーコードでDynamoDBにPutItemしてみた
sonoda_mj
2
370
今年から苑田は○○します!!
sonoda_mj
0
49
AWS re:Invent 2023 で発表された Bedrockの新モデルを使ってみた
sonoda_mj
0
88
AWS re:Invent 2023での新サービスを速攻で試してみた
sonoda_mj
0
110
Other Decks in Technology
See All in Technology
Phluxorでアクターモデルを 理解・体験しよう / toolkit-for-flexible-actor-models-in-php-phluxor
ytake
1
110
Lernen durch Schmerzen! Mit Reinforcement Learning selbstlernende Systeme entwickeln
joergneumann
0
210
まずはパネル「Table」を使い倒してみよう@GrafanaMeetupJapan#2
rinchoku
1
230
Productivity-Conference-GitHub-20240629
yuhattor
2
2k
2024年のRailsと自由について考える
takahashim
19
6.2k
Refactoring to Expressive Kotlin
davidkwon7
0
440
新常識! Javascript×AWS Lambdaがアツい!!
watany
3
260
プロダクト拡大フェーズでプロダクト検証サイクル効率化を目指す過程で見えたもの / Streamlining Product Validation in Growth Phase
kakehashi
5
4.8k
日本発24時間グローバルイベント"JAWS PANKRATION 2024"の紹介
yoshimi0227
1
170
健常者から見たAndroidのアクセシビリティ機能
takamichie
PRO
0
170
Oracle製品を使ったシステム開発の新人研修事例/JPOUG Tech Talk Night #9
sawakihideto
0
120
Oracle Modern Data Platform Reference Architecture (Autonomous Data Warehouse編)
oracle4engineer
PRO
0
520
Featured
See All Featured
A designer walks into a library…
pauljervisheath
201
24k
Understanding Cognitive Biases in Performance Measurement
bluesmoon
13
1.2k
Speed Design
sergeychernyshev
6
180
Building Effective Engineering Teams - LeadDev
addyosmani
42
2.1k
The Mythical Team-Month
searls
217
42k
Building a Scalable Design System with Sketch
lauravandoore
457
32k
Fight the Zombie Pattern Library - RWD Summit 2016
marcelosomers
228
16k
The Straight Up "How To Draw Better" Workshop
denniskardys
228
130k
Designing for Performance
lara
603
67k
Large-scale JavaScript Application Architecture
addyosmani
505
110k
What's new in Ruby 2.0
geeforr
338
31k
4 Signs Your Business is Dying
shpigford
177
21k
Transcript
会社の公開ページとKnowledge Base for Amazon BerdrockでRAG作ってみた JAWS-UG沖縄 ⽣成AI特集︕2024年2⽉ 2024.2.17 苑⽥朝彰 1
⾃⼰紹介 苑⽥ 朝彰 Sonoda Tomotada - ID - Github︓tomomj -
Twitter︓@sonoda_mj - Work at - 株式会社 Fusic (フュージック) 技術創造部⾨所属 - 新卒3年⽬ - 最近MLを勉強し出した - Skill - AWS/React(Native)/Ruby on Rails 2
アジェンダ 3 l 背景 l Knowledge Base for Amazon Bedrockとは
l 会社の公開ページとBedrockでRAG作ってみた l まとめ
01 背景
新しい情報やプライベートの情報に関する 内容について回答してくれる、ChatGPTの ようなアプリを個人開発で作りたい!
でもいいネタが思いつかん!!
参考:https://fusic.co.jp/members
ちょうどええデータ あるやん
これ使ってみよか〜
作ったもの
苑田(webにない情報) って誰ですか? Webアプリ
苑田っていうのはな。。。 Webアプリ
02 Knowledge Base for Amazon Bedrockとは
Knowledge Base for Amazon Bedrockとは 14 "NB[PO#FESPDLͷφϨοδϕʔεΛ༻͢Δͱɺ"NB[PO#FESPDL͔Β '.Λσʔλιʔ εʹଓͯ͠ݕࡧ֦ுੜ 3"(
Λߦ͏͜ͱ͕Ͱ͖Δɻ͜ΕʹΑΓɺ'.ͷطଘͷڧྗͳػೳΛ ֦ு͠ɺಛఆͷυϝΠϯ৫ʹؔ͢ΔࣝΛਂΊΔ͜ͱ͕Ͱ͖Δɻ 引用:https://aws.amazon.com/jp/bedrock/knowledge-bases/
データの前処理 15 引用:https://docs.aws.amazon.com/bedrock/latest/userguide/knowledge-base.html • ドキュメントを管理しやすいチャンクに分割し、効率的に取得できるようにする • ドキュメントをEmbedding Modelを使用してベクトル化する • Vector
DBに格納する Cohere
ランタイム実⾏ 16 引用:https://docs.aws.amazon.com/bedrock/latest/userguide/knowledge-base.html • ユーザーのクエリをベクトル化する • ドキュメントのベクトルと比較し、意味的に類似したチャンクが検索される • 取得されたチャンクからの追加のコンテキストで拡張される Cohere
Claude
Knowledge Baseについて詳しく 17 or or Vector Database Data Source S3
Bedrock User LLM 様々な情報を入れる コードを書かなくとも一括で作成してくれる(S3以外) or
03 会社の公開ページとBedrockで RAG作ってみた
データソース 19 Fusicのメンバー紹介(全員分) 参考: https://fusic.co.jp/members/108
構成図 20
構成図 21
None
質問内容 会話履歴を保持するための セッションID
sessionIDを指定しない場合 sessionIDを指定する場合 苑田とは誰ですか? AWSエンジニアです 詳細を教えてください 詳細とは何でしょうか? 苑田とは誰ですか? AWSエンジニアです 詳細を教えてください 彼はAWSだけではなく、Rubyも書ける
ようです。緑のタイツを着ています。 会話情報が保持される
構成図 25
None
構成図 27 毎日データをベクトル化してPineconeに保存している
データを前処理する 28 名前:苑田朝彰 コメント:ほげほげ 略歴:ほげほげ 担当・スキル:ほげほげ プライベート:ほげほげ 必要なところだけ取ったtxtファイル データの抽出
構成図 29 ベクターDB Freeプラン使用
デモ
04 まとめ
まとめ Bedrockを使ってChatGPTのようなアプリを簡単に作ることができた Point 2 sessionIDを使⽤することで、会話履歴が保持された 32 Point 1 Point 3
データの精度を上げるには前処理が重要(かもしれない)
ご清聴いただきありがとうございました Thank You We are Hiring ! https://recruit.fusic.co.jp/
Appendix
検索拡張⽣成(RAG)とは 35 Retrieval Augmented Generation(RAG) 生成系の言語 AI モデルに外部メモリをつけるというコンセプトのことを指す Vector Database
LLM 質問 検索 返答 検索結果 引用:https://github.com/aws-samples/jp-rag-sample
検索拡張⽣成(RAG)とは 36 事前に学習したデータに関しては返答することができる AWSについて教えて AWSってのはな・・・ LLM
検索拡張⽣成(RAG)とは 37 しかし、学習していない内容に関しては答えられない 苑田について教えて 誰やねん 私の知識はxxxx年まででぇ〜
検索拡張⽣成(RAG)とは 38 外部のデータベースなどを紐づけることで、新しい情報やプライベートの情報に関す る回答を生成することができる Vector Database 苑田について教えて 新しいデータをベクトル化 して格納
検索拡張⽣成(RAG)とは 39 外部のデータベースなどを紐づけることで、新しい情報やプライベートの情報に関す る回答を生成することができる Vector Database 近いベクトルを探す 「苑田について教えて」を ベクトル化
検索拡張⽣成(RAG)とは 40 外部のデータベースなどを紐づけることで、新しい情報やプライベートの情報に関す る回答を生成することができる Vector Database 検索結果を返す
検索拡張⽣成(RAG)とは 41 外部のデータベースなどを紐づけることで、新しい情報やプライベートの情報に関す る回答を生成することができる Vector Database 苑田ってのはな