Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
5分ちょいでわかった気になるラムダアーキテクチャ
Search
yubessy
August 28, 2017
Programming
0
2.2k
5分ちょいでわかった気になるラムダアーキテクチャ
社内勉強会用資料です
yubessy
August 28, 2017
Tweet
Share
More Decks by yubessy
See All by yubessy
DDIA (Designing Data-Intensive Applications) はいいぞ
yubessy
0
1.4k
Introduction to CircleCI
yubessy
1
110
Docker Hands-on
yubessy
0
100
Resource Polymorphism
yubessy
0
280
不動点コンビネータ?
yubessy
0
280
とりあえず機械学習したかった
yubessy
0
330
Scala Native
yubessy
0
210
Type Erasure と Reflection のはなし
yubessy
1
450
量子暗号
yubessy
0
210
Other Decks in Programming
See All in Programming
💎 My RubyKaigi Effect in 2025: Top Ruby Companies 🌐
yasulab
PRO
1
130
コードに語らせよう――自己ドキュメント化が内包する楽しさについて / Let the Code Speak
nrslib
6
1.4k
単体テストの始め方/作り方
toms74209200
0
390
Bytecode Manipulation 으로 생산성 높이기
bigstark
1
160
ワイがおすすめする新潟の食 / 20250530phpconf-niigata-eve
kasacchiful
0
290
KotlinConf 2025 現地で感じたServer-Side Kotlin
n_takehata
1
170
JSAI2025 RecSysChallenge2024 優勝報告
unonao
1
440
F#で自在につくる静的ブログサイト - 関数型まつり2025
pizzacat83
0
280
RubyKaigiで得られる10の価値 〜Ruby話を聞くことだけが RubyKaigiじゃない〜
tomohiko9090
0
130
カクヨムAndroidアプリのリブート
numeroanddev
0
390
Javaに鉄道指向プログラミング (Railway Oriented Pro gramming) のエッセンスを取り入れる/Bringing the Essence of Railway-Oriented Programming to Java
cocet33000
2
510
Parallel::Pipesの紹介
skaji
2
900
Featured
See All Featured
Thoughts on Productivity
jonyablonski
69
4.7k
Keith and Marios Guide to Fast Websites
keithpitt
411
22k
Agile that works and the tools we love
rasmusluckow
329
21k
Learning to Love Humans: Emotional Interface Design
aarron
273
40k
Creating an realtime collaboration tool: Agile Flush - .NET Oxford
marcduiker
30
2.1k
10 Git Anti Patterns You Should be Aware of
lemiorhan
PRO
657
60k
Product Roadmaps are Hard
iamctodd
PRO
53
11k
The Psychology of Web Performance [Beyond Tellerrand 2023]
tammyeverts
47
2.8k
ピンチをチャンスに:未来をつくるプロダクトロードマップ #pmconf2020
aki_iinuma
123
52k
The Cult of Friendly URLs
andyhume
79
6.4k
実際に使うSQLの書き方 徹底解説 / pgcon21j-tutorial
soudai
PRO
180
53k
How to Create Impact in a Changing Tech Landscape [PerfNow 2023]
tammyeverts
52
2.8k
Transcript
5分ちょいでわかった気になる ラムダアー キテクチャ @yubessy 0x64 物語 Reboot #06 " システムアー
キテクチャ"
Lambda Architecture
Lambda Architecture ≠
ラムダアー キテクチャとは? = ビッグデー タ処理システムの設計指針 例えるなら: Web アプリの設計指針 -> MVC
ビッグデー タ処理システムの設計指針 -> ラムダアー キテクチャ 提唱者: Nathan Marz Apache Storm の開発者
ビッグデー タの例 ログ 最新の状態だけでなく過去の全事象を記録 -> 時間に対して線形にデー タ量が増加 ソー シャルネットワー ク
ユー ザ同士がサー ビス内でつながる -> ユー ザ数 n に対して O(n^2) の関係デー タ
ビッグデー タ処理システムの例 デー タ分析基盤 デー タドリブンな意思決定を支援する アドホックなクエリにも答えなければならない 機械学習基盤 デー タから直接サー
ビスや機能を創り出す 非常に大きな計算量が必要となる
ビッグデー タ処理の課題 スケー ラビリティ デー タ増に応じてリソー スを追加 RDB では処理能力が追いつかない 堅牢性
デー タ量が多いと耐障害性を保ちにくい 汎用性 どんな処理が実行されるか事前に予想しにくい
登場背景 従来の状況 個別の課題を対処療法的に解決 -> トレー ドオフによるいたちごっこ -> プロジェクト毎に同じ仕事の繰り返し ラムダアー キテクチャ
課題を整理・ 一般化し、 それらを包括的に解決 -> トレー ドオフを統制下に置く -> 一般的な枠組みに昇華
原理 全ての処理はデー タ集合に対するクエリである KPI 分析もレコメンド生成もデー タ集合から 価値を生み出す計算(= クエリ) とみなす クエリはデー
タに対する関数である 関数は必要に応じて分割・ 合成できる -> 計算フロー を垂直・ 水平に分割できる
全貌 https://dzone.com/articles/lambda-architecture-with-apache- spark
全貌 バッチ層 過去からの全デー タをマスタデー タ化して蓄積 マスタデー タからバッチビュー を生成 スピー ド層
生デー タを低レイテンシのストリー ムに流す ストリー ムからリアルタイムビュー を生成 サー ビス層 2つのビュー からクエリの結果を計算
マスタデー タ
マスタデー タ 永続性を必要とする唯一のデー タストア ビュー が失われてもマスタデー タから再生成可 純粋な事実デー タのみを追記方式で記録 他の値から導出できる値は保持しない
削除・ 更新を行わない(≠RDB のテー ブル) 分散ファイルシステム(HDFS, S3 等) を利用 スキー マを強制できるフォー マットを利用
バッチビュー・ リアルタイムビュー
バッチビュー・ リアルタイムビュー 計算量の多いクエリのために事前計算を行う e. g. アクセスログの時間毎・ 日毎の集計値 バッチビュー マスタデー タに定期的なバッチ処理を実行
MapReduce, Apache Spark などを利用 リアルタイムビュー 生デー タをストリー ム集計 Apache Storm, Amazon Kinesis などを利用
ラムダアー キテクチャの利点 クエリの計算フロー を2層に分けることで 様々 なトレー ドオフを回避 正確性 <-> レイテンシ
クエリの自由度 <-> 計算量 永続性をマスタデー タのみに求めることで 堅牢性とスケー ラビリティを両立 冗長化が容易 DB サー バ管理が不要
Livesense Analytics と Lambda Architecture アクセスログテー ブルの生成バッチで導入 マスタデー タ (S3)
( ユー ザID, タイムスタンプ, URL) のみを保持 バッチビュー (Spark on EMR) visit_id や page_type などはこちらで生成 リアルタイムビュー: 作ってない 詳しくは↓ で デー タ分析を支える「 便利カラム」 の問題点と その解決策 - LIVESENSE made*
Livesense Analytics と Lambda Architecture
まとめ だいたいこの本に書いてる
参考 Lambda Architecture » λ lambda-architecture.net Lambda Architecture with Apache
Spark - DZone Big Data O'Reilly Japan - スケー ラブルリアルタイムデー タ 分析入門