Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
双方向推薦システムにおける長期的マッチング最大化に向けた代理目的関数の設計と実証
Search
Recruit
PRO
June 17, 2026
Technology
160
1
Share
Embed
Copy iframe code
Copy JS code
Copy link
Start on current slide
双方向推薦システムにおける長期的マッチング最大化に向けた代理目的関数の設計と実証
2026/6/12に、2026年度 人工知能学会全国大会(第40回)で発表した西村の資料になります。
Recruit
PRO
June 17, 2026
More Decks by Recruit
See All by Recruit
AIネイティブ時代における 開発組織の役割と拡張の可能性
recruitengineers
PRO
2
230
開発が速く安くなった後の話 AI時代のソフトウェアエンジニアリング組織論 #devsumi
recruitengineers
PRO
45
31k
就職⽀援サービスにおけるキャリアアドバイザーのシフトスケジューリング
recruitengineers
PRO
1
210
Model Routerを使った逐次LLM選択による毀損低減効果の検証
recruitengineers
PRO
2
83
ストリーム処理基盤のFlink移行検証と適材適所の実践
recruitengineers
PRO
2
120
AI 時代の Platform Engineering
recruitengineers
PRO
3
520
巨大プラットフォームを進化させる「第3のROI」
recruitengineers
PRO
2
3.7k
データ戦略を加速させる プラットフォーム エンジニアリングと進化的アーキテクチャ
recruitengineers
PRO
3
130
まなび領域における生成AI活用事例
recruitengineers
PRO
2
350
Other Decks in Technology
See All in Technology
データ活用研修 問いの発見と仮説構築【MIXI 26新卒技術研修】
mixi_engineers
PRO
1
540
Claude Mythos、Fable...フロンティアAIの最新動向と企業のセキュリティ対策
flatt_security
0
160
AI研修(Day1)【MIXI 26新卒技術研修】
mixi_engineers
PRO
2
2.2k
現場との対話から始める “作る前に問い直す”業務改善
mochico50
2
330
システム監視を 「システムを監視するだけ」で 終わらせないために
seiud
0
140
QAと開発の両側から進める AI活用 -QAプロセスAI支援ツールキットと Inner Loop / Outer Loopの取り組み-
legalontechnologies
PRO
2
280
AI時代におけるエンジニアの新たな役割──FDEとクオリアの探求/登壇資料(戸井田 裕貴)
hacobu
PRO
0
600
AIで楽になるはずが、なぜ疲れる?
kinopeee
0
130
StepFunctionsとGraphRAGを活用した暗黙知活用のためのRAG基盤
yakumo
0
180
AIツールを導入しても生産性はあがらない? カオナビが直面した 3つの壁と乗り越え方。/ Overcoming 3 Barriers to AI-Driven Productivity at kaonavi
kaonavi
0
380
データエンジニアこそ組織のオントロジーに向き合うべき — 問いに答えるAIから、事業を動かすAIへ
gappy50
4
1.1k
AI時代におけるテストの基礎の再定義 / Rethinking the Fundamentals of Testing in the AI Era
mineo_matsuya
15
6k
Featured
See All Featured
Conquering PDFs: document understanding beyond plain text
inesmontani
PRO
4
2.9k
We Have a Design System, Now What?
morganepeng
55
8.2k
Google's AI Overviews - The New Search
badams
0
1.1k
We Are The Robots
honzajavorek
0
290
[RailsConf 2023 Opening Keynote] The Magic of Rails
eileencodes
31
10k
Refactoring Trust on Your Teams (GOTO; Chicago 2020)
rmw
35
3.7k
Imperfection Machines: The Place of Print at Facebook
scottboms
270
14k
Claude Code どこまでも/ Claude Code Everywhere
nwiizo
65
57k
WCS-LA-2024
lcolladotor
0
760
Impact Scores and Hybrid Strategies: The future of link building
tamaranovitovic
0
340
Build The Right Thing And Hit Your Dates
maggiecrowley
39
3.3k
I Don’t Have Time: Getting Over the Fear to Launch Your Podcast
jcasabona
34
2.8k
Transcript
© Recruit Co., Ltd. All Rights Reserved 双方向推薦システムにおける 長期的マッチング最大化に向けた 代理目的関数の設計と実証
株式会社リクルート 西村 直樹 東京科学大学 小林 健 東京科学大学 中田 和秀 2026年度人工知能学会全国大会(第40回) 2026年6月12日 @ Gメッセ群馬
© Recruit Co., Ltd. All Rights Reserved 2 発表の構成 ⚫
背景と課題 ⚫ 長期的マッチングを考慮した代理目的変数 ⚫ 将来マッチング率の推定の安定化 ⚫ 数値実験 ⚫ まとめと今後の課題
© Recruit Co., Ltd. All Rights Reserved 3 双方向推薦システム 推薦する側、推薦される側の両者の嗜好を加味して推薦対象を決定
例:求人検索プラットフォーム → 求職者と企業(求人票)の両者を考慮した推薦が求められる 求職者 企業 考慮度合い 求職者行動 企業行動 考慮度合い 求職者 企業 求職者行動 企業行動
© Recruit Co., Ltd. All Rights Reserved 4 課題 1度の推薦でのマッチング度合いは最大化されるが、
求職者が行動を起こすことによる長期的な影響が考慮されない 双方向推薦システムの目的関数と課題 推薦の目的関数として、双方向の両者のスコアの積が一般的に用いられる [Pizzato+ 2010] 求職者 企業 閲覧・応募などの 求職者行動の度合い 選考通過・内定など の企業行動の度合い 求職者の行動意欲が低下してサービスから早期に離脱したり、推薦の 情報源となる行動データが減少することにより推薦精度が低下
© Recruit Co., Ltd. All Rights Reserved 5 課題 のように指数重み
を動的に決めれば よさそうだが、ルールベースの設定では最終指標の向上が難しい 求人検索プラットフォームにおける理想的な推薦の挙動 登録初期や離反期の活動意欲が十分でない段階では、直接マッチングに 繋がる求人に加えて、選択肢を広げる求人もあわせて提示し求職活動の活性化 序盤 定着期 離反期 方針 重視指標 まず求職活動の 開始を支援する 行動データをもとに マッチングしやすい 求人を推薦 活動意欲を再度 喚起する 求職者行動重視 マッチング重視 求職者行動重視
© Recruit Co., Ltd. All Rights Reserved 6 関連研究と提案手法の位置づけ 双方向推薦の標準的な定式化
[Pizzato+ 2010] • 双方向の両者の受容スコアの積による貪欲最適化 → 目先のマッチング率に偏る最適化で、将来価値を考慮しない ベルマン方程式の近似に基づく代理目的関数の設計 [Cai+ 2023] • ベルマン方程式の一次近似(即時報酬+将来価値増分)を代理目的関数に用いる • 価値関数の学習が過去データだけでは閉じず、オンライン更新を前提とする → 安定的な運用が求められるサービスへの適用が難しい 提案手法 • Cai+の代理目的関数(即時報酬+将来価値増分)の枠組みは共通 • 将来価値の増分を過去データを用いて推定 → オンライン更新不要 • ドメイン知識を利用した形状制約付き回帰 → スパースデータでも推定を安定化
© Recruit Co., Ltd. All Rights Reserved 7 発表の構成 ⚫
背景と課題 ⚫ 長期的マッチングを考慮した代理目的変数 ⚫ 将来マッチング率の推定の安定化 ⚫ 数値実験 ⚫ まとめと今後の課題
© Recruit Co., Ltd. All Rights Reserved 8 が大のとき求職者行動重視、 が小のときマッチング
重視となるような代理目的関数を設計したい 離反期 求職者状態に合わせた推薦の実現のための準備 求職者行動数 (Frequency)、最終行動からの経過日数 (Recency) のシンプルな 2次元空間で求職者状態を定義したときの将来のマッチング率を観察 序盤:求職者行動が生じることによる将来マッチング率 の増分 が大きい 定着期:求職者行動が増えると追加で行動が生じること による は低減 離反期:最終行動から経過日数が経っていくと、将来 マッチング率が低下していくため、新たに行動が生じた ときの は再度大きくなる 求職者状態ごとの 将来のマッチング率 定着期 序盤
© Recruit Co., Ltd. All Rights Reserved 9 求職者状態ごとの 将来のマッチング率
提案する代理目的関数 その推薦による直接的なマッチング度合いを測るスコアの積に加えて、 求職者行動が生じることによる将来のマッチング率増分 も考慮し順序付け 求職者行動が生じることによる 将来マッチング率の増分 将来効果の 重視度パラメータ 求職者 の の具体的な算出例: ① 求職者行動数0、経過日数10、将来マッチング率 0.1 ↓求職者行動が生じることによる状態変化 ② 求職者行動数1, 経過日数0:将来マッチング率 0.2 ① ②
© Recruit Co., Ltd. All Rights Reserved 10 求職者状態ごとの将来のマッチング率 提案する代理目的関数による推薦の挙動
小 → 従来の貪欲最適の目的関数に近い 大 → の影響が相対的に大 離反期 小 大 定着期 序盤 大 を対象プラットフォームの行動ログから集計、 を実験をもとに適切にに設定することで、推薦を動的に調整可能に
© Recruit Co., Ltd. All Rights Reserved 11 発表の構成 ⚫
背景と課題 ⚫ 長期的マッチングを考慮した代理目的変数 ⚫ 将来マッチング率の推定の安定化 ⚫ 数値実験 ⚫ まとめと今後の課題
© Recruit Co., Ltd. All Rights Reserved 12 求職者状態ごとの将来マッチング率の推定の課題 将来マッチング率の推定において、マッチング数は
求職者行動数に比べてサンプルサイズが小さい → 累積行動数 (Frequency) と経過日数 (Recency) の組によってはデータがスパースとなり推定が不安定に 将来マッチング率について、ドメイン知識として 期待される、以下の性質を満たすように補正する • 累積行動数が多い → 将来マッチング率 大 • 行動からの経過日数が長い → 将来マッチング率 小 実績平均の将来マッチング率 最終行動からの経過日数 が長いほど低下
© Recruit Co., Ltd. All Rights Reserved 13 単調性制約によるマッチング率表の補正 累計行動数
が大きいほど推定値は大 サンプルサイズ 集計値 推定値 実績平均の将来マッチング率 推定の将来マッチング率 最終行動からの経過日数 が長いほど低下 経過日数 が大きいほど推定値は小 について常に正の値を取る ことが保証される [Iwanaga+ 2016]
© Recruit Co., Ltd. All Rights Reserved 14 発表の構成 ⚫
背景と課題 ⚫ 長期的マッチングを考慮した代理目的変数 ⚫ 将来マッチング率の推定の安定化 ⚫ 数値実験 ⚫ まとめと今後の課題
© Recruit Co., Ltd. All Rights Reserved 15 人工データによる検証 ―
実験設定 • 求職者行動による将来マッチング率の変化度合いを2パターンの仮定で設定 - 動的環境(変化あり) → 求職者行動の有無により次の推薦の がそれぞれ増減 - 静的環境(変化無し) → 求職者行動が次の推薦の に影響しない 静的環境の将来マッチング率 動的環境の将来マッチング率 求職者行動が増 → 対数関数的にマッチング率増 経過ステップ増 → 指数関数的にマッチング率減 • 求職者と企業の行動確率は既知として、一様分布U(0, 0.3)から独立にサンプリング • 50期後の累積の求職者行動数、マッチング数を 貪欲/提案 目的関数をもとに推薦した場合で比較 実験設定詳細:https//www.github.com/nnnnishi/contrast-effect-jsai2026
© Recruit Co., Ltd. All Rights Reserved 16 • 行動により活動意欲に変化がない状況では、提案目的関数による推薦は
求職者行動を増加させるものの最終的なマッチング数は減少 • 現実に近い、行動により活動意欲が変化する状況では、提案目的関数にて適切に を設定することで求職者行動だけでなくマッチングまで増加 実験結果 静的環境 求職者行動を重視 するとマッチングが減 動的環境 求職者行動を適度に重視 するとマッチングが増 • 実サービスでのA/Bテストにおいても、動的環境と同様の傾向を確認
© Recruit Co., Ltd. All Rights Reserved 17 発表の構成 ⚫
背景と課題 ⚫ 長期的マッチングを考慮した代理目的変数 ⚫ 将来マッチング率の推定の安定化 ⚫ 数値実験 ⚫ まとめと今後の課題
© Recruit Co., Ltd. All Rights Reserved 18 まとめと今後の課題 まとめ
• 長期的なマッチング増加のため、短期的なマッチング率と 将来のマッチング率増分を組み合わせた代理目的関数を提案 • 将来マッチング率の推定において、単調性制約を課した 凸二次計画問題としてモデリングすることで安定した推定を実現 今後の課題 • 将来効果の重視度パラメータ のパーソナライズ → どの程度将来効果を重視すべきかはユーザによって異なる • 推薦方策の変化を考慮した将来マッチング率増分の推定 → 方策変化を反映しつつ、安定運用が可能な方法を検討