行動データ由来のPersonaでA/Bテストを事前シミュレーションする
LLM agentと実ユーザー行動に基づくpersonaでA/Bテストの方向を予測する手法を、質問形式、評価結果、subsampling、再現性と限界から解説します。
Personal notes since 2020
技術や日々の試行錯誤を、あとから読み返せる形で残しています。
Latest
LLM agentと実ユーザー行動に基づくpersonaでA/Bテストの方向を予測する手法を、質問形式、評価結果、subsampling、再現性と限界から解説します。
KDD 2025のRPGを、OPQによる長いSemantic ID、multi-token prediction、graph-constrained decoding、評価結果と再現時の注意点から解説します。
Metaの広告ranking論文をもとに、RQ-VAEによる階層Semantic ID、prefix n-gram、long-tail・cold start・予測安定性への効果とproduction導入上の注意点を解説します。