Applied-Machine-Learning-Lab/Awesome-Personalized-RAG-Agent

A Survey of Personalization: From RAG to Agent

119

33 commits

updated Aug 6, 2025

See the code

README

Logo

Awesome-Personalized-RAG-Agent

Static Badge

📘 Overview

This is the official repository of the paper "A Survey of Personalization: From RAG to Agent", arXiv.

🎯 Our repository Awesome-Personalized-RAG-Agent is a curated collection of papers, resources, benchmarks, and datasets focused on Personalized Retrieval-Augmented Generation (RAG) and personalized agentic RAG system.

Personalization has become a cornerstone in modern AI systems, enabling customized interactions that reflect individual user preferences, contexts, and goals. Recent research has increasingly explored RAG frameworks and their evolution into agent-based architectures, aiming to improve user alignment and satisfaction.

This repository systematically categorizes personalization across the three core stages of RAG:

  • Pre-retrieval (e.g., query rewriting and expansion),
  • Retrieval (e.g., indexing, personalized reranking),
  • Generation (e.g., using explicit or implicit user signals).

Beyond traditional RAG pipelines, we extend the scope to Personalized LLM Agents—systems enhanced with agentic functionalities such as dynamic user modeling, personalized planning, memory integration, and autonomous behavior.

🔥 News

  • [2025, Apr 15]:  🚀🚀 Our paper is now available on arXiv, and the reading list is on GitHub Repo.

🧭 Table of Contents

📃 Papers

1. Pre-retrieval

🔄 1.1 Query Rewriting

NameTitlePersonalized presentationPublicationPaper LinkCode Link
Least-to-most PromptingLeast-to-Most Prompting Enables Complex Reasoning in Large Language ModelsSplit by sub-query terms in different questionsICLR 2023[Link]
Personalized Search-based Query Rewrite System for Conversational AIBuild a personalized index for each userACL 2021[Link]
Agent4RankingAgent4Ranking: Semantic Robust Ranking via Personalized Query Rewriting Using Multi-agent LLMUse agents for efficient query rewriting.arXiv 2023[Link]
Least-to-most PromptingQuery Rewriting in TaoBao SearchA learning enhanced architecture based on “query retrieval−semantic relevance”.CIKM 2022[Link]
CLE-QRLearning to rewrite prompts for personalized text generationMultistage framework for personalized rewrites.WWW 2024[Link]
CGFCGF: Constrained Generation Framework for Query Rewriting in Conversational AIPersonalized prompt rewriting by using an LLM agent.ACL 2022[Link]
RL-based Query Rewriting with Distilled LLM for online E-Commerce SystemsStudent model to rewrite query.arXiv 2025[Link]
CoPSCognitive Personalized Search Integrating Large Language Models with an Efficient Memory MechanismPersonalized query intent.WWW 2024[Link]
BASESBASES: Large-scale Web Search User Simulation with Large Language Model based AgentsUser simulation agent.arXiv 2024[Link]
ERAGentERAGent: Enhancing Retrieval-Augmented Language Models with Improved Accuracy, Efficiency, and PersonalizationCollaorative module for query rewrite.arXiv 2024[Link]
PEARLPEARL: Personalizing Large Language Model Writing Assistants with Generation-Calibrated RetrieversPersonlaized LLM for query write.arXiv 2024[Link]
FIGGraph Meets LLM: A Novel Approach to Collaborative Filtering for Robust Conversational UnderstandingGraph-based methods with LLMs to query rewritearXiv 2023[Link]

➕ 1.2 Query Expansion

NameTitlePersonalized presentationPublicationPaper LinkCode Link
PNQESPersonalized Optimal Search in Local Query ExpansionSearch history, Latent semantic indexingACLCLP 2006[Link]
Exploiting social relations for query expansion and result rankingFriendship, TaggingICDE Workshop 2008[Link]
GosspleToward personalized query expansionCalculating the distance between users, constructing a personalized network that connects users with similar interests. Extracting tagsEuroSys Workshop 2009[Link]
Social tagging in query expansion: A new way for personalized web searchUser Interest TaggingCSE 2009[Link]
SoQuESpersonalized social query expansion using social bookmarking systemsExtract user tag behavior to build personalized user profiles.SIGIR 2011[Link]
Improving search via personalized query expansion using social mediaTaggingInformation retrieval 2012[Link]
Axiomatic term-based personalized query expansion using bookmarking systemBookmarking, Social NetworkInternational Conference on Database and Expert Systems Applications 2016[Link]
WE-LMpersonalized query expansion utilizing multi-relationalsocial dataTaggingSMAP Workshop 2017[Link]
PSQEpersonalized social query expansion using social annotationsUser Interest TaggingTransactions on Large-Scale Data-and Knowledge-Centered Systems XL 2019[Link]
PQEWCPersonalized Query Expansion with Contextual Word EmbeddingsEmploying topic modeling on user texts and dynamically selecting relevant wordsTOIS 2023[Link]
NameTitlePersonalized presentationPublicationPaper LinkCode Link
PSQEPSQE: Personalized Semantic Query Expansion for user-centric query disambiguationLeveraging synthetic user profiles built from Wikipedia articles, training word2vec embeddings on these profiles[Link]
BoboUtilizing user-input contextual terms for query disambiguationcontextual termsColing 2010[Link]
Personalized Query Auto-Completion Through a Lightweight Representation of the User ContextLearning embeddings from the user’s recent queriesarXiv 2019[Link]

2. Retrieval

🗂️ 2.1 Indexing

NameTitlePersonalized presentationPublicationPaper LinkCode Link
PearlPearl: Personalizing large language model writing assistants with generation-calibrated retrieversPersonalized IndexingACL 2024[Link]
KG-RetrieveKG-Retriever: Efficient Knowledge Indexing for Retrieval-Augmented Large Language ModelsHierarchical Index GrapharXiv 2024[Link]
EMG-RAGCrafting Personalized Agents through Retrieval-Augmented Generation on Editable Memory GraphsEditable Knowledge Graph for IndexingEMNLP 2024[Link]
PGraphRAGPersonalized Graph-Based Retrieval for Large Language ModelsUser-centric Knowledge Graphs for Personalized IndexingarXiv 2025[Link][Link]

🔍 2.2 Retrieve

NameTitlePersonalized presentationPublicationPaper LinkCode Link
Optimization Methods for Personalizing Large Language Models through Retrieval AugmentationGradients based on personalized scoresSIGIR 2024[Link]
MeMemoMeMemo: On-device Retrieval Augmentation for Private and Personalized Text GenerationPrivacy ProtectionSIGIR 2024 (short)[Link][Link]
LAPSDoing Personal LAPS: LLM-Augmented Dialogue Construction for Personalized Multi-Session Conversational SearchPersonalized DialogueSIGIR 2024[Link][Link]
Partner Matters! An Empirical Study on Fusing Personas for Personalized Response Selection in Retrieval-Based ChatbotsPersonalized DialogueSIGIR 2021[Link][Link]
ERRAExplainable Recommendation with Personalized Review Retrieval and Aspect LearningPersonalized RecommendationACL 2023[Link][Link]
RECAP: Retrieval-Enhanced Context-Aware Prefix Encoder for Personalized Dialogue Response GenerationPersonalized DialogueACL 2023[Link][Link]
HEARTHEART-felt Narratives: Tracing Empathy and Narrative Style in Personal Stories with LLMsPersonalized Writing StyleEMNLP 2024[Link][Link]
OPPUDemocratizing Large Language Models via Personalized Parameter-Efficient Fine-tuningPersonalized Parameter Fine-tuningEMNLP 2024[Link][Link]
LAPDOGLearning Retrieval Augmentation for Personalized Dialogue GenerationPersonalized DialogueEMNLP 2023[Link][Link]
UniMPTowards Unified Multi-Modal Personalization: Large Vision-Language Models for Generative Recommendation and BeyondPersonalized RecommendationICLR 2024[Link]
Personalized Language Generation via Bayesian Metric Augmented RetrievalPersonalized RetrievalarXiv[Link]
Leveraging Similar Users for Personalized Language Modeling with Limited DataPersonalized RetrievalACL 2022[Link]
UIAA Personalized Dense Retrieval Framework for Unified Information AccessPersonalized RetrievalSIGIR 2023[Link][Link]
XPERTPersonalized Retrieval over Millions of ItemsPersonalized RetrievalSIGIR 2023[Link][Link]
DPSRTowards personalized and semantic retrieval: An end-to-end solution for e-commerce search via embedding learningPersonalized RetrievalSIGIR 2020[Link]
PersonalTMPersonalTM: Transformer Memory for Personalized RetrievalPersonalized RetrievalSIGIR 2023 (short)[Link]
A zero attention model for personalized product searchPersonalized SearchCIKM 2019[Link]
RTMLearning a Fine-Grained Review-based Transformer Model for Personalized Product SearchPersonalized SearchSIGIR 2021[Link][Link]
Personalizing Student-Agent Interactions Using Log-Contextualized Retrieval Augmented Generation (RAG)Personalized RetrievalarXiv[Link]

🧹 2.3 Post-Retrieve

NameTitlePersonalized presentationPublicationPaper LinkCode Link
PersonaRAGPersonaRAG: Enhancing Retrieval-Augmented Generation Systems with User-Centric AgentsUser-centric Agent for RankingarXiv 2024LinkLink
Improving RAG with LoRA Finetuning for Persona Text GenerationPersonalized Re-rankingLink
UniMS-RAGUniMS-RAG: A Unified Multi-source Retrieval-Augmented Generation for Personalized Dialogue SystemsPersonalized Re-rankingarXiv 2024Link
Learning to Rank for Multiple Retrieval-Augmented Models through Iterative Utility MaximizationPersonalized RankingarXiv 2024LinkLink
Rehearse With User: Personalized Opinion Summarization via Role-Playing Based on Large Language ModelsPersonalized Opinion SummarizationarXiv 2025Link
AutoCompressorsAdapting Language Models to Compress ContextsContextual Embedding CompressionEMNLP 2023LinkLink
FIT-RAGFIT-RAG: Black-Box RAG with Factual Information and Token ReductionTokens Minization within RAGToIS 2025Link

3. Generation

🎯 3.1 Generation from Explicit Preference

NameTitlePersonalized presentationPublicationPaper LinkCode Link
P2Evaluating and inducing personality in pre-trained language modelsRole PlayingNeurIPS 2023[Link][Link]
OpinionQAWhose opinions do language models reflect?Role PlayingICML 2023[Link][Link]
Character ProfilingEvaluating Character Understanding of Large Language Models via Character Profiling from Fictional WorksRole PlayingICML 2023[Link][Link]
Do LLMs Understand User Preferences? Evaluating LLMs On User Rating PredictionPersonalized RecommendationarXiv[Link]
Cue-CoTCue-CoT: Chain-of-thought prompting for responding to in-depth dialogue questions with LLMsPersonalized DialogueEMNLP 2023[Link][Link]
TICLTuning-Free Personalized Alignment via Trial-Error-Explain In-Context LearningPersonalized Text GenerationarXiv[Link][Link]
GPGGuided Profile Generation Improves Personalization with LLMsPersonalized Text GenerationarXiv[Link]
Integrating Summarization and Retrieval for Enhanced Personalization via Large Language ModelsPersonalized Text GenerationarXiv[Link]
LLMTreeRecLLMTreeRec: Unleashing the Power of Large Language Models for Cold-Start RecommendationsPersonalized RecommendationCOLING 2025[Link][Link]
MatryoshkaMATRYOSHKA: Learning To Drive Black-Box LLMS With LLMSPersonalized Text GenerationarXiv[Link]
Learning to rewrite prompts for personalized text generationPersonalized Text GenerationWWW 2024[Link]
RecGPTRecGPT: Generative Pre-training for Text-based RecommendationPersonalized RecommendationACL 2024[Link][Link]
PEPLER-DPersonalized prompt learning for explainable recommendationPersonalized RecommendationTOIS 2023[Link][Link]
SGPTUnlocking the potential of prompt-tuning in bridging generalized and personalized federated learningPersonalized Federated LearningCVPR 2024[Link][Link]
PFCLPersonalized federated continual learning via multi-granularity promptPersonalized Federated LearningKDD 2024[Link][Link]
Measuring What Makes You Unique: Difference-Aware User Modeling for Enhancing LLM PersonalizationPersonalized Text GenerationACL Findings 2025[Link][Link]

🕵️ 3.2 Generation from Implicit Preference

NameTitlePersonalized presentationPublicationPaper LinkCode Link
PLoRAPersonalized LoRA for Human-Centered Text UnderstandingPersonalized Text UnderstandingAAAI 2024[Link][Link]
LM-PPersonalized Large Language ModelsPersonalized Fine-tuningSENTIRE 2024 (ICDM Workshop)[Link][Link]
MiLPPersonalized LLM Response Generation with Parameterized User Memory InjectionPersonalized Text GenerationarXiv[Link][Link]
OPPUDemocratizing Large Language Models via Personalized Parameter-Efficient Fine-tuningPersonalized Text GenerationEMNLP 2024[Link][Link]
PER-PCSPERSONALIZED PIECES: Efficient Personalized Large Language Models through Collaborative EffortsPersonalized Text GenerationEMNLP 2024[Link][Link]
Review-LLMReview-LLM: Harnessing Large Language Models for Personalized Review GenerationPersonalized Review GenerationarXiv[Link]
UserIdentifierUserIdentifier: Implicit User Representations for Simple and Effective Personalized Sentiment AnalysisPersonalized Text UnderstandingNAACL 2022[Link]
UserAdapterUserAdapter: Few-Shot User Learning in Sentiment AnalysisPersonalized Text UnderstandingACL Fingdings 2021[Link]
HYDRAHYDRA: Model Factorization Framework for Black-Box LLM PersonalizationPersonalized Reranking and GenerationNeurIPS 2024[Link][Link]
PocketLLMPocketLLM: Enabling On-Device Fine-Tuning for Personalized LLMsPersonalized Text GenerationPrivateNLP 2024 (ACL Workshop)[Link]
CoGenesisCoGenesis: A Framework Collaborating Large and Small Language Models for Secure Context-Aware Instruction FollowingPersonalized Text GenerationACl 2024[Link][Link]
P-RLHFP-RLHF: Personalized Language Modeling from Personalized Human FeedbackPersonalized Text GenerationarXiv[Link][Link]
P-SOUPSPersonalized Soups: Personalized Large Language Model Alignment via Post-hoc Parameter MergingPersonalized Text GenerationAdaptive Foundation Models 2024 (NeurIPS 2024)[Link][Link]
PADPAD: Personalized Alignment of LLMs at Decoding-TimePersonalized Text GenerationICLR 2025[Link][Link]
REST-PGReasoning-enhanced self-training for long-form personalized Text GenerationPersonalized Text GenerationarXiv[Link]
Optimization Methods for Personalizing Large Language Models through Retrieval AugmentationPersonalized Retrieval and GenerationSIGIR 2024[Link]
RewriterSlRlLearning to Rewrite Prompts for Personalized Text GenerationPersonalized Text GenerationWWW 2024[Link]
Reinforcement learning for optimizing rag for domain chatbotsPersonalized ChatbotRL+LLMs 2024 (AAAI Workshop)[Link]

4. Agentic RAG

🧠 4.1 Understanding

NameTitlePersonalized PresentationPublicationPaper LinkCode Link
Penetrative AI: Making LLMs Comprehend the Physical WorldUser interaction with physical-world data via sensorsACL Findings 2024LinkLink
Conversational Health Agents: A Personalized LLM-Powered Agent FrameworkPersonalized healthcare support via health data and knowledge basearXiv 2024LinkLink
RoleLLMRoleLLM: Benchmarking, eliciting, and enhancing role-playing abilities of large language modelsLLMs role-playing charactersarXiv 2024Link
Character-llmCharacter-llm: A trainable agent for role-playingLLM character simulation with memory/personalityEMNLP 2023LinkLink
InCharacterEvaluating personality fidelity in role-playing agents through psychological interviewsPsychological evaluation of role-play agentsACL 2024LinkLink
SocialbenchSocialbench: Sociality evaluation of role-playing conversational agentsBenchmarking social interaction ability in role-playingACL Findings 2024LinkLink
MMroleMmrole: A comprehensive framework for developing and evaluating multimodal role-playing agentsDeveloping and Evaluating Multimodal Role-Playing AgentsICLR 2025LinkLink
Enhancing role-playing language models with personality-indicative dataLeveraging psychological scale questions for agent personality modellingEMNLP Findings 2024LinkLink
Enabling Conversational Interaction with Mobile UI using Large Language ModelsMobile UI interaction with LLMsCHI 2023Link
CharacterEvalA chinese benchmark for role-playing conversational agent evaluationChinese dataset for role-playing agent evaluationarXiv 2024LinkLink
NeekoNeeko: Leveraging dynamic lora for efficient multi-character role-playing agentEfficient multi-character simulationEMNLP 2024LinkLink

🗺️ 4.2 Planing and Execution

NameTitlePersonalized PresentationPublicationPaper LinkCode Link
EMG-RAGCrafting Personalized Agents through Retrieval-Augmented Generation on Editable Memory GraphsPersonalized assistant using user memoryEMNLP 2024Link
Generative agents: Interactive simulacra of human behaviorSimulation of social and individual behaviors in Stanford TownUIST 2023Link
Conversational Health Agents: A Personalized LLM-Powered Agent FrameworkPersonalized healthcare support via health data and knowledge basearXiv 2024LinkLink
User Behavior Simulation with Large Language Model based AgentsSimulation of user behavior in recommender systemsarXiv 2024Link
Personal Large Language Model Agents: A Case Study on Tailored Travel PlanningTailored travel based on user preferencesEMNLP 2024Link
PersonalWABLarge Language Models Empowered Personalized Web AgentsUser profile + web action optimizationWWW 2025 OralLink
Voyager: An Open-Ended Embodied Agent with Large Language ModelsMinecraft agent simulation and skill learningTMLR 2024LinkLink
MEMORYLLM: Towards Self-Updatable Large Language ModelsSelf-evolution via memory updateICML 2024Link
Bootstrap Your Own Skills: Learning to Solve New Tasks with Large Language Model GuidanceRobotic arm learning to manipulate objectsCoRL 2023LinkLink
Enabling Conversational Interaction with Mobile UI using Large Language ModelsMobile UI interaction with LLMsCHI 2023Link
Penetrative AI: Making LLMs Comprehend the Physical WorldUser interaction with physical-world data via sensorsACL Findings 2024LinkLink
Language models as zero-shot planners: Extracting actionable knowledge for embodied agentsTask planning in virtual environmentsICML 2022LinkLink
MetaGPTMetagpt: Meta programming for multi-agent collaborative frameworkMulti-agent collaboration for complex tasksICLR 2024Link
OKR-AgentAgents meet okr: An object and key results driven agent system with hierarchical self-collaboration and self-evaluationRole-assigned agents solving creative tasksarXiv 2023LinkLink

✍️ 4.3 Generation

NameTitlePersonalized PresentationPublicationPaper LinkCode Link
Character-llmCharacter-llm: A trainable agent for role-playingLLM character simulation with memory/personalityEMNLP 2023LinkLink
Investigating the Personality Consistency in Quantized Role-Playing Dialogue AgentsRobustness and consistency in constrained setupsEMNLP 2024Link
MMroleMmrole: A comprehensive framework for developing and evaluating multimodal role-playing agentsDeveloping and Evaluating Multimodal Role-Playing AgentsICLR 2025LinkLink
RoleLLMRoleLLM: Benchmarking, eliciting, and enhancing role-playing abilities of large language modelsLLMs role-playing charactersarXiv 2024Link
Enhancing role-playing language models with personality-indicative dataPersonality-focused character simulationEMNLP 2024 FindingsLinkLink
InCharacterEvaluating personality fidelity in role-playing agents through psychological interviewsPsychological evaluation of role-play agentsACL 2024LinkLink
SocialbenchSocialbench: Sociality evaluation of role-playing conversational agentsBenchmarking social interaction ability in role-playingACL Findings 2024LinkLink
PersonaAgentWhen Large Language Model Agents Meet Personalization at Test TimePersonalized LLM agent frameworkarXiv 2025Link

📚 Datasets and Evaluation

FieldDatasetMetricsLink
Query RewritingSCANAccuracyLink
Query RewritingRobust04AccuracyLink
Query RewritingAvocado Research Email CollectionBLEU, ROUGELink
Query RewritingAmazon ReviewBLEU, ROUGELink
Query RewritingReddit CommentsBLEU, ROUGELink
Query RewritingAmazon ESCI DatasetEM, ROUGE-L, XEntropyLink
Query RewritingAOLMAP, MRR, P@1Link
Query RewritingWARRIORSMRR, NDCGLink
Query RewritingAITA WORKSMMacro-F1, BS-F1Link
Query RewritingPIPPMS, Image-Align, ROUGELink
Query ExpansionPersonalized Results Re-RankingMAP, MRR, NDCG, RBPLink
Query Expansiondel.icio.usPrecision, MAP, MRR, RecallLink
Query ExpansionFlickrPrecisionLink
Query ExpansionCiteULikeRecall, MAP, MRRLink
Query ExpansionLRDPPrecision, Recall, F1Link
Query ExpansionDeliciousMAP, MRRLink
Query ExpansionFlickrMAP, MRRLink
Query ExpansionBibsonomyMAP, Precision, PQEC, Prof-overlapLink
Other Query-relatedWikipediaPrecision, RecallLink
Retrieval / GenerationTOPDIALBLEU, F1, Success RateLink
Retrieval / GenerationLiveChatRecall, MRRLink
Retrieval / GenerationPersonalityEvdAccuracy, Fluency, Coherence, PlausibilityLink
Retrieval / GenerationPchatbotBLEU, ROUGE, Distinct, MRRLink
Retrieval / GenerationDuLemonPerplexity, BLEU, Accuracy, Precision, Recall, F1Link
Retrieval / GenerationPersonalityEditES, DD, Accuracy, TPEI, PAELink
GenerationLaMPAccuracy, F1, MAE, RMSE, ROUGELink
GenerationLongLaMPAccuracy, F1, MAE, RMSE, ROUGELink
GenerationPGraphRAGROUGE, METEOR, MAE, RMSELink
GenerationAmazonQA ProductsROUGE, Persona-F1Link
GenerationRedditROUGE, Persona-F1Link
GenerationMedicalDialogueROUGE, Persona-F1Link
GenerationPersonalized-genMean Success Rate, Median Relative Improvements, FluencyLink
GenrationPersonaBenchRecall, F1, NDCGLink
GenerationPERSONAMEMDiscriminative & Generative SettingsLink
GenerationREALTALKLexical Sim., Semantic Sim., EI, Partial-Exact-Match F1, LLM AccuracyLink
GenerationUserBenchBest Exist Rate, Correct Exist Rate, Score, Search Attempt Valid, Action Attempt Valid, Preference ElicitedLink

📚 Surveys

🧠 Personalized LLMs

🎭 Personalized Role-Playing

📁 Repositories

🚀 Contributing

We sincerely welcome you to contribute to this repository!

🙌 Whether you're adding new papers or datasets/benchmarks, fixing bugs, improving the documentation, or suggesting ideas, every bit of help is appreciated.

📌 Citation

If you find this repository useful in your research, please consider citing our paper:

@article{li2025survey,
  title={A Survey of Personalization: From RAG to Agent},
  author={Li, Xiaopeng and Jia, Pengyue and Xu, Derong and Wen, Yi and Zhang, Yingyi and Zhang, Wenlin and Wang, Wanyu and Wang, Yichao and Du, Zhaocheng and Li, Xiangyang and others},
  journal={arXiv preprint arXiv:2504.10147},
  year={2025}
}
agent
awesome
large-language-model
llm
llms
personalization
rag

Applied-Machine-Learning-Lab/Awesome-Personalized-RAG-Agent

A Survey of Personalization: From RAG to Agent

119

33 commits

updated Aug 6, 2025

See the code

README

Logo

Awesome-Personalized-RAG-Agent

Static Badge

📘 Overview

This is the official repository of the paper "A Survey of Personalization: From RAG to Agent", arXiv.

🎯 Our repository Awesome-Personalized-RAG-Agent is a curated collection of papers, resources, benchmarks, and datasets focused on Personalized Retrieval-Augmented Generation (RAG) and personalized agentic RAG system.

Personalization has become a cornerstone in modern AI systems, enabling customized interactions that reflect individual user preferences, contexts, and goals. Recent research has increasingly explored RAG frameworks and their evolution into agent-based architectures, aiming to improve user alignment and satisfaction.

This repository systematically categorizes personalization across the three core stages of RAG:

  • Pre-retrieval (e.g., query rewriting and expansion),
  • Retrieval (e.g., indexing, personalized reranking),
  • Generation (e.g., using explicit or implicit user signals).

Beyond traditional RAG pipelines, we extend the scope to Personalized LLM Agents—systems enhanced with agentic functionalities such as dynamic user modeling, personalized planning, memory integration, and autonomous behavior.

🔥 News

  • [2025, Apr 15]:  🚀🚀 Our paper is now available on arXiv, and the reading list is on GitHub Repo.

🧭 Table of Contents

📃 Papers

1. Pre-retrieval

🔄 1.1 Query Rewriting

NameTitlePersonalized presentationPublicationPaper LinkCode Link
Least-to-most PromptingLeast-to-Most Prompting Enables Complex Reasoning in Large Language ModelsSplit by sub-query terms in different questionsICLR 2023[Link]
Personalized Search-based Query Rewrite System for Conversational AIBuild a personalized index for each userACL 2021[Link]
Agent4RankingAgent4Ranking: Semantic Robust Ranking via Personalized Query Rewriting Using Multi-agent LLMUse agents for efficient query rewriting.arXiv 2023[Link]
Least-to-most PromptingQuery Rewriting in TaoBao SearchA learning enhanced architecture based on “query retrieval−semantic relevance”.CIKM 2022[Link]
CLE-QRLearning to rewrite prompts for personalized text generationMultistage framework for personalized rewrites.WWW 2024[Link]
CGFCGF: Constrained Generation Framework for Query Rewriting in Conversational AIPersonalized prompt rewriting by using an LLM agent.ACL 2022[Link]
RL-based Query Rewriting with Distilled LLM for online E-Commerce SystemsStudent model to rewrite query.arXiv 2025[Link]
CoPSCognitive Personalized Search Integrating Large Language Models with an Efficient Memory MechanismPersonalized query intent.WWW 2024[Link]
BASESBASES: Large-scale Web Search User Simulation with Large Language Model based AgentsUser simulation agent.arXiv 2024[Link]
ERAGentERAGent: Enhancing Retrieval-Augmented Language Models with Improved Accuracy, Efficiency, and PersonalizationCollaorative module for query rewrite.arXiv 2024[Link]
PEARLPEARL: Personalizing Large Language Model Writing Assistants with Generation-Calibrated RetrieversPersonlaized LLM for query write.arXiv 2024[Link]
FIGGraph Meets LLM: A Novel Approach to Collaborative Filtering for Robust Conversational UnderstandingGraph-based methods with LLMs to query rewritearXiv 2023[Link]

➕ 1.2 Query Expansion

NameTitlePersonalized presentationPublicationPaper LinkCode Link
PNQESPersonalized Optimal Search in Local Query ExpansionSearch history, Latent semantic indexingACLCLP 2006[Link]
Exploiting social relations for query expansion and result rankingFriendship, TaggingICDE Workshop 2008[Link]
GosspleToward personalized query expansionCalculating the distance between users, constructing a personalized network that connects users with similar interests. Extracting tagsEuroSys Workshop 2009[Link]
Social tagging in query expansion: A new way for personalized web searchUser Interest TaggingCSE 2009[Link]
SoQuESpersonalized social query expansion using social bookmarking systemsExtract user tag behavior to build personalized user profiles.SIGIR 2011[Link]
Improving search via personalized query expansion using social mediaTaggingInformation retrieval 2012[Link]
Axiomatic term-based personalized query expansion using bookmarking systemBookmarking, Social NetworkInternational Conference on Database and Expert Systems Applications 2016[Link]
WE-LMpersonalized query expansion utilizing multi-relationalsocial dataTaggingSMAP Workshop 2017[Link]
PSQEpersonalized social query expansion using social annotationsUser Interest TaggingTransactions on Large-Scale Data-and Knowledge-Centered Systems XL 2019[Link]
PQEWCPersonalized Query Expansion with Contextual Word EmbeddingsEmploying topic modeling on user texts and dynamically selecting relevant wordsTOIS 2023[Link]
NameTitlePersonalized presentationPublicationPaper LinkCode Link
PSQEPSQE: Personalized Semantic Query Expansion for user-centric query disambiguationLeveraging synthetic user profiles built from Wikipedia articles, training word2vec embeddings on these profiles[Link]
BoboUtilizing user-input contextual terms for query disambiguationcontextual termsColing 2010[Link]
Personalized Query Auto-Completion Through a Lightweight Representation of the User ContextLearning embeddings from the user’s recent queriesarXiv 2019[Link]

2. Retrieval

🗂️ 2.1 Indexing

NameTitlePersonalized presentationPublicationPaper LinkCode Link
PearlPearl: Personalizing large language model writing assistants with generation-calibrated retrieversPersonalized IndexingACL 2024[Link]
KG-RetrieveKG-Retriever: Efficient Knowledge Indexing for Retrieval-Augmented Large Language ModelsHierarchical Index GrapharXiv 2024[Link]
EMG-RAGCrafting Personalized Agents through Retrieval-Augmented Generation on Editable Memory GraphsEditable Knowledge Graph for IndexingEMNLP 2024[Link]
PGraphRAGPersonalized Graph-Based Retrieval for Large Language ModelsUser-centric Knowledge Graphs for Personalized IndexingarXiv 2025[Link][Link]

🔍 2.2 Retrieve

NameTitlePersonalized presentationPublicationPaper LinkCode Link
Optimization Methods for Personalizing Large Language Models through Retrieval AugmentationGradients based on personalized scoresSIGIR 2024[Link]
MeMemoMeMemo: On-device Retrieval Augmentation for Private and Personalized Text GenerationPrivacy ProtectionSIGIR 2024 (short)[Link][Link]
LAPSDoing Personal LAPS: LLM-Augmented Dialogue Construction for Personalized Multi-Session Conversational SearchPersonalized DialogueSIGIR 2024[Link][Link]
Partner Matters! An Empirical Study on Fusing Personas for Personalized Response Selection in Retrieval-Based ChatbotsPersonalized DialogueSIGIR 2021[Link][Link]
ERRAExplainable Recommendation with Personalized Review Retrieval and Aspect LearningPersonalized RecommendationACL 2023[Link][Link]
RECAP: Retrieval-Enhanced Context-Aware Prefix Encoder for Personalized Dialogue Response GenerationPersonalized DialogueACL 2023[Link][Link]
HEARTHEART-felt Narratives: Tracing Empathy and Narrative Style in Personal Stories with LLMsPersonalized Writing StyleEMNLP 2024[Link][Link]
OPPUDemocratizing Large Language Models via Personalized Parameter-Efficient Fine-tuningPersonalized Parameter Fine-tuningEMNLP 2024[Link][Link]
LAPDOGLearning Retrieval Augmentation for Personalized Dialogue GenerationPersonalized DialogueEMNLP 2023[Link][Link]
UniMPTowards Unified Multi-Modal Personalization: Large Vision-Language Models for Generative Recommendation and BeyondPersonalized RecommendationICLR 2024[Link]
Personalized Language Generation via Bayesian Metric Augmented RetrievalPersonalized RetrievalarXiv[Link]
Leveraging Similar Users for Personalized Language Modeling with Limited DataPersonalized RetrievalACL 2022[Link]
UIAA Personalized Dense Retrieval Framework for Unified Information AccessPersonalized RetrievalSIGIR 2023[Link][Link]
XPERTPersonalized Retrieval over Millions of ItemsPersonalized RetrievalSIGIR 2023[Link][Link]
DPSRTowards personalized and semantic retrieval: An end-to-end solution for e-commerce search via embedding learningPersonalized RetrievalSIGIR 2020[Link]
PersonalTMPersonalTM: Transformer Memory for Personalized RetrievalPersonalized RetrievalSIGIR 2023 (short)[Link]
A zero attention model for personalized product searchPersonalized SearchCIKM 2019[Link]
RTMLearning a Fine-Grained Review-based Transformer Model for Personalized Product SearchPersonalized SearchSIGIR 2021[Link][Link]
Personalizing Student-Agent Interactions Using Log-Contextualized Retrieval Augmented Generation (RAG)Personalized RetrievalarXiv[Link]

🧹 2.3 Post-Retrieve

NameTitlePersonalized presentationPublicationPaper LinkCode Link
PersonaRAGPersonaRAG: Enhancing Retrieval-Augmented Generation Systems with User-Centric AgentsUser-centric Agent for RankingarXiv 2024LinkLink
Improving RAG with LoRA Finetuning for Persona Text GenerationPersonalized Re-rankingLink
UniMS-RAGUniMS-RAG: A Unified Multi-source Retrieval-Augmented Generation for Personalized Dialogue SystemsPersonalized Re-rankingarXiv 2024Link
Learning to Rank for Multiple Retrieval-Augmented Models through Iterative Utility MaximizationPersonalized RankingarXiv 2024LinkLink
Rehearse With User: Personalized Opinion Summarization via Role-Playing Based on Large Language ModelsPersonalized Opinion SummarizationarXiv 2025Link
AutoCompressorsAdapting Language Models to Compress ContextsContextual Embedding CompressionEMNLP 2023LinkLink
FIT-RAGFIT-RAG: Black-Box RAG with Factual Information and Token ReductionTokens Minization within RAGToIS 2025Link

3. Generation

🎯 3.1 Generation from Explicit Preference

NameTitlePersonalized presentationPublicationPaper LinkCode Link
P2Evaluating and inducing personality in pre-trained language modelsRole PlayingNeurIPS 2023[Link][Link]
OpinionQAWhose opinions do language models reflect?Role PlayingICML 2023[Link][Link]
Character ProfilingEvaluating Character Understanding of Large Language Models via Character Profiling from Fictional WorksRole PlayingICML 2023[Link][Link]
Do LLMs Understand User Preferences? Evaluating LLMs On User Rating PredictionPersonalized RecommendationarXiv[Link]
Cue-CoTCue-CoT: Chain-of-thought prompting for responding to in-depth dialogue questions with LLMsPersonalized DialogueEMNLP 2023[Link][Link]
TICLTuning-Free Personalized Alignment via Trial-Error-Explain In-Context LearningPersonalized Text GenerationarXiv[Link][Link]
GPGGuided Profile Generation Improves Personalization with LLMsPersonalized Text GenerationarXiv[Link]
Integrating Summarization and Retrieval for Enhanced Personalization via Large Language ModelsPersonalized Text GenerationarXiv[Link]
LLMTreeRecLLMTreeRec: Unleashing the Power of Large Language Models for Cold-Start RecommendationsPersonalized RecommendationCOLING 2025[Link][Link]
MatryoshkaMATRYOSHKA: Learning To Drive Black-Box LLMS With LLMSPersonalized Text GenerationarXiv[Link]
Learning to rewrite prompts for personalized text generationPersonalized Text GenerationWWW 2024[Link]
RecGPTRecGPT: Generative Pre-training for Text-based RecommendationPersonalized RecommendationACL 2024[Link][Link]
PEPLER-DPersonalized prompt learning for explainable recommendationPersonalized RecommendationTOIS 2023[Link][Link]
SGPTUnlocking the potential of prompt-tuning in bridging generalized and personalized federated learningPersonalized Federated LearningCVPR 2024[Link][Link]
PFCLPersonalized federated continual learning via multi-granularity promptPersonalized Federated LearningKDD 2024[Link][Link]
Measuring What Makes You Unique: Difference-Aware User Modeling for Enhancing LLM PersonalizationPersonalized Text GenerationACL Findings 2025[Link][Link]

🕵️ 3.2 Generation from Implicit Preference

NameTitlePersonalized presentationPublicationPaper LinkCode Link
PLoRAPersonalized LoRA for Human-Centered Text UnderstandingPersonalized Text UnderstandingAAAI 2024[Link][Link]
LM-PPersonalized Large Language ModelsPersonalized Fine-tuningSENTIRE 2024 (ICDM Workshop)[Link][Link]
MiLPPersonalized LLM Response Generation with Parameterized User Memory InjectionPersonalized Text GenerationarXiv[Link][Link]
OPPUDemocratizing Large Language Models via Personalized Parameter-Efficient Fine-tuningPersonalized Text GenerationEMNLP 2024[Link][Link]
PER-PCSPERSONALIZED PIECES: Efficient Personalized Large Language Models through Collaborative EffortsPersonalized Text GenerationEMNLP 2024[Link][Link]
Review-LLMReview-LLM: Harnessing Large Language Models for Personalized Review GenerationPersonalized Review GenerationarXiv[Link]
UserIdentifierUserIdentifier: Implicit User Representations for Simple and Effective Personalized Sentiment AnalysisPersonalized Text UnderstandingNAACL 2022[Link]
UserAdapterUserAdapter: Few-Shot User Learning in Sentiment AnalysisPersonalized Text UnderstandingACL Fingdings 2021[Link]
HYDRAHYDRA: Model Factorization Framework for Black-Box LLM PersonalizationPersonalized Reranking and GenerationNeurIPS 2024[Link][Link]
PocketLLMPocketLLM: Enabling On-Device Fine-Tuning for Personalized LLMsPersonalized Text GenerationPrivateNLP 2024 (ACL Workshop)[Link]
CoGenesisCoGenesis: A Framework Collaborating Large and Small Language Models for Secure Context-Aware Instruction FollowingPersonalized Text GenerationACl 2024[Link][Link]
P-RLHFP-RLHF: Personalized Language Modeling from Personalized Human FeedbackPersonalized Text GenerationarXiv[Link][Link]
P-SOUPSPersonalized Soups: Personalized Large Language Model Alignment via Post-hoc Parameter MergingPersonalized Text GenerationAdaptive Foundation Models 2024 (NeurIPS 2024)[Link][Link]
PADPAD: Personalized Alignment of LLMs at Decoding-TimePersonalized Text GenerationICLR 2025[Link][Link]
REST-PGReasoning-enhanced self-training for long-form personalized Text GenerationPersonalized Text GenerationarXiv[Link]
Optimization Methods for Personalizing Large Language Models through Retrieval AugmentationPersonalized Retrieval and GenerationSIGIR 2024[Link]
RewriterSlRlLearning to Rewrite Prompts for Personalized Text GenerationPersonalized Text GenerationWWW 2024[Link]
Reinforcement learning for optimizing rag for domain chatbotsPersonalized ChatbotRL+LLMs 2024 (AAAI Workshop)[Link]

4. Agentic RAG

🧠 4.1 Understanding

NameTitlePersonalized PresentationPublicationPaper LinkCode Link
Penetrative AI: Making LLMs Comprehend the Physical WorldUser interaction with physical-world data via sensorsACL Findings 2024LinkLink
Conversational Health Agents: A Personalized LLM-Powered Agent FrameworkPersonalized healthcare support via health data and knowledge basearXiv 2024LinkLink
RoleLLMRoleLLM: Benchmarking, eliciting, and enhancing role-playing abilities of large language modelsLLMs role-playing charactersarXiv 2024Link
Character-llmCharacter-llm: A trainable agent for role-playingLLM character simulation with memory/personalityEMNLP 2023LinkLink
InCharacterEvaluating personality fidelity in role-playing agents through psychological interviewsPsychological evaluation of role-play agentsACL 2024LinkLink
SocialbenchSocialbench: Sociality evaluation of role-playing conversational agentsBenchmarking social interaction ability in role-playingACL Findings 2024LinkLink
MMroleMmrole: A comprehensive framework for developing and evaluating multimodal role-playing agentsDeveloping and Evaluating Multimodal Role-Playing AgentsICLR 2025LinkLink
Enhancing role-playing language models with personality-indicative dataLeveraging psychological scale questions for agent personality modellingEMNLP Findings 2024LinkLink
Enabling Conversational Interaction with Mobile UI using Large Language ModelsMobile UI interaction with LLMsCHI 2023Link
CharacterEvalA chinese benchmark for role-playing conversational agent evaluationChinese dataset for role-playing agent evaluationarXiv 2024LinkLink
NeekoNeeko: Leveraging dynamic lora for efficient multi-character role-playing agentEfficient multi-character simulationEMNLP 2024LinkLink

🗺️ 4.2 Planing and Execution

NameTitlePersonalized PresentationPublicationPaper LinkCode Link
EMG-RAGCrafting Personalized Agents through Retrieval-Augmented Generation on Editable Memory GraphsPersonalized assistant using user memoryEMNLP 2024Link
Generative agents: Interactive simulacra of human behaviorSimulation of social and individual behaviors in Stanford TownUIST 2023Link
Conversational Health Agents: A Personalized LLM-Powered Agent FrameworkPersonalized healthcare support via health data and knowledge basearXiv 2024LinkLink
User Behavior Simulation with Large Language Model based AgentsSimulation of user behavior in recommender systemsarXiv 2024Link
Personal Large Language Model Agents: A Case Study on Tailored Travel PlanningTailored travel based on user preferencesEMNLP 2024Link
PersonalWABLarge Language Models Empowered Personalized Web AgentsUser profile + web action optimizationWWW 2025 OralLink
Voyager: An Open-Ended Embodied Agent with Large Language ModelsMinecraft agent simulation and skill learningTMLR 2024LinkLink
MEMORYLLM: Towards Self-Updatable Large Language ModelsSelf-evolution via memory updateICML 2024Link
Bootstrap Your Own Skills: Learning to Solve New Tasks with Large Language Model GuidanceRobotic arm learning to manipulate objectsCoRL 2023LinkLink
Enabling Conversational Interaction with Mobile UI using Large Language ModelsMobile UI interaction with LLMsCHI 2023Link
Penetrative AI: Making LLMs Comprehend the Physical WorldUser interaction with physical-world data via sensorsACL Findings 2024LinkLink
Language models as zero-shot planners: Extracting actionable knowledge for embodied agentsTask planning in virtual environmentsICML 2022LinkLink
MetaGPTMetagpt: Meta programming for multi-agent collaborative frameworkMulti-agent collaboration for complex tasksICLR 2024Link
OKR-AgentAgents meet okr: An object and key results driven agent system with hierarchical self-collaboration and self-evaluationRole-assigned agents solving creative tasksarXiv 2023LinkLink

✍️ 4.3 Generation

NameTitlePersonalized PresentationPublicationPaper LinkCode Link
Character-llmCharacter-llm: A trainable agent for role-playingLLM character simulation with memory/personalityEMNLP 2023LinkLink
Investigating the Personality Consistency in Quantized Role-Playing Dialogue AgentsRobustness and consistency in constrained setupsEMNLP 2024Link
MMroleMmrole: A comprehensive framework for developing and evaluating multimodal role-playing agentsDeveloping and Evaluating Multimodal Role-Playing AgentsICLR 2025LinkLink
RoleLLMRoleLLM: Benchmarking, eliciting, and enhancing role-playing abilities of large language modelsLLMs role-playing charactersarXiv 2024Link
Enhancing role-playing language models with personality-indicative dataPersonality-focused character simulationEMNLP 2024 FindingsLinkLink
InCharacterEvaluating personality fidelity in role-playing agents through psychological interviewsPsychological evaluation of role-play agentsACL 2024LinkLink
SocialbenchSocialbench: Sociality evaluation of role-playing conversational agentsBenchmarking social interaction ability in role-playingACL Findings 2024LinkLink
PersonaAgentWhen Large Language Model Agents Meet Personalization at Test TimePersonalized LLM agent frameworkarXiv 2025Link

📚 Datasets and Evaluation

FieldDatasetMetricsLink
Query RewritingSCANAccuracyLink
Query RewritingRobust04AccuracyLink
Query RewritingAvocado Research Email CollectionBLEU, ROUGELink
Query RewritingAmazon ReviewBLEU, ROUGELink
Query RewritingReddit CommentsBLEU, ROUGELink
Query RewritingAmazon ESCI DatasetEM, ROUGE-L, XEntropyLink
Query RewritingAOLMAP, MRR, P@1Link
Query RewritingWARRIORSMRR, NDCGLink
Query RewritingAITA WORKSMMacro-F1, BS-F1Link
Query RewritingPIPPMS, Image-Align, ROUGELink
Query ExpansionPersonalized Results Re-RankingMAP, MRR, NDCG, RBPLink
Query Expansiondel.icio.usPrecision, MAP, MRR, RecallLink
Query ExpansionFlickrPrecisionLink
Query ExpansionCiteULikeRecall, MAP, MRRLink
Query ExpansionLRDPPrecision, Recall, F1Link
Query ExpansionDeliciousMAP, MRRLink
Query ExpansionFlickrMAP, MRRLink
Query ExpansionBibsonomyMAP, Precision, PQEC, Prof-overlapLink
Other Query-relatedWikipediaPrecision, RecallLink
Retrieval / GenerationTOPDIALBLEU, F1, Success RateLink
Retrieval / GenerationLiveChatRecall, MRRLink
Retrieval / GenerationPersonalityEvdAccuracy, Fluency, Coherence, PlausibilityLink
Retrieval / GenerationPchatbotBLEU, ROUGE, Distinct, MRRLink
Retrieval / GenerationDuLemonPerplexity, BLEU, Accuracy, Precision, Recall, F1Link
Retrieval / GenerationPersonalityEditES, DD, Accuracy, TPEI, PAELink
GenerationLaMPAccuracy, F1, MAE, RMSE, ROUGELink
GenerationLongLaMPAccuracy, F1, MAE, RMSE, ROUGELink
GenerationPGraphRAGROUGE, METEOR, MAE, RMSELink
GenerationAmazonQA ProductsROUGE, Persona-F1Link
GenerationRedditROUGE, Persona-F1Link
GenerationMedicalDialogueROUGE, Persona-F1Link
GenerationPersonalized-genMean Success Rate, Median Relative Improvements, FluencyLink
GenrationPersonaBenchRecall, F1, NDCGLink
GenerationPERSONAMEMDiscriminative & Generative SettingsLink
GenerationREALTALKLexical Sim., Semantic Sim., EI, Partial-Exact-Match F1, LLM AccuracyLink
GenerationUserBenchBest Exist Rate, Correct Exist Rate, Score, Search Attempt Valid, Action Attempt Valid, Preference ElicitedLink

📚 Surveys

🧠 Personalized LLMs

🎭 Personalized Role-Playing

📁 Repositories

🚀 Contributing

We sincerely welcome you to contribute to this repository!

🙌 Whether you're adding new papers or datasets/benchmarks, fixing bugs, improving the documentation, or suggesting ideas, every bit of help is appreciated.

📌 Citation

If you find this repository useful in your research, please consider citing our paper:

@article{li2025survey,
  title={A Survey of Personalization: From RAG to Agent},
  author={Li, Xiaopeng and Jia, Pengyue and Xu, Derong and Wen, Yi and Zhang, Yingyi and Zhang, Wenlin and Wang, Wanyu and Wang, Yichao and Du, Zhaocheng and Li, Xiangyang and others},
  journal={arXiv preprint arXiv:2504.10147},
  year={2025}
}
agent
awesome
large-language-model
llm
llms
personalization
rag