Exploring MAML + RL for LLM Agent in Long-Horizon Environments
0
stars
8
commits
Python
primary language
Aug 21, 2026
updated
8 commits
NVIDIA-NeMo/RL
Scalable toolkit for efficient model reinforcement
2,005
MiG-NJU/PersonaVLM
[CVPR 2026 Highlight] PersonaVLM: Long-Term Personalized Multimodal LLMs
121
hoangNguyen210/Reinforcement-Learning-CBM
To RL-CBM
sathishkumar67/Mamba
Implementation of Mamba(State Space Model)
Leosang-lx/LLM-Inference
Research and develop distributed LLM inference
alibaba/ROLL
An Efficient and User-Friendly Scaling Library for Reinforcement Learning with Large Language Models
3,391
rainbow-brain/LLM_Embedding_Finetuning
LLM을 활용하기 위한 Embedding 모델과, LLM 모델의 finetuning 하는 방법을 모은 곳
BytedTsinghua-SIA/MemAgent
A MemAgent framework that can be extrapolated to 3.5M, along with a training framework for RL…
1,105
57.5%
Jupyter Notebook
25.8%
C
10.8%
Shell
3.1%
PDDL
1.4%