10 repos
Dense retrieval systems and retrieval-augmented generation (RAG) pipelines for language models, with focus on efficient neural retrieval methods like ColBERT and ColPali. The cluster covers distillation techniques for compressing retrieval models, multi-query and single-query dense retrieval approaches, and optimizations for integrating retrieval components into large language model workflows. Repositories here span implementations, model variants, and performance-tuning strategies for production RAG systems.