6 repos
xlang-ai/BRIGHT
[ICLR 2025] BRIGHT: A Realistic and Challenging Benchmark for Reasoning-Intensive Retrieval
214
26 commits
jacklanda/SemanticQA
[ACL 2026 Oral] Revisiting a Pain in the Neck: A Semantic Reasoning Benchmark for Language Models
11
48 commits
yale-nlp/Bright-Pro
Bright-Pro
1
2 commits
facebook/WearableQA
WearableQA
14
j991222/mirb
MIRB: Mathematical Information Retrieval Benchmark
3
3 commits
perplexity-ai/q2d-web-leaderboard
Q2D-Web leaderboard
19
10 commits