basicv8vc/SimpleQA

Dataset

SimpleQA

32

4 commits

2 linked in READMEs

updated Nov 5, 2024

See the code

README

SimpleQA

A factuality benchmark called SimpleQA that measures the ability for language models to answer short, fact-seeking questions.

Sources

openai/simple-evals

Introducing SimpleQA

Measuring short-form factuality in large language models

Contributors

basicv8vc

4 commits

basicv8vc/SimpleQA

Dataset

SimpleQA

32

4 commits

2 linked in READMEs

updated Nov 5, 2024

See the code

README

SimpleQA

A factuality benchmark called SimpleQA that measures the ability for language models to answer short, fact-seeking questions.

Sources

openai/simple-evals

Introducing SimpleQA

Measuring short-form factuality in large language models

Contributors

basicv8vc

4 commits