Viewer
• Updated • 412k • 23.6k
• 121
Viewer
• Updated • 570k • 29.3k
• 98
Updated • 2.13k
• 6
Right for the Wrong Reasons: Diagnosing Syntactic Heuristics in Natural
Language Inference
Paper
• 1902.01007
• Published • 1
A large annotated corpus for learning natural language inference
Paper
• 1508.05326
• Published • 1
Benchmark
• Updated • 1.25k • 109k
• 580
Benchmark
• Updated • 12.1k • 224k
• 546
google-research-datasets/nq_open
Viewer
• Updated • 91.5k • 25.9k
• 36
Viewer
• Updated • 203k • 97.9k
• 336
HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question
Answering
Paper
• 1809.09600
• Published • 5
Viewer
• Updated • 237k • 19.9k
• 83
LexGLUE: A Benchmark Dataset for Legal Language Understanding in English
Paper
• 2110.00976
• Published • 1
Viewer
• Updated • 1.59k • 8.13k
• 118
A Dataset of Information-Seeking Questions and Answers Anchored in
Research Papers
Paper
• 2105.03011
• Published • 2
Amod/mental_health_counseling_conversations
Preview
• Updated • 1.3k
• 509
MuskumPillerum/General-Knowledge
Viewer
• Updated • 37.6k • 456
• 51
Viewer
• Updated • 98.2k • 207k
• 1.23k
SQuAD: 100,000+ Questions for Machine Comprehension of Text
Paper
• 1606.05250
• Published • 7
Viewer
• Updated • 196k • 238k
• 210
SuperGLUE: A Stickier Benchmark for General-Purpose Language
Understanding Systems
Paper
• 1905.00537
• Published • 4
Viewer
• Updated • 11.9k • 177k
• 151
Viewer
• Updated • 7.79k • 544k
• 409
Think you have Solved Question Answering? Try ARC, the AI2 Reasoning
Challenge
Paper
• 1803.05457
• Published • 5
Viewer
• Updated • 914k • 71.8k
• 206
TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for
Reading Comprehension
Paper
• 1705.03551
• Published • 2
Viewer
• Updated • 274k • 41.6k
• 343
PubMedQA: A Dataset for Biomedical Research Question Answering
Paper
• 1909.06146
• Published • 5
GPQA: A Graduate-Level Google-Proof Q&A Benchmark
Paper
• 2311.12022
• Published • 38