Winogrande — LLM Ewaluacja i benchmarki Dataset
44k commonsense reasoning problems inspired by Winograd Schema challenges. Tests whether models can resolve pronoun ambiguity using real-world knowledge. Requires understanding of causality and physical common sense that pure language statistics can't capture. Included in the Open LLM Leaderboard.
Dataset Details
| Provider | allenai |
| Category | Ewaluacja i benchmarki |
| Size | 44k Problems |
| License | Apache 2.0 |
| Downloads | 3M |
| Tags | Benchmark, Commonsense-Reasoning, Winograd, NLU |
from datasets import load_dataset
ds = load_dataset("allenai/winogrande")
Powiązane zbiory danych
Najczęstsze pytania
Czy mogę użyć Winogrande komercyjnie?
Tak — Winogrande jest udostępniony na licencji Apache 2.0, liberalnej licencji pozwalającej na użycie komercyjne, w tym trenowanie modeli wdrażanych w produkcie. Przed publikacją sprawdź wymogi atrybucji na karcie zbioru.
Ile danych zawiera Winogrande i czy potrzebuję wszystkich?
Winogrande zawiera 44k Problems. To benchmark ewaluacyjny, używany w całości do mierzenia modeli — nigdy nie mieszaj go z danymi treningowymi, bo wyniki benchmarku stracą sens.
Do czego Winogrande nadaje się najlepiej?
Benchmarking commonsense reasoning. Należy do sekcji „Ewaluacja i benchmarki" naszego centrum zbiorów danych, gdzie znajdziesz alternatywy i zbiory komplementarne.
← Wszystkie zbiory danych | Fine-Tuning Guide