CoolFace
Datasetpublic

disi-unibo-nlp/Phunny

Phunny: A Humor-Based QA Benchmark for Evaluating LLM Generalization Welcome to Phunny, a humor-based question answering (QA) benchmark designed to evaluate the reasoning and generalization abilities of large language models (LLMs) through structured puns. This repository accompanies our ACL 2025 main track paper:"What do you call a dog that is incontrovertibly true? Dogma: Testing LLM Generalization through Humor" To reproduce our experiments: Code available on GitHub… See the full description on the dataset page: https://huggingface.co/datasets/disi-unibo-nlp/Phunny.

sourceHugging Facemitupdated 1y agoView on Hugging Face
3likes32downloads
17 commits on main
8dffc261y ago

Update README.md

alecocc
92748e21y ago

Update README.md

alecocc
16396461y ago

Update README.md

alecocc
a09be6f1y ago

Update README.md

alecocc
4c913fc1y ago

Update README.md

alecocc
ac673c11y ago

Update README.md

luca-ragazzi
5e127231y ago

Update README.md

luca-ragazzi
9b323d41y ago

Update README.md

luca-ragazzi
67287662y ago

Upload dataset

paoloitaliani
031143e2y ago

Upload dataset

paoloitaliani
37380da2y ago

Upload dataset

paoloitaliani
db1fd7b2y ago

Upload dataset

paoloitaliani
1ccfe742y ago

Upload dataset

paoloitaliani
df9c6492y ago

Upload dataset

paoloitaliani
6d8d57a2y ago

Upload dataset

paoloitaliani
2ea965a2y ago

Upload dataset

paoloitaliani
74bfe682y ago

initial commit

paoloitaliani