CoolFace
Datasetpublic

secbench-hf/SecBench

SecBench: A Comprehensive Multi-Dimensional Benchmarking Dataset for LLMs in Cybersecurity 中文README Evaluating Large Language Models (LLMs) is crucial for understanding their capabilities and limitations across various applications, including natural language processing and code generation. Existing benchmarks like MMLU, C-Eval, and HumanEval assess general LLM performance but lack focus on specific expert domains such as cybersecurity. Previous attempts to create cybersecurity… See the full description on the dataset page: https://huggingface.co/datasets/secbench-hf/SecBench.

sourceHugging Facemitupdated 2y agoView on Hugging Face
12likes639downloads
29 commits on main
7ed8fa82y ago

Upload README_CN.md

secbench
e734e952y ago

Delete README_CN.md

secbench
b0dcf132y ago

Update README.md

secbench
b71bdfc2y ago

Update README.md

secbench
fa49d4f2y ago

Upload README_CN.md

secbench
43e518d2y ago

Update README.md

secbench
c8489a22y ago

Update README.md

secbench
2fdb6fe2y ago

Update README.md

secbench
8557a2c2y ago

Update README.md

secbench
218c7482y ago

Update README.md

secbench
6dc3a7e2y ago

Delete SAQs_270.jsonl

secbench
fa114642y ago

Delete MCQs_2730.jsonl

secbench
3d9912a2y ago

Update README.md

secbench
c1ab6922y ago

Upload 2 files

secbench
70cdafc2y ago

Update README.md

secbench
58844d22y ago

Upload 2 files

secbench
fc9e6b02y ago

Delete data

secbench
79c0b812y ago

Update README.md

secbench
66282b02y ago

Update README.md

secbench
4d343a12y ago

Update README.md

secbench
fe0d3d72y ago

Update README.md

secbench
b52925d2y ago

Upload 5 files

secbench
aa8b3132y ago

Upload 2 files

secbench
56d6c622y ago

Delete data

secbench
b5874e12y ago

Create data

secbench
d56e7622y ago

Update README.md

secbench
4cfd69a2y ago

Update README.md

secbench
d4f1ccf2y ago

Update README.md

secbench
300d3c62y ago

initial commit

secbench