CoolFace
Datasetpublic

Yobitel/qwen-qwen2-5-coder-7b-instruct__code-generation-humaneval-mini__019e3b3f81a0

Qwen/Qwen2.5-Coder-7B-Instruct on code.generation.humaneval-mini (NVIDIA H100 80GB HBM3) Back to leaderboard Headline metrics Metric Value Unit N Samples 5 N Ok 5 Ok Rate 1 Pass At 1 1 Pass At 1 P05 1 Pass At 1 P50 1 Pass At 1 P95 1 Timeout Rate 0 TTFT P50 15.1846 ms Total P50 Ms 1141.4107 Tokens Out Total 944 Run configuration Model: Qwen/Qwen2.5-Coder-7B-Instruct @ unknown00 Engine: vllm vunknown… See the full description on the dataset page: https://huggingface.co/datasets/Yobitel/qwen-qwen2-5-coder-7b-instruct__code-generation-humaneval-mini__019e3b3f81a0.

sourceHugging Facecc-by-4.0updated 4mo agoView on Hugging Face
0likes10downloads
Dataset Card

Qwen/Qwen2.5-Coder-7B-Instruct on code.generation.humaneval-mini (NVIDIA H100 80GB HBM3)

Back to leaderboard

Headline metrics

MetricValueUnit
N Samples5
N Ok5
Ok Rate1
Pass At 11
Pass At 1 P051
Pass At 1 P501
Pass At 1 P951
Timeout Rate0
TTFT P5015.1846ms
Total P50 Ms1141.4107
Tokens Out Total944

Run configuration

  • —Model: Qwen/Qwen2.5-Coder-7B-Instruct @ unknown00
  • —Engine: vllm vunknown
  • —Quantization: fp16
  • —Hardware: NVIDIA H100 80GB HBM3
  • —Driver: 580.126.09
  • —CUDA: 13.0
  • —Run date: 2026-05-18T13:21:18.240224+00:00
  • —Seed: 0

Verification

This result is Sigstore-signed and Rekor-logged. Verify:

bash
pip install inferencebench
bench verify hf://datasets/Yobitel/qwen-qwen2-5-coder-7b-instruct__code-generation-humaneval-mini__019e3b3f81a0/envelope.json

Rekor entry: log index -1

Methodology

See the suite methodology page.

Citation

bibtex
@misc{inferencebench_019e3b3f81a0,
  title = { Qwen/Qwen2.5-Coder-7B-Instruct on code.generation.humaneval-mini },
  author = { {InferenceBench community} },
  year = { 2026 },
  url = { https://huggingface.co/datasets/Yobitel/qwen-qwen2-5-coder-7b-instruct__code-generation-humaneval-mini__019e3b3f81a0 },
}

Published via [InferenceBench](https://github.com/yobitelcomm/bench) — vendor-neutral AI benchmarks.