rounakbende10/rh-swe-bench
Coding
Red Hat SWE-bench - 341 verified tasks from 25 RH ecosystem repos.
Run this task
CLI:
inspect eval inspect_harbor/rounakbende10_rh_swe_bench --model openai/gpt-5Python:
from inspect_ai import eval
from inspect_harbor import rounakbende10_rh_swe_bench
eval(rounakbende10_rh_swe_bench(), model="openai/gpt-5")Dataset information
| Harbor registry | rounakbende10/rh-swe-bench |
| Inspect task | rounakbende10_rh_swe_bench |
| Latest digest | sha256:8b225cf78dc4438279daa87af90b1d6b56baeed8e32df0712e065a144e011024 |
| Samples | 341 |
| Source | https://github.com/rounakbende10/rh-swe-bench |
See Task Parameters for the parameter set shared across all Harbor tasks.