Code Generation On Res Q
Métriques
pass@1
Résultats
Résultats de performance de divers modèles sur ce benchmark
Tableau comparatif
Nom du modèle | pass@1 |
---|---|
res-q-evaluating-code-editing-large-language | 30.0 |
res-q-evaluating-code-editing-large-language | 58.0 |
res-q-evaluating-code-editing-large-language | 20.0 |
res-q-evaluating-code-editing-large-language | 18.0 |
res-q-evaluating-code-editing-large-language | 30.0 |
res-q-evaluating-code-editing-large-language | 36.0 |
res-q-evaluating-code-editing-large-language | 46.0 |
res-q-evaluating-code-editing-large-language | 29.0 |
res-q-evaluating-code-editing-large-language | 37.0 |