HyperAI초신경

Mathematical Reasoning On Lila Ood

평가 지표

Accuracy

평가 결과

이 벤치마크에서 각 모델의 성능 결과

비교 표
모델 이름Accuracy
lila-a-unified-benchmark-for-mathematical0.448
lila-a-unified-benchmark-for-mathematical0.268
lila-a-unified-benchmark-for-mathematical0.586
lila-a-unified-benchmark-for-mathematical0.384
lila-a-unified-benchmark-for-mathematical0.177
lila-a-unified-benchmark-for-mathematical0.238