HyperAI
Command Palette
Search for a command to run...
Résultats de performance de différents modèles sur ce benchmark
Metrics
Len-control. Win Rate
Win Rate vs GPT-4 (Arena-Hard)
Win Rate vs GPT-4 (Alpaca Eval 2.0)
1 ligne au total
Search for a command to run...
Résultats de performance de différents modèles sur ce benchmark
Search for a command to run...
Résultats de performance de différents modèles sur ce benchmark