HyperAI
Command Palette
Search for a command to run...
Leistungsergebnisse verschiedener Modelle auf diesem Benchmark
Metriken
Len-control. Win Rate
Win Rate vs GPT-4 (Arena-Hard)
Win Rate vs GPT-4 (Alpaca Eval 2.0)
1 Zeile insgesamt
Search for a command to run...
Leistungsergebnisse verschiedener Modelle auf diesem Benchmark
Search for a command to run...
Leistungsergebnisse verschiedener Modelle auf diesem Benchmark