HyperAI
Command Palette
Search for a command to run...
Performance results of various models on this benchmark
Metrics
Expl.
# Params
Context len.
Average
Refusal (Ans.)
Conciseness (QA)
Refusal (Unans.)
Completeness (QA)
Faithfulness (QA)
Conciseness (Summ.)
Completeness (Summ.)
Faithfulness (Summ.)
2 rows total