Base language model benchmark
BananaMindBench Leaderboard
Text-completion performance on 350 BananaMind Base Bench 1.1 examples, ranked by fixed-item Overall Elo.
Maximum parameter size for submissions: 250M.
Base language model benchmark
Text-completion performance on 350 BananaMind Base Bench 1.1 examples, ranked by fixed-item Overall Elo.
Maximum parameter size for submissions: 250M.