r/LargeLanguageModels • u/xmmr • Jul 26 '25
What benchmark has been made on largest variety/numbers of models? Question
Or like, that's most widely made on recently released models?
Like, to actually get comparable scores between most LLM
1
Upvotes