The Eval Index / Benchmarks / #14

open-compass/opencompass

by open-compass · Benchmarks · updated 2d ago

OpenCompass is an LLM evaluation platform, supporting a wide range of models (Llama3, Mistral, InternLM2,GPT-4,LLaMa2, Qwen,GLM, Claude, etc) over 100+ datasets.

79
momentum
7,421
stars
863
forks
#14
rank
benchmarkchatgptevaluationlarge-language-modelllama2llama3llmopenai
View on GitHub →