The Eval Index / Red Teaming & Safety / #250
whitecircle/circle-guard-bench
by whitecircle · Red Teaming & Safety · updated 6mo ago
First-of-its-kind AI benchmark for evaluating the protection capabilities of large language model (LLM) guard systems (guardrails and safeguards)
23
momentum
75
stars
5
forks
#250
rank
aibenchmarkbenchmarkingguardrailguardrailsjailbreaklarge-language-modellarge-language-modelsllmllm-as-a-judgellm-evalllm-evaluation
View on GitHub →