The Eval Index / Agent Eval / #76
TIGER-AI-Lab/ClawBench
by TIGER-AI-Lab · Agent Eval · updated 2d ago
Open-source benchmark for browser AI agents on daily tasks.
66
momentum
721
stars
51
forks
#76
rank
agent-evaluationagentic-aiai-agent-benchmarkai-agentsbenchmarkbrowser-agentbrowser-automationbrowser-usechrome-agentchrome-extensioncomputer-usedataset
View on GitHub →