The Eval Index / Agent Eval / #76

TIGER-AI-Lab/ClawBench

by TIGER-AI-Lab · Agent Eval · updated 2d ago

Open-source benchmark for browser AI agents on daily tasks.

66
momentum
721
stars
51
forks
#76
rank
agent-evaluationagentic-aiai-agent-benchmarkai-agentsbenchmarkbrowser-agentbrowser-automationbrowser-usechrome-agentchrome-extensioncomputer-usedataset
View on GitHub →