← Back to Explore
Agent Evaluation and Benchmarks🌱 growing

ARC-AGI-2

Website ↗

Frontier benchmark for measuring general intelligence capabilities in AI agents beyond pattern matching.

LanguagePython
SourceREADME.md (Line 380)
#Python#Benchmark

Related Resources in Agent Evaluation and Benchmarks