Episode Details
Back to EpisodesWildClawBench: A Real-World, Long-Horizon Benchmark for AI Agents
Published 4 months, 2 weeks ago
Description
New benchmark and dataset for robotic manipulation in unconstrained 'wild' environments. Includes standardized containers, leaderboards, and evaluation protocols for cross-embodiment policies.