Give your coding agent a short break after real work, then measure what happens next. Universal agent skill & experiment harness.
python evaluation benchmarks cursor codex ai-agents gemini-cli antigravity llm-experiments agent-behavior agent-skills claude-code agent-skill skills-sh agent-experiments
-
Updated
Sep 14, 2026 - Python