A terminal AI agent that works on a codebase, container, browser or desktop, uses what it built, and judges its work against criteria written before it started. One agent loop, rubric-first evaluator, tiered memory, four-vendor routing, six benchmark harnesses.