Agent Run Console
Production / compare
← Runs esc

Compare

A · run_023c10vsB · run_fe9d90code-reviewSwap A and B
Duration
32.9s +80%
A: 18.3s
Cost
$0.061 -41%
A: $0.103
Tokens
25.7k -11%
A: 28.9k
Steps
10 +100%
A: 5
Model changed
GPT-4.1
A: Claude Sonnet

Steps, aligned

ChangeStepAB
SameInput policy check0.4s0.4s
SamePlan the task4.8s5.5s
Samesearch_codebase2.9s1.9s
SameRetrieve context · top 82.5s2.0s
ChangedDecide next step6.6s4.7s
Addedrun_tests—1.4s
Addedsearch_codebase—1.6s
AddedDecide next step—5.4s
Addedget_diff—1.9s
AddedWrite final answer—6.1s

Output diff

− 0 words + 0 words 100% unchanged

Reviewed 14 files. Three issues: the cache key ignores the locale, a test is skipped without a reason, and a server action is missing input validation. Tests pass. Suggested changes posted as comments, one marked blocking.

Keyboard shortcuts

Move down / up
jk
Open run
Enter
Back to runs
Esc
Select for compare
x
Compare selected
c
Re-run
r
Search
/
Next / previous step
↓↑
Replay trace
p
Show shortcuts
?