Queue questions.
One prompt per line. Blank lines and # comments are skipped.
With Learned router on (default): first ask runs Top-K + judge
(explore_learn); the same prompt again reuses that winner
at K=1 (exploit_experience).
Force explore always re-judges via
/v1/bench/judge (ignores memory).
Progress
idleRun summary
Questions
0
Succeeded
0
Failed
0
Skipped
0
Escalated
0
Total time
—
Median E2E
—
Total cost
—
Learning report
Results
| # | Status | E2E | TTFT | Mode | Esc | Models | Tools | Tokens | Cost | Prompt |
|---|