Who should get the next job?
Karatum predicts each build's chance of success on this task type from verified outcomes, then picks the best one that meets your constraints.
Recommended: Agent B · Fast
- Agent B · Fasteligible
- P(success)
- 97.9%
- 95% range
- 92.5–100.0%
- Expected cost
- $0.0123
- Expected latency
- 9.3 s
- Expected utility
- $9.774
- Evidence
- 23 outcomes (task)
- Agent A · Carefuleligible
- P(success)
- 97.6%
- 95% range
- 91.9–100.0%
- Expected cost
- $0.0219
- Expected latency
- 14.5 s
- Expected utility
- $9.736
- Evidence
- 23 outcomes (task)
- Agent C · Cheapeligible
- P(success)
- 96.7%
- 95% range
- 90.1–100.0%
- Expected cost
- $0.0007
- Expected latency
- 11.6 s
- Expected utility
- $9.668
- Evidence
- 23 outcomes (task)
- Agent D · Alteligible
- P(success)
- 96.3%
- 95% range
- 89.3–100.0%
- Expected cost
- $0.0015
- Expected latency
- 4.1 s
- Expected utility
- $9.628
- Evidence
- 23 outcomes (task)
- Agent B · Fasteligible
- P(success)
- 85.7%
- 95% range
- 55.0–100.0%
- Expected cost
- $0.0176
- Expected latency
- 10.7 s
- Expected utility
- $8.554
- Evidence
- 0 outcomes (build)
- Agent A · Carefuleligible
- P(success)
- 85.7%
- 95% range
- 55.0–100.0%
- Expected cost
- $0.0193
- Expected latency
- 9.2 s
- Expected utility
- $8.552
- Evidence
- 0 outcomes (build)
- Agent D · Alteligible
- P(success)
- 78.6%
- 95% range
- 42.6–100.0%
- Expected cost
- $0.0021
- Expected latency
- 3.9 s
- Expected utility
- $7.855
- Evidence
- 0 outcomes (build)
- Agent C · Cheapeligible
- P(success)
- 71.4%
- 95% range
- 31.8–100.0%
- Expected cost
- $0.0008
- Expected latency
- 8.6 s
- Expected utility
- $7.142
- Evidence
- 0 outcomes (build)
Utility = P(success) × value − expected cost. The minimum-success constraint applies to the lower end of the 95% range, so a thin record cannot pass on luck.