Models
latest model of each family — live from /v1/models (workers assigned)
Prompt
Latency Breakdown
TTFA — first answer token (lime) + answer-generation time (grey) · milliseconds · median across runs
TTFA (first answer)
Answer generation
Speed vs Cost
tokens/sec → faster right · output cost ↓ cheaper down · ideal = bottom-right