Artificial Analysis measured the time to first token of every reasoning model from o3 to R1. DeepSeek R1 = 103 sec
Qwen3-32B on Cerebras = 1.1 sec We give you R1 level intelligence with 99% latency reduction. Try it: https://
inference.cerebras.ai
Cerebras Qwen3 achieves 99% latency reduction versus o3
By
–
