19 August 2026
AI models process text faster on chips and servers
First reported
Latent Space ran this on .
- Apple's M5 Max chip now runs AI models at 70 tokens per second, a measure of how quickly text is generated.
- Cerebras, a chip company, announced their CS-4 processor reaches 1000 tokens per second for very large models, roughly 14 times faster.