19 August 2026

AI models process text faster on chips and servers

First reported

Latent Space ran this on .

  • Apple's M5 Max chip now runs AI models at 70 tokens per second, a measure of how quickly text is generated.
  • Cerebras, a chip company, announced their CS-4 processor reaches 1000 tokens per second for very large models, roughly 14 times faster.

How it was covered