KI-Rechenleistung
Chips zu kaufen heißt nicht, sie zu betreiben: Ohne Netzanschluss und Strom warten GPUs im Rack auf Elektrizität. Der Engpass wandert von Fertigungsnode und VRAM zu Umspannwerk und Rechnung.
Der Engpass bei Rechenleistung wandert vom Chip zum Strom: Warteschlangen beim Netzanschluss, Trafo-Lieferzeiten und Stromverträge verzögern Rechenzentren um Jahre. Auf der Angebotsseite wird Compute zur teilbaren Ware — serverlose Plattformen wie Modal rechnen GPUs sekundengenau ab, Inferenz, Feintuning und Batch teilen sich eine Abstraktion. Auf der Nachfrageseite frisst oft der unsichtbare reasoning token das Budget: hinter ein paar hundert Wörtern können Zehntausende Denk-Tokens laufen.