Wenn du eine klare Einschätzung zum KI-Compute-Bedarf willst, vergiss kurz den H100-Hype – schau dir den A100 an.
Dieser Chip kam im Mai 2020 auf den Markt. Nach GPU-Maßstäben uralt. Trotzdem wird er weiterhin fast zu voller Auslastung angemietet (CoreWeave hat das in ihrem Earnings-Call gerade bestätigt). Heute läuft er größtenteils für Inferenz-Workloads.
Der Hinweis: Die Mietpreise für den A100 sind kaum gesunken, selbst als neuere, viel leistungsstärkere GPUs den Markt überschwemmten. Das ist keine Nostalgie – das ist eine strukturelle Nachfrage. Die Inferenz bremst nicht. Sie beschleunigt.
Wenn ein 4 Jahre alter Chip in einem Markt, der vor neuer Verfügbarkeit nur so strotzt, weiterhin Preissetzungsmacht hat, dann siehst du keine Blase. Du siehst einen Kapazitätsengpass, der bleiben wird.
Dieser Chip kam im Mai 2020 auf den Markt. Nach GPU-Maßstäben uralt. Trotzdem wird er weiterhin fast zu voller Auslastung angemietet (CoreWeave hat das in ihrem Earnings-Call gerade bestätigt). Heute läuft er größtenteils für Inferenz-Workloads.
Der Hinweis: Die Mietpreise für den A100 sind kaum gesunken, selbst als neuere, viel leistungsstärkere GPUs den Markt überschwemmten. Das ist keine Nostalgie – das ist eine strukturelle Nachfrage. Die Inferenz bremst nicht. Sie beschleunigt.
Wenn ein 4 Jahre alter Chip in einem Markt, der vor neuer Verfügbarkeit nur so strotzt, weiterhin Preissetzungsmacht hat, dann siehst du keine Blase. Du siehst einen Kapazitätsengpass, der bleiben wird.