Was tun, wenn KI jedes Jahr 13-mal billiger wird?

Eine Grafik aus einem Forschungsbericht vom September 2026 macht in sozialen Netzwerken die Runde: Der Preis für KI-Leistung fällt schneller als je ein Preis in der Technikgeschichte. Wir haben die Zahlen der Quelle nachgelesen und in eigene Grafiken übersetzt. Dabei zeigt sich, was die Kurve wirklich misst, warum Ihre Rechnung trotzdem steigen kann und welche drei Regeln wir daraus für den Betrieb ableiten.

25. September 2026 6 Minuten Lesezeit KI im Mittelstand

Regelwerk · Nachweis · Betrieb

Fünf Kurven auf einem Bild, alle fallen. Strom, Lithium-Akkus, Rechenleistung, DNA-Sequenzierung, und dann eine fünfte, die fast senkrecht nach unten geht: der Preis für künstliches Denken. Die Grafik stammt aus einem Bericht des Forschungsinstituts Epoch AI vom 22. September 2026 und wird in sozialen Netzwerken mit Hochrechnungen weitergereicht, die bis zu „eine Billion Mal günstiger in drei Jahren“ reichen. Wir haben den Bericht gelesen, die Zahlen in eigene Grafiken übersetzt und die Frage gestellt, die in fast jedem Erstgespräch fällt: Lohnt es sich, jetzt Geld für KI auszugeben, oder wird es sowieso billiger?

Was misst die Kurve wirklich?

Nicht den Preis der besten KI, sondern den Preis für eine feste Leistung. Die Forscher legen eine Punktzahl auf einem Prüfset fest, etwa drei Viertel richtige Antworten auf Fragen auf Doktorandenniveau, und suchen zu jedem Zeitpunkt das günstigste Modell, das diese Punktzahl schafft. Der Preis dieses Modells je Frage ist der Messwert. Über fünf Prüfsets und drei Jahre fällt er im Mittel um 47 Prozent je Quartal, das ist 13-fach je Jahr.

Ein Beispiel aus dem Bericht: Ein Spitzenmodell vom Januar 2025 brauchte rund 30 Cent je Frage für diese Punktzahl. Ein Modell vom Juli 2026 schafft dieselbe Punktzahl für vier Hundertstel Cent. Faktor 725 in unter 18 Monaten.

Der Preis des Rechnens fiel schneller als jeder Preis zuvorPreisrückgang je Jahr bei gleicher Leistung, als gerade Linie fortgeschrieben; die gemessenen Kurven verlaufen stufiger
Preisverfall von Strom, Lithium-Akkus, Rechenleistung, DNA-Sequenzierung und KI-Inferenz im Vergleich, logarithmisch 1 10 100 1.000 1 Mio. 1 Mrd. 1 Bio. 0 10 20 30 40 50 60 70 80 90 günstiger um Faktor Jahre seit Beginn des Preisverfalls Strom: 1892 bis 1973, 1,05-fach günstiger je Jahr, insgesamt Faktor 52 Strom (Haushalte, USA) 1892 bis 1973 Lithium-Akkus: 1991 bis 2024, 1,16-fach günstiger je Jahr, insgesamt Faktor 134 Lithium-Akkus 1991 bis 2024 Rechenleistung: 1940 bis 2001, 1,51-fach günstiger je Jahr, insgesamt Faktor 83 Mrd. Rechenleistung 1940 bis 2001 DNA-Sequenzierung: 2001 bis 2025, 1,84-fach günstiger je Jahr, insgesamt Faktor 2,3 Mio. DNA-Sequenzierung 2001 bis 2025 KI-Inferenz: 2021 bis 2026, 13,00-fach günstiger je Jahr, insgesamt Faktor 371.293 KI-Inferenz 2021 bis 2026 Preisverfall von Strom, Lithium-Akkus, Rechenleistung, DNA-Sequenzierung und KI-Inferenz im Vergleich, logarithmisch 1 10 100 1.000 1 Mio. 1 Mrd. 1 Bio. 0 10 20 30 40 50 60 70 80 90 günstiger um Faktor Jahre seit Beginn des Preisverfalls Strom: 1892 bis 1973, 1,05-fach günstiger je Jahr, insgesamt Faktor 52 Strom Lithium-Akkus: 1991 bis 2024, 1,16-fach günstiger je Jahr, insgesamt Faktor 134 Lithium-Akkus 1991 bis 2024 Rechenleistung: 1940 bis 2001, 1,51-fach günstiger je Jahr, insgesamt Faktor 83 Mrd. Rechenleistung 1940 bis 2001 DNA-Sequenzierung: 2001 bis 2025, 1,84-fach günstiger je Jahr, insgesamt Faktor 2,3 Mio. DNA-Sequen- zierung 2001 bis 2025 KI-Inferenz: 2021 bis 2026, 13,00-fach günstiger je Jahr, insgesamt Faktor 371.293 KI-Inferenz 2021 bis 2026
Strom 1892 bis 1973Lithium-Akkus 1991 bis 2024Rechenleistung 1940 bis 2001DNA-Sequenzierung 2001 bis 2025KI-Inferenz 2021 bis 2026
Werte als Tabelle
TechnologieZeitraumgünstiger je Jahrgesamt (idealisiert)
Strom1892 bis 19731,05-fach52
Lithium-Akkus1991 bis 20241,16-fach134
Rechenleistung1940 bis 20011,51-fach83 Mrd.
DNA-Sequenzierung2001 bis 20251,84-fach2,3 Mio.
KI-Inferenz2021 bis 202613,00-fach371.293
Eigene Darstellung nach Epoch AI, „The plunging price of thought“ (Emberson und Roodman, 22. September 2026, CC BY 4.0). Jahresraten: Strom 1,05, Lithium-Akkus 1,16, Rechenleistung 1,51, DNA-Sequenzierung 1,84, KI-Inferenz mindestens 13.

Zum Vergleich hat der Bericht historische Preisreihen herangezogen. Der Strompreis für Haushalte fiel über acht Jahrzehnte um etwa fünf Prozent je Jahr, Rechenleistung wurde über sechs Jahrzehnte jedes Jahr etwa anderthalbmal günstiger. KI-Inferenz fällt viermal schneller als DNA-Sequenzierung, sechsmal schneller als Rechenleistung und 54-mal schneller als Strom. Zwei unabhängige Beobachtungen stützen die Größenordnung: Der Stanford AI Index maß für die Leistung eines Chatmodells von Ende 2022 einen Preisrückgang um den Faktor 280 in zwei Jahren. Eine Wagniskapitalgesellschaft schätzte Ende 2024 grob zehnfach je Jahr.

13-fachgünstiger je Jahr bei gleicher LeistungMittel über fünf Prüfsets, 2023 bis 2026
47 %Preisrückgang je Quartaldieselbe Punktzahl, das günstigste Modell des Tages
725-fachgünstiger in unter 18 Monateneine Frage auf Doktorandenniveau, Januar 2025 bis Juli 2026
54-malschneller als der Preisverfall von StromStrom 1892 bis 1973, KI 2023 bis 2026
Zahlen aus Epoch AI, „The plunging price of thought“ (22. September 2026). Das Beispiel mit 725-fach vergleicht das günstigste Modell für 75 Prozent richtige Antworten auf dem Prüfset GPQA Diamond.

Was die Kurve nicht sagt

Drei Dinge halten die Autoren selbst fest, und in den Kurzvideos fehlen sie.

Die Spitze wird nicht billiger. Gemessen wird der Preis für die Leistung von gestern. Das jeweils beste Modell des Jahres liegt in den öffentlichen Preislisten seit 2023 in derselben Preisklasse. Wer immer das Beste will, zahlt immer den vollen Preis. Was fällt, ist der Preis für das, was vor einem Jahr das Beste war.

Die Treppe: gleiche Leistung wird billiger, die Spitze bleibt teuerIdealisiert mit dem gemessenen Mittelwert von 13-fach je Jahr; Preise relativ zum heutigen Preis derselben Leistung
Gleiche Leistung wird jedes Jahr rund 13-fach günstiger, die jeweils beste Leistung kostet weiter den vollen Preis 100 % 10 % 1 % 0,1 % Preis für dieselbe Leistung heute in einem Jahr in zwei Jahren Die jeweils beste verfügbare Leistung kostet in jedem Jahr etwa den vollen Preis Spitzenleistung von heute: 100 %, dann 7,7 %, dann 0,6 % des Ausgangspreises Spitzenleistung in einem Jahr: 100 %, dann 7,7 %, dann 0,6 % des Ausgangspreises 100 % 7,7 % 0,6 % Spitzenleistung von heute nach zwei Jahren Routinepreis Spitzenleistung in einem Jahr nach einem Jahr ein Bruchteil Spitzenleistung in zwei Jahren Die jeweils beste Leistung kostet weiter den vollen Preis Gleiche Leistung wird jedes Jahr rund 13-fach günstiger, die jeweils beste Leistung kostet weiter den vollen Preis 100 % 10 % 1 % 0,1 % Preis für dieselbe Leistung heute in einem Jahr in zwei Jahren Die jeweils beste verfügbare Leistung kostet in jedem Jahr etwa den vollen Preis Spitzenleistung von heute: 100 %, dann 7,7 %, dann 0,6 % des Ausgangspreises Spitzenleistung in einem Jahr: 100 %, dann 7,7 %, dann 0,6 % des Ausgangspreises 100 % 7,7 % 0,6 % Spitze von heute Spitze in einem Jahr Spitze in zwei Jahren jeweils beste Leistung: immer der volle Preis
jeweils beste verfügbare LeistungSpitzenleistung von heuteSpitzenleistung in einem JahrSpitzenleistung in zwei Jahren
Werte als Tabelle
Leistungsniveauheutein einem Jahrin zwei Jahren
Spitzenleistung von heute100 %7,7 %0,6 %
Spitzenleistung in einem Jahrnoch nicht verfügbar100 %7,7 %
Spitzenleistung in zwei Jahrennoch nicht verfügbarnoch nicht verfügbar100 %
Eigene Darstellung. Die Jahresrate stammt aus Epoch AI (22. September 2026); die Preisklasse der jeweils besten Modelle ist in den öffentlichen Preislisten der großen Anbieter über die Jahre etwa gleich geblieben.

Prüfsets sind nicht Ihre Arbeit. Eine Mathematikaufgabe mit eindeutiger Lösung lässt sich messen, das Beantworten einer Kundenmail mit drei Anhängen nicht. Die Autoren schreiben selbst, dass ihre Messgröße ein unvollkommener Stellvertreter für nützliche Arbeit ist. Und praktisch niemand wechselt jeden Monat zum günstigsten Modell, das gerade noch reicht. Der volle Preisvorteil aus der Kurve kommt deshalb bei kaum einem Betrieb an.

Drei Jahre Daten tragen keine Hochrechnung über drei weitere. Die Kurve zeigt eine Steigung, keine Zukunft. Ob sie sich abflacht oder steil bleibt, sagt der Bericht ausdrücklich nicht. „Eine Billion Mal günstiger in drei Jahren“ ist eine Multiplikation, kein Messwert. Für die Planung eines Betriebs genügt eine schwächere und belastbarere Aussage: Was heute knapp zu teuer ist, ist in einem Jahr sehr wahrscheinlich bezahlbar.

Warum Ihre Rechnung trotzdem steigt

Fallende Preise je Aufgabe und steigende Gesamtausgaben widersprechen sich nicht. Die Marktforscher von Gartner erwarten für 2026 weltweit fast 50 Prozent mehr Ausgaben für KI als im Vorjahr, für generative Modelle mehr als eine Verdopplung. Eine Recherche des australischen Rundfunks vom August 2026 beschreibt den Mechanismus: Der Token-Preis fiel innerhalb von gut einem Jahr auf etwa ein Hundertstel, die Rechnungen der Unternehmen stiegen. Weil mehr Aufgaben automatisiert werden, weil die Aufgaben komplexer werden und weil für Spezialarbeit das Spitzenmodell gewählt wird.

Ihre KI-Rechnung hat drei StellschraubenNur die erste dreht sich von allein in Ihre Richtung
KI-Rechnung=
Preis je Aufgabefälltbei gleicher Leistung um ein Vielfaches je Jahr
Zahl der Aufgabensteigtje günstiger, desto mehr wird automatisiert
Anteil Spitzenmodellsteigtwer immer das Beste will, zahlt immer den vollen Preis

Der Preis je Aufgabe ist die einzige der drei Stellschrauben, die sich von allein in Ihre Richtung dreht. Die anderen beiden stellen Sie.

Drei Regeln, nach denen wir planen

Wir betreiben KI im eigenen Haus, bei europäischen Anbietern und über Spitzenmodelle, und wir bauen sie für Kunden. Aus dem Preisverfall haben wir drei Regeln abgeleitet, die in jeder Planung stehen.

Regel 1: Rechnen Sie mit der Aufgabe, nicht mit dem Preis. Eine Aufgabenliste mit drei Spalten: heute wirtschaftlich, in einem Jahr, in zwei Jahren. Jede Aufgabe bekommt die Spalte, in der sie sich zum erwarteten Preis rechnet. Bei uns stehen in der ersten Spalte Prüfläufe, die jede Nacht über Produktdaten laufen und zum Preisniveau von 2024 nicht bezahlbar gewesen wären. In der dritten Spalte steht, was heute noch das Spitzenmodell braucht und deshalb wartet. Die Liste wird einmal im Jahr nach links verschoben, nicht neu erfunden.

Regel 2: Kaufen Sie Rechenleistung nicht auf Vorrat. Ein Server wird über drei bis fünf Jahre abgeschrieben. Der Preis für dieselbe Leistung aus dem Netz fällt in dieser Zeit um mehrere Größenordnungen. Eigene Hardware gewinnt deshalb nur dort, wo der Preis nicht das Argument ist: bei Daten, die das Haus nicht verlassen dürfen, bei Sprache-zu-Text und bei gleichmäßiger Dauerlast. Wie wir das aufteilen, steht im Beitrag über lokale KI im Betrieb. Alles andere wird je Anfrage abgerechnet, damit der Preisverfall bei Ihnen ankommt und nicht beim Abschreibungsplan.

Regel 3: Steuern Sie über die Modellklasse, nicht über den Token-Preis. Die Preisliste eines Anbieters spannt zwischen kleinstem und größtem Modell etwa den Faktor zehn. Deshalb bekommt bei uns jede Aufgabenklasse eine Modellklasse: Das teuerste Modell prüft Ergebnisse, bei denen ein Fehler teuer wäre, die Fleißarbeit erledigen mittlere und kleine Modelle. Ein Budgetdeckel je Aufgabe verhindert, dass ein Agent in einer Schleife die Monatsrechnung eines Menschen verbraucht. Nach jeder neuen Modellgeneration wird die Zuordnung neu gemessen, weil das Modell von gestern morgen in die günstigere Klasse rutscht.

Für Sie heißt das

Für Sie heißt das: Die Frage „jetzt oder später“ ist falsch gestellt. Was Sie heute lernen, gilt nächstes Jahr für ein Vielfaches der Aufgabenmenge zum gleichen Geld. Wer wartet, bis es billiger ist, wartet auf eine Leistung, die dann schon wieder Vorjahresstand ist. Fangen Sie mit den Aufgaben an, die sich heute rechnen, und schreiben Sie die anderen in die zweite und dritte Spalte.

Der nächste Schritt ist eine Stunde mit Ihrer Aufgabenliste: Welche Aufgaben laufen bereits, welche warten auf den Preis, welche auf die Vertraulichkeitsregel. Danach ist die KI-Rechnung eine Planung und keine Überraschung.

Quellen

Veröffentlicht am 25. September 2026.

Kurz beantwortet

Drei Fragen dazu.

Sollte ich mit KI-Projekten warten, bis es billiger wird?

Nein, weil nicht die KI billiger wird, die Sie dann wollen. Günstiger wird die Leistung von gestern; die beste Leistung des Jahres bleibt in ihrer Preisklasse. Sinnvoll ist, mit den Aufgaben zu beginnen, die sich heute rechnen, und die teureren in eine Liste für das nächste Jahr zu schreiben. Das Wissen aus dem ersten Jahr ist der Teil, den der Preisverfall nicht liefert.

Sinkt meine KI-Rechnung nächstes Jahr um den Faktor 13?

Nur, wenn Sie dieselben Aufgaben in derselben Menge behalten und aktiv auf das günstigste passende Modell wechseln. In der Praxis steigen Menge und Anspruch. Die Marktforscher von Gartner erwarten für 2026 weltweit fast 50 Prozent mehr KI-Ausgaben als im Vorjahr. Die Rechnung steuern Sie über die Modellklasse je Aufgabe und einen Budgetdeckel, nicht über den Token-Preis.

Lohnt sich eigene KI-Hardware bei diesem Preisverfall noch?

Für den Preis nicht, für die Vertraulichkeit ja. Eine Maschine im Haus rechnet sich dort, wo Daten das Haus nicht verlassen dürfen, bei Spracherkennung und bei gleichmäßiger Dauerlast. Für alles andere ist die Abrechnung je Anfrage der Weg, auf dem der Preisverfall bei Ihnen ankommt statt beim Abschreibungsplan.

Weiterlesen

Aus derselben Werkstatt.

KI im Mittelstand · 15. September 2026

Was der TÜV-Kurs zum KI-Compliance-Beauftragten bringt

Zwei Tage Seminar, 30 Fragen, ein Zertifikat: Was der Kurs zum KI-Compliance-Beauftragten (TÜV) einem Mittelständler wirklich bringt und was er nicht leistet.

Lesen →
KI im Mittelstand · 12. September 2026

KI-Inventar: der erste Schritt zur KI-Compliance

Was ein KI-Inventar ist, welche zehn Felder je Eintrag hineingehören, was draußen bleibt und wie es zur Grundlage für Schulung, Regelwerk und Rollenfrage wird.

Lesen →

Sie wollen wissen, wo Ihr Betrieb steht?

Ein Erstgespräch von 30 Minuten reicht, um die drei wichtigsten Punkte zu klären. Ohne Verpflichtung, ohne Folien.

Erstgespräch anfragen