Zum Hauptinhalt Zur Navigation Zur Suche

Golem Plus Artikel
KI-Abrechnung nach Energieverbrauch:
Um den Faktor vier billiger

Bei Neuralwatt bezahlt man bei KI-Nutzung statt Token verbrauchte Kilowattstunden. 30 Tage nachgerechnet ergeben 100 statt 428 US-Dollar.
/ Robert Heide
Kommentare Auf Google folgen (öffnet im neuen Fenster)
Abrechnung von KI-Inferenz nach Energieverbrauch statt klassischer Tokenpreise - unser Autor hat nachgerechnet, was es bringt. (Bild: zulfugarkarimov/Pixabay)
Abrechnung von KI-Inferenz nach Energieverbrauch statt klassischer Tokenpreise - unser Autor hat nachgerechnet, was es bringt. Bild: zulfugarkarimov/Pixabay

Wer ein KI-Modell über eine API nutzt, bezahlt heute per Token – getrennt abgerechnet für Eingabe und Ausgabe, meist pro Million. Das ist bequem, weil man vorab kalkulieren kann. Der Preis hat allerdings wenig mit der Rechenarbeit zu tun, die eine Anfrage tatsächlich auslöst. Anbieter, die ihre Grafikprozessoren gut auslasten und effizient cachen, geben davon wenig bis nichts an die Kunden weiter. Ob eine Anfrage sofort beantwortet werden muss oder etwas Wartezeit verträgt, wird heute von den wenigsten Anbietern abgefragt, geschweige denn rabattiert.

Neuralwatt aus Seattle dreht das um: Der Anbieter misst den Strom, den eine Anfrage auf der GPU verbraucht, und stellt statt verbrauchter Tokens Kilowattstunden in Rechnung. Ich habe das 30 Tage lang produktiv genutzt, 139.879 Anfragen und 1,67 Milliarden Token über sechs Modelle. Im Standard-Abo waren es 100,75 US-Dollar – gegenüber 427,62 US-Dollar, die die gleiche Nutzung nach der Token-Preisliste desselben Anbieters gekostet hätte. Das ergibt Faktor 4,2 – was allerdings die fast uninteressanteste Zahl des gesamten Artikels ist. Denn über die verwendeten Modelle streut der Faktor zwischen 0,9 und 6,5. Bei einem Modell wäre sogar die Token-Abrechnung in meinem konkreten Fall günstiger gewesen.

Golem Plus Artikel