Alle Folgen › Folge 2
PreisschlachtWarum Spitzen-KI plötzlich halb so viel kostet
Am 21. und 22. September haben xAI, OpenAI und Anthropic ihre Spitzenmodelle billiger gemacht – dazu kommen offene Modelle wie Xiaomis MiMo. Paul und Paula erklären, was ein Token ist, warum die Preise fallen und warum „halb so teuer" nicht heißen muss, dass eine Aufgabe halb so viel kostet.
Kurz erklärt
Token
Die Recheneinheit von Sprachmodellen – und die Einheit, in der KI-Anbieter abrechnen.
Open-Weight-Modell
Ein KI-Modell, dessen Gewichte frei herunterladbar sind – und das man selbst betreiben kann.
Large Language Model (LLM)
Das Sprachmodell hinter ChatGPT, Claude, Gemini & Co. – ein Textvorhersage-System im Riesenformat.
Kontextfenster
Wie viel Text ein Modell auf einmal „im Blick“ hat – das Kurzzeitgedächtnis der KI.
Reasoning-Modell („Denkmodus“)
Modelle, die vor der Antwort erst intern nachdenken – besser bei kniffligen Aufgaben, aber langsamer und teurer.
Training & Inferenz
Einmal lernen, millionenfach anwenden – die zwei Phasen im Leben eines KI-Modells.
Benchmark
Standardisierte Tests, mit denen Hersteller ihre Modelle vergleichen – und warum man ihnen nicht blind trauen sollte.
API
Die Programmierschnittstelle, über die Apps und Automatisierungen KI-Modelle direkt nutzen.
Mixture of Experts (MoE)
Ein Modell aus vielen Spezialisten, von denen pro Wort nur wenige arbeiten – groß, aber sparsam.
Quellen zu dieser Folge
Jede Aussage der Folge haben wir vor der Aufnahme an diesen Quellen geprüft. Angaben von Herstellern kennzeichnen wir in der Folge als solche.
- GPT-6 Luna: 0,10 $ pro 1 Mio. Input-Tokens (Kaltstart „Zehn Cent")
developers.openai.comopenai.comventurebeat.com - GPT-6 Sol/Luna am 22.09.2026 erschienen
marktechpost.com - Claude Opus 5.5 am 22.09.2026; „40 % weniger bei typischer Nutzung" durch Preis/Token −20 % (5→4 $ In, 25→20 $ Out) plus weniger Tokens pro Aufgabe
anthropic.comanthropic.commixed-news.com - Grok 4.7 am 21.09.2026; 2 $ / 6 $ pro Mio. Tokens, gleicher Preis wie Grok 4.6, soll besser sein (u. a. CursorBench 46,3 % vs. 40,4 %, Herstellerangabe)
x.aisuperpowerdaily.com - Xiaomi MiMo-V2.6 unter MIT-Lizenz, Modelldateien frei (inkl. kommerzielle Nutzung)
huggingface.coopensourceforu.com - „Laut Xiaomi" bestes offenes Modell im Artificial-Analysis-Index (46), hinter geschlossenen (53)
technode.com - Token-Faustregel: ~4 Zeichen bzw. ~3/4 Wort (Englisch); andere Sprachen abweichend
help.openai.com - GPT-5.6-Sol-Preis ist Aktionspreis, „mindestens bis 21. November 2026"
neomanex.com - Simon Willison: danach Erhöhung geplant (er schreibt: 25 %), GPT-6 also halb so teuer wie ein Aktionspreis
simonwillison.net - „Ein Token misst den Einsatz, nicht die erledigte Arbeit" (FourWeekMBA)
fourweekmba.com - Wccftech: Luna nimmt offenen Modellen das Preisargument, weil beim Input günstiger als DeepSeek V4.1 Flash (0,15 $ Off-Peak)
wccftech.com