
KI-Modelle im Preisvergleich: Warum Sprechen mit ChatGPT jetzt zur Zugriffsfrage wird.
23. September 2026 · 6 Min. Lesezeit
Fünf neue KI-Modelle in drei Tagen, sinkende Tokenpreise und ChatGPT mit Zugriff auf Mail und Kalender: Für Unternehmen wird KI günstiger und zugleich handlungsfähiger. Entscheidend sind deshalb nicht allein Modellpreise, sondern die Kosten je erledigter Aufgabe und klare Regeln für Zugriffe.
Vom 21. bis 23. September 2026 haben fünf Anbieter neue KI-Modelle vorgestellt. Zwei davon kamen am selben Tag und zu niedrigeren Preisen als ihre Vorgänger. Am 23. September erhielt zudem die Sprachfunktion von ChatGPT Zugriff auf Postfach und Kalender.
Für Geschäftsführungen stecken darin zwei zentrale Fragen:
- Was kostet KI tatsächlich?
- Wer entscheidet, worauf eine Software zugreifen darf, die auf Zuruf handelt?
Fünf Anbieter, drei Tage
Am Montag, 21. September, stellte xAI Grok 4.7 vor. Laut xAI arbeitet das Modell bei komplexen Aufgaben länger und prüft seine Antworten häufiger. Der Preis bleibt gegenüber dem Vorgänger unverändert: 2 US-Dollar je Million eingelesener Tokens und 6 US-Dollar je Million ausgegebener Tokens.
Am Dienstag, 22. September, veröffentlichte Xiaomi MiMo-V2.6 in zwei Varianten: Pro und Flash. Die Gewichte der Modelle stehen unter einer sehr freien Lizenz. Unternehmen können sie deshalb herunterladen und auf eigener Infrastruktur betreiben.
Damit verbunden ist allerdings eine offene Herkunftsfrage. Anthropic hatte Xiaomi am 10. September vorgeworfen, Claude in großem Umfang abgefragt zu haben, um mit den Antworten eigene Modelle zu trainieren. Laut Anthropic geschah dies über mehr als 400.000 Anfragen und rund 1.500 Konten. Eine öffentliche Antwort von Xiaomi war bis zum 24. September nicht zu finden.
Wer ein offenes Modell im eigenen Haus einsetzen möchte, sollte daher nicht nur auf Lizenz und Leistungsdaten schauen, sondern auch auf die Herkunft und Dokumentation des Modells.
Ebenfalls am 22. September folgten OpenAI und Anthropic:
- OpenAI stellte GPT-6 Sol und GPT-6 Luna vor, günstigere Varianten des Spitzenmodells GPT-6 Astra. Sol kostet 2 US-Dollar je Million eingelesener und 10 US-Dollar je Million ausgegebener Tokens. Luna kostet 0,10 beziehungsweise 0,50 US-Dollar. OpenAI spricht von 50 Prozent niedrigeren Preisen als bei den Vorgängern – bezogen auf deren Aktionspreise.
- Anthropic stellte Claude Opus 5.5 vor. Nach Angaben des Unternehmens erreicht es bei vielen Aufgaben das Niveau des Spitzenmodells Fable 5.1 und soll im Betrieb 40 Prozent weniger kosten als Opus 5. Der Listenpreis sinkt von 5 auf 4 US-Dollar je Million eingelesener Tokens sowie von 25 auf 20 US-Dollar für ausgegebene Tokens.
Am Mittwoch, 23. September, veröffentlichte Google zwei neue Modelle für Sprachausgabe: Gemini 3.8 Flash TTS und Flash-Lite TTS. Sie unterstützen mehr als 100 Sprachen und bieten über 2.000 vorkonfigurierte Stimmen, die sich per Beschreibung anpassen lassen.
Wichtig für die Einordnung: Die Angaben zu Leistung, Preis und Funktionsumfang stammen jeweils von den Anbietern selbst.
Warum ein günstigerer Token nicht automatisch eine günstigere Aufgabe bedeutet
Die meisten Anbieter rechnen nach Tokens ab. Tokens sind kleine Textbausteine, grob gesagt Wortteile. Sinkt der Preis je Token, klingt das zunächst nach einer klaren Ersparnis.
Doch diese Rechnung greift zu kurz.
Ein leistungsfähigeres Modell kann mehr Tokens verbrauchen, weil es länger nachdenkt, Zwischenschritte erzeugt oder Ergebnisse mehrfach überprüft. Dann kann der Preis je Token sinken, während die Kosten je erledigter Aufgabe gleich bleiben oder sogar steigen.
Der unabhängige Testdienst Artificial Analysis hat dies am 22. September für Claude Opus 5.5 auf der höchsten Leistungsstufe ausgewertet:
- Opus 5.5 liegt dort an der Spitze eines Leistungsindexes.
- Für eine Aufgabe benötigt das Modell jedoch deutlich mehr Tokens als Opus 5.
- Allein der Mehrverbrauch hätte die Kosten je Aufgabe um rund 80 Prozent erhöht.
- Durch die niedrigeren Tokenpreise kostete eine Testaufgabe mit Opus 5.5 letztlich 5,98 US-Dollar. Mit Opus 5 waren es 5,86 US-Dollar.
Das Ergebnis: mehr Leistung zum nahezu gleichen Preis je Aufgabe – aber keine wirkliche Ersparnis.
Das widerspricht nicht zwingend Anthropics Aussage über 40 Prozent niedrigere Betriebskosten. Die Aussage bezieht sich auf den allgemeinen Betrieb; der Vergleich von Artificial Analysis betrachtet die höchste Leistungsstufe. Er zeigt aber, warum Preislisten allein wenig über die tatsächliche Wirtschaftlichkeit aussagen.
Die relevante Kennzahl: Kosten je brauchbarem Ergebnis
Für Unternehmen ist deshalb nicht der Tokenpreis die wichtigste Kennzahl, sondern:
Was kostet eine brauchbar erledigte Aufgabe?
Ein praktikabler Test sieht so aus:
- Wählen Sie 20 typische Aufgaben aus Ihrem Betrieb aus.
- Lassen Sie zwei oder drei Modelle dieselben Aufgaben bearbeiten.
- Bewerten Sie die Ergebnisse anhand vorher festgelegter Kriterien.
- Teilen Sie die Gesamtkosten durch die Zahl der brauchbaren Ergebnisse.
Das ist aufwendiger als ein Vergleich von Preislisten. Es ist aber die Kennzahl, die im Controlling, in der Fachabteilung und in der Geschäftsführung relevant ist.
ChatGPT arbeitet jetzt auf Zuruf
Am 23. September hat OpenAI die Sprachfunktion von ChatGPT erweitert. Sie kann nun Plugins nutzen, etwa für E-Mail, Kalender und Slack. Die Funktion läuft auf den neuen GPT-6-Modellen und steht auch in ChatGPT Work zur Verfügung – also in dem Bereich, in dem ChatGPT Dokumente, Präsentationen und Tabellen erstellt.
Praktisch bedeutet das: Nutzer können künftig Fragen stellen wie:
- „Was ist in meinem Postfach gerade dringend?“
- „Wann habe ich am Montag eine halbe Stunde frei?“
- „Schreib dem Kunden einen Entwurf.“
ChatGPT wird damit nicht nur zur Diktierfunktion. Es wird zu einem Assistenten, der zuhört und anschließend in verbundenen Programmen arbeitet.
Genau darin liegt der Nutzen. Und genau darin liegt die neue Verantwortung.
Drei Fragen, bevor ChatGPT an ein Postfach darf
Bevor eine Sprachfunktion im Unternehmen auf Mail, Kalender oder andere Systeme zugreifen darf, sollten drei Fragen geklärt sein.
1. Auf welche Konten darf die KI zugreifen?
Ein verbundenes Plugin sieht so viel, wie das jeweilige Konto und die erteilte Freigabe zulassen. Deshalb sollte nicht automatisch das reguläre Konto der Geschäftsführung oder einer Führungskraft verbunden werden.
Für erste Tests empfiehlt sich ein separates Testkonto mit begrenzten Rechten.
2. Darf die KI nur lesen oder auch handeln?
Es macht einen erheblichen Unterschied, ob ein System E-Mails zusammenfasst oder E-Mails im Namen eines Mitarbeitenden versendet.
Ein Entwurf ist in vielen Fällen unkritisch. Eine automatisch versandte Nachricht kann dagegen rechtliche, wirtschaftliche oder reputative Folgen haben.
3. Wer hat die Freigabe erteilt?
Wenn niemand klar benennen kann, wer den Zugriff auf Postfach, Kalender oder Slack freigegeben hat, fehlt bereits die wichtigste Grundlage für einen kontrollierten Einsatz.
Zugriffsrechte sollten deshalb nicht beiläufig in einzelnen Teams vergeben werden. Sie brauchen eine klare Verantwortlichkeit.
Was Geschäftsführungen jetzt tun können
Erstens: Vergleichen Sie KI-Modelle nach den Kosten je erledigter Aufgabe, nicht nach dem Preis je Token.
Zweitens: Prüfen Sie laufende Verträge mit KI-Anbietern. Sinkende Listenpreise bedeuten nicht automatisch, dass Ihre bestehenden Konditionen angepasst werden.
Drittens: Testen Sie Sprachfunktionen und neue Integrationen zunächst in einer begrenzten Umgebung – mit Testkonten, klaren Berechtigungen und ohne automatische Versand- oder Freigaberechte.
KI wird günstiger. Gleichzeitig greift sie tiefer in den Arbeitsalltag ein. Der wirtschaftliche Vorteil entsteht nicht durch den niedrigsten Tokenpreis, sondern durch einen kontrollierten Einsatz in den richtigen Prozessen.
Mehr Einordnung im KI-Strategiebriefing
Im KI-Strategiebriefing ordnen wir jede Woche die wichtigsten KI-Entwicklungen für Geschäftsführungen und Entscheider ein: kompakt, praxisnah und mit Blick auf die Entscheidungen, die jetzt anstehen.
Jeden Freitag um 8:00 Uhr · 30 Minuten · online
Jetzt zum nächsten KI-Strategiebriefing anmelden:
https://www.silbury.com/strategie
Quellen
- OpenAI, „Introducing GPT-6 Sol and Luna“, 22. September 2026
- Anthropic, „Introducing Claude Opus 5.5“, 22. September 2026
- Artificial Analysis, Auswertung zu Claude Opus 5.5, 22. September 2026
- OpenAI, Ankündigung zur erweiterten Sprachfunktion, 23. September 2026
- Google, Vorstellung von Gemini 3.8 Flash TTS und Flash-Lite TTS, 23. September 2026
- xAI, Ankündigung von Grok 4.7, 21. September 2026
- Xiaomi, MiMo-V2.6 auf Hugging Face, 22. September 2026
- Anthropic, „Detecting and countering misuse of AI: September 2026“, 10. September 2026


