KI ist gerade 100-mal günstiger geworden
Was bedeutet das für die physische Welt?
0,03 US-Dollar gegenüber 3,15 US-Dollar
Geschätzte durchschnittliche Benchmarkkosten: DeepSeek V4-Flash gegenüber Claude Fable 5
KI ist gerade
100-mal günstiger geworden
0,03 US-Dollar gegenüber 3,15 US-Dollar
Jahrelang konzentrierte sich die Diskussion über künstliche Intelligenz auf eine einzige Frage: Wie intelligent kann sie werden?
Die nächste Phase könnte durch eine andere Frage geprägt werden: Wie günstig lässt sich diese Intelligenz überall bereitstellen?
Im August 2026 lieferte das chinesische KI-Unternehmen DeepSeek eine eindrucksvolle Antwort. Eine unabhängige Analyse seines Modells V4-Flash ergab Kosten von ungefähr 0,03 US-Dollar für einen durchschnittlichen Benchmarktest, verglichen mit 3,15 US-Dollar für Anthropics Claude Fable 5. Nach diesem Maßstab war DeepSeek etwa 105-mal günstiger.
Das bedeutet nicht, dass DeepSeek 105-mal besser oder insgesamt leistungsfähiger ist. Es bedeutet, dass die Kosten nützlicher KI-Arbeit dramatisch sinken. Das könnte ebenso folgenreich sein wie der Wettlauf um das leistungsfähigste Modell.
Für Unternehmen reichen die Folgen weit über Chatbots und Software hinaus. Wenn leistungsfähige KI günstig genug für den breiten Einsatz wird, kann sie Laptops und Smartphones verlassen und in Geschäfte, Einkaufszentren, Flughäfen, Hotels, Museen, Stadien und öffentliche Räume einziehen.
KI steht kurz davor, Teil der physischen Welt zu werden.
Die Zahlen hinter der Schlagzeile
Laut einer von Reuters aufgegriffenen Untersuchung kostete DeepSeek V4-Flash zum Start 0,14 US-Dollar je Million Eingabetokens und 0,28 US-Dollar je Million Ausgabetokens. Artificial Analysis schätzte die durchschnittlichen Kosten eines abgeschlossenen Benchmarktests auf drei Cent. Die entsprechenden geschätzten Vergleichskosten betrugen:
- 0,86 US-Dollar für Moonshot AIs Kimi K3
- 1,86 US-Dollar für OpenAIs GPT-5.6 Sol
- 3,15 US-Dollar für Anthropics Claude Fable 5
Der Vergleich ist wichtig, weil Tokenpreise nicht die ganze Geschichte erzählen. Ein günstiges Modell kann teuer werden, wenn es deutlich mehr Denkschritte, Versuche oder erzeugten Text benötigt, um eine Aufgabe abzuschließen. Die Kosten je abgeschlossener Aufgabe sind deshalb ein wesentlich nützlicherer wirtschaftlicher Maßstab.
DeepSeeks Vorteil blieb außergewöhnlich: Bei den untersuchten Tests war es ungefähr 29-mal günstiger als Kimi K3, 62-mal günstiger als GPT-5.6 Sol und 105-mal günstiger als Claude Fable 5.
Dabei gibt es eine wichtige Einschränkung. DeepSeek V4-Flash erreichte 50 von 100 Punkten im Intelligence Index von Artificial Analysis. Damit lag es auf dem Niveau von Googles Gemini 3.6 Flash, aber hinter den führenden Modellen von Anthropic und OpenAI, die mindestens neun Punkte mehr erzielten.
DeepSeek führte anschließend das leistungsfähigere V4 Pro ein und kündigte höhere API-Preise für beide V4-Modelle an. Der genaue Preisabstand wird sich daher weiter verändern. Die übergeordnete Richtung ist jedoch eindeutig: Wettbewerb senkt die Kosten leistungsfähiger KI, und Unternehmen haben inzwischen eine viel größere Auswahl an Preis-Leistungs-Optionen.
Das leistungsfähigste Modell ist nicht immer das richtige
Ein großer Teil der KI-Branche orientiert sich an Ranglisten. Modelle konkurrieren in höherer Mathematik, Softwareentwicklung, wissenschaftlichem Denken und autonomem Werkzeugeinsatz. Diese Fähigkeiten sind wichtig, doch die meisten Kundengespräche benötigen keine Spitzenleistung beim logischen Schlussfolgern.
Ein Kunde in einem Einkaufszentrum möchte vielleicht wissen:
- Wo ist ein bestimmtes Geschäft?
- Wann schließt das Einkaufszentrum?
- Ist dieses Produkt in einer anderen Farbe erhältlich?
- Welches Restaurant bietet vegetarisches Essen?
- Wie melde ich mich zum Treueprogramm an?
- Kann ich mit jemandem Arabisch, Spanisch oder Mandarin sprechen?
Diese Interaktionen sind wertvoll, aber meist klar begrenzt, wiederholbar und auf freigegebene Informationen gestützt. Für jeden Austausch das teuerste Schlussfolgerungsmodell der Welt zu verwenden, kann einer Paketlieferung im Formel-1-Wagen gleichen: technisch beeindruckend, wirtschaftlich aber unnötig.
Die Zukunft wird wahrscheinlich nicht einem einzelnen KI-Modell gehören. Intelligente Systeme wählen für jede Aufgabe das passendste Modell. Ein schnelles, wirtschaftliches Modell kann Routineanfragen bearbeiten. Komplexere Anliegen können an ein leistungsfähigeres Modell weitergeleitet werden. Sensible oder außergewöhnliche Gespräche können Menschen übernehmen.
Dieser Ansatz, manchmal als Modellrouting bezeichnet, ermöglicht Unternehmen ein ausgewogenes Verhältnis von Intelligenz, Geschwindigkeit, Zuverlässigkeit und Kosten, statt für jede Interaktion einen Aufpreis zu zahlen.
Von einzelnen Pilotprojekten zu ganzen Standortnetzen
Die Wirtschaftlichkeit wird besonders wichtig, wenn KI in physische Standorte einzieht.
Ein Händler, der einen einzelnen KI-Assistenten testet, kann vergleichsweise hohe Nutzungskosten hinnehmen. Ein multinationales Unternehmen mit Assistenten an 500 Standorten muss anders rechnen. Wenn jeder Standort täglich Hunderte Gespräche führt, summieren sich selbst kleine Kostenunterschiede schnell.
Betrachten wir ein Netzwerk aus 1.000 KI-Assistenten mit jeweils 200 Gesprächen pro Tag. Das ergibt:
- 200.000 Gespräche täglich
- Ungefähr sechs Millionen Gespräche monatlich
- Mehr als 73 Millionen Gespräche jährlich
Das ist ein Beispielszenario und keine Prognose der Kosten von DeepSeek oder Claude. Die tatsächlichen Ausgaben hängen von Gesprächslänge, Sprachverarbeitung, Systemarchitektur, Zwischenspeicherung und gewählten Modellen ab. Es zeigt jedoch die Bedeutung niedrigerer Ausführungskosten: Bereits ein Cent Ersparnis je Gespräch ergibt in diesem Maßstab ungefähr 730.000 US-Dollar jährlich.
Der KI-Preiskampf kann damit verändern, welche Projekte Unternehmen umsetzen möchten. Was früher nur für einzelne Vorzeigestandorte sinnvoll war, kann in vollständigen Handels-, Hotel- oder Verkehrsnetzen tragfähig werden.
Intelligenz braucht weiterhin eine Schnittstelle
Günstigere KI schafft nicht automatisch ein besseres Kundenerlebnis.
Die meiste KI bleibt hinter Suchfeldern oder Chatfenstern verborgen. Sie mag leistungsfähig sein, ist in einer physischen Umgebung jedoch häufig unsichtbar. Kunden müssen ein Terminal bemerken, dessen Funktion verstehen, sich nähern und sich für eine Interaktion entscheiden.
Hier wird holografische KI bedeutsam.
Miirage verleiht digitaler Intelligenz physische Präsenz. Statt Kunden um die Interaktion mit einem weiteren flachen Bildschirm zu bitten, kann ein holografischer KI-Avatar als lebensgroßer Markenvertreter erscheinen: aus der Entfernung sichtbar, aufmerksamkeitsstark und bereit für ein natürliches gesprochenes Gespräch.
Dieselbe Installation kann zwischen mehreren Rollen wechseln:
- Eine wirkungsvolle holografische Anzeige
- Ein mehrsprachiger Kundenservice-Assistent
- Ein Produktspezialist oder virtueller Verkäufer
- Ein Assistent für Orientierung und Besucherinformation
- Eine Markenfigur oder ein Markenbotschafter
- Ein interaktiver Veranstaltungsgastgeber
- Eine Verbindung zu Treueprogrammen, Produktkatalogen und menschlicher Liveunterstützung
Diese Kombination zählt. Herkömmliche digitale Beschilderung vermittelt eine Botschaft. Ein holografisches KI-System kann Aufmerksamkeit gewinnen, auf die Person direkt vor ihm reagieren und sie bei einem nächsten Schritt unterstützen.
Es macht aus einem Medium ein Gespräch.
Was sinkende KI-Kosten für Miirage bedeuten
Für Miirage bedeutet DeepSeeks Entwicklung nicht, dass jeder holografische Avatar sofort zu einem bestimmten Modell wechseln sollte. Bei Unternehmens-KI zählen auch Genauigkeit, Latenz, Sprachleistung, Sicherheit, Datenstandort, regulatorische Anforderungen und langfristige Zuverlässigkeit.
Die eigentliche Chance liegt in einer flexiblen Architektur.
Miirages Zukunft hängt nicht davon ab, welches einzelne KI-Unternehmen den Modellwettlauf gewinnt. Während DeepSeek, Anthropic, OpenAI, Google und andere konkurrieren, kann Miirage von Verbesserungen im gesamten Markt profitieren. Bessere Modelle machen Avatare leistungsfähiger. Schnellere Modelle machen Gespräche natürlicher. Günstigere Modelle machen große Installationsnetze wirtschaftlich tragfähiger.
Daraus entstehen mehrere Möglichkeiten.
Mehr Intelligenz an jedem Standort
Niedrigere Betriebskosten erlauben KI-Unterstützung über wenige hochwertige Standorte hinaus. Eine Einkaufszentrengruppe könnte unterschiedliche Assistenten an Eingängen, Informationspunkten und in Verkaufsbereichen einsetzen. Ein Flughafen könnte mehrsprachige Orientierung über mehrere Terminals bieten. Ein Händler könnte jede Abteilung mit einem eigenen Spezialistenavatar ausstatten.
Längere und gehaltvollere Gespräche
Wenn jede erzeugte Antwort erhebliche Kosten verursacht, begrenzen Unternehmen naturgemäß die Nutzung. Niedrigere Kosten erleichtern ausführlichere Produktsuche, Vergleiche, Problemlösung und begleiteten Verkauf.
Mehrsprachiger Service im großen Maßstab
An einem physischen Standort ist selten jederzeit Personal für jede Sprache verfügbar. Holografische KI kann diese Lücke verkleinern, einheitliche Informationen bereitstellen und während der Interaktion die Sprache wechseln.
Intelligentere Mediennetzwerke
Miirage-Displays können mehr sein als ein Netzwerk von Werbebildschirmen. Sie können eine intelligente Interaktionsebene über mehrere Standorte bilden: Kampagnen ausspielen, Fragen beantworten, Besucher führen und auf aktuelle Informationen freigegebener Systeme reagieren.
Einfacherer Einstieg für Unternehmen
Sinkende Modellkosten verringern eine Hürde für KI-Experimente. Kleinere Organisationen und einzelne Einrichtungen erhalten Zugang zu Fähigkeiten, die zuvor nur für die größten internationalen Unternehmen tragfähig erschienen.
Günstige Intelligenz braucht weiterhin gute Steuerung
Niedrige Kosten dürfen nicht mit Einsatzreife verwechselt werden.
Ein KI-Avatar, der ein Unternehmen vertritt, muss korrekte, markengerechte und sichere Antworten geben. Er braucht eine kontrollierte Wissensbasis, klare Grenzen, geeignete Weiterleitung und zuverlässige Überwachung. Er muss wissen, welche Fragen er beantworten darf und welche er nicht versuchen sollte.
Im Unternehmensumfeld gewinnt nicht einfach das Modell mit dem niedrigsten Tokenpreis. Entscheidend ist das Gesamtsystem, das Folgendes verbindet:
- Das richtige Modell für die jeweilige Anfrage
- Freigegebene und regelmäßig gepflegte Informationen
- Schnelle Spracherkennung und natürliche Sprachausgabe
- Klare Regeln für Datenschutz und Datenverwaltung
- Anbindung an relevante Unternehmenssysteme
- Fernüberwachung und betriebliche Ausfallsicherheit
- Einen Weg zu menschlicher Unterstützung bei Bedarf
Das KI-Modell ist der Motor. Es ist nicht das ganze Fahrzeug.
Die Ära physischer KI rückt näher
DeepSeeks jüngste Veröffentlichungen sind Teil eines wesentlich größeren Wandels. Die Kosten leistungsfähiger Intelligenz sinken, die Modellauswahl wächst und der Wettbewerb zwingt alle großen Anbieter, mehr Nutzen für weniger Geld zu liefern.
Mit dieser Entwicklung wird KI kein knappes Merkmal weniger digitaler Produkte mehr sein. Sie wird zu einer eingebetteten Ebene in unseren Umgebungen.
Am stärksten profitieren nicht unbedingt Unternehmen, die ein einzelnes „bestes“ Modell auswählen. Es profitieren jene, die verstehen, wo Intelligenz Wert schafft, für jede Aufgabe das richtige Leistungsniveau wählen und Menschen einen intuitiven Zugang bieten.
In der digitalen Welt bleibt diese Schnittstelle möglicherweise ein Chatfenster.
In der physischen Welt könnte sie ein holografischer Mensch direkt vor Ihnen sein.
Miirage entwickelt diese Schnittstelle: Das Unternehmen verwandelt schnell fortschreitende KI in sichtbare, ansprechende und nützliche Erlebnisse. Aus Aufmerksamkeit werden Gespräche, aus Gesprächen werden Kunden.