GPT-5.6 Sol vs Terra vs Luna: Die wahren Kosten von KI-Videoprojekten

Quelle: Elser AI

Die Preisliste der Token gibt dir keine Auskunft über die Kosten von KI-Video. Sie verrät dir lediglich den Preis für die Modellantwort. Die Projektkosten hängen davon ab, wie oft die Antworten geändert werden müssen, ob Renderfehler vermieden werden können, wie viele Kontexte wiederholt gesendet werden und welche Aufgaben tatsächlich fortgeschrittene Überlegungen erfordern.

Bis zum 28. August 2026 listet OpenAI GPT-5.6 Sol mit 4 USD pro Million Eingabe-Token und 20 USD pro Million Ausgabe-Token, Terra mit 2 USD und 12 USD, Luna mit 0,20 USD und 1,20 USD. Die Kosten für zwischengespeicherte Eingaben betragen 0,40 USD, 0,20 USD bzw. 0,02 USD. Laut der Preisliste von OpenAI ist der aktuelle Preis für Sol mindestens bis zum 21. November ein Aktionspreis.

Dieser Artikel simuliert einen realistischen Pre-Production-Workflow für einen einminütigen Anime-Video. GPT-5.6 wird für Text- und Bildanalyse, Planung, Prompting und Überprüfung verwendet – nicht für die direkte Videorendering.

Projekte, die wir derzeit berechnen

Angenommen, ein unabhängiger Kreativer produziert einen 60-sekündigen animierten Kurzfilm mit acht Einstellungen. Der Arbeitsablauf umfasst:

  • Voraussetzung Entwicklung;
  • Ein 900 Wörter langes Skript;
  • Zeichenspezifikation;
  • Ein Storyboard-Briefing mit acht Kameras;
  • Achte Generation von Eingabeaufforderungen und Überarbeitungen;
  • Sprach- und Klangrichtung;
  • Kontinuitätsprüfung mit ausgewählten Frames durchführen;
  • Titel, Beschreibung, Untertitel und Plattform-Metadaten.

Video-, Bild-, Sprach- und Bearbeitungskosten variieren je nach Plattform und werden nicht in die Token-Berechnung einbezogen. Dieser Ausschluss ist bewusst: Wir möchten zunächst die Planungsebene verstehen und dann untersuchen, wie sie die teure Rendering-Ebene beeinflusst.

Du kannst diesen gesamten Prozess in Elser AI durchführen, wobei Skripte, Rollen, Storyboards, Szenen, Audio und der endgültige Schnitt miteinander verbunden bleiben. Die folgende Berechnung hilft dabei zu entscheiden, welches Sprachmodell jede Entscheidung unterstützen sollte.

Aktuelle Preiseingabe

| Modell | Nicht gecachter Input / 1M | Gecachter Input / 1M | Output / 1M | | Sol | $4.00 | $0.40 | $20.00 | | Terra | $2.00 | $0.20 | $12.00 | | Luna | 0,20 $ | 0,02 $ | 1,20 $ |

Die Grundformel lautet:

cost = (Anzahl der nicht zwischengespeicherten Eingabetoken × Eingaberate / 1.000.000) + (Anzahl der zwischengespeicherten Eingabe-Token × Cache-Rate / 1.000.000) + (Anzahl der Ausgabe-Token × Ausgaberate / 1.000.000)

Immer die tatsächlichen API-Nutzungsdaten für die Abrechnung verwenden. Wort-zu-Token-Schätzungen sind nur Planungswerkzeuge, keine Rechnungen.

Szenario A: Verwendung eines einzigen Modells für alle Aufgaben

Angenommen, das Projekt verbraucht 160.000 Eingabe-Token und 55.000 Ausgabe-Token während des Forschungsberichts, der Iteration und des Überprüfungsprozesses, ohne Cache-Nutzung.

Sol

输入:0.16 × $4.00 = $0.64 Ausgabe: 0,055 × 20,00 $ = 1,10 $ Gesamt: $1.74

Erde

Eingabe: 0,16 × 2,00 $ = 0,32 $ Ausgabe: 0,055 × 12,00 $ = 0,66 $ Gesamt: $0.98

Luna

Eingabe: 0,16 × 0,20 $ = 0,032 $ Ausgabe: 0,055 × 1,20 $ = 0,066 $ Gesamt: $0.098

In diesem vereinfachten Fall betragen die Kosten von Luna etwa ein Zehntel der Kosten von Terra. Der absolute Unterschied zwischen Terra und Sol beträgt jedoch nur 0,76 US-Dollar. Wenn Sol eine unnötige Videoneuberechnung vermeiden kann, könnte es auf Projektebene günstiger sein. Umgekehrt spart die Verwendung von Sol zur Dateinamenerzeugung fast nichts, verbraucht aber hochwertige Rechenleistung, die in wertvollen Szenarien besser eingesetzt werden könnte.

Szenario B: Aufgabenverteilung nach Schwierigkeitsgrad

Näher an der realen Produktionsumgebung orientierte Routing-Aufgaben:

Luna: 80.000 Eingabe, 25.000 Ausgabe

Verwenden Sie Luna für kreative Erweiterungen, Metadatenverwaltung, Formatierung, Untertitelbereinigung, Standardisierung von Aufnahmeprotokollen und Auffüllen von Prompt-Vorlagen.

0,08 × 0,20 $ + 0,025 × 1,20 $ = 0,046 $

Terra: 65.000 Eingaben, 24.000 Ausgaben

Verwenden Sie Terra für Skriptentwicklung, Kameraführung, Dialoge, Szenenhinweise und Revisionszusammenfassungen.

0.065 × $2.00 + 0.024 × $12.00 = $0.418

Sol: 25.000 Eingaben, 6.000 Ausgaben

Nutzen Sie Sol für die finale narrative Prüfung, Widerspruchserkennung sowie die Diagnose der teuersten Fehlerszenarien.

0,025 × 4,00 $ + 0,006 × 20,00 $ = 0,22 $

Routen insgesamt

Der Routing-Workflow kostet etwa 0,684 USD an Tokens des Textmodells. In unserem Beispiel ist es günstiger als die alleinige Nutzung von Terra und bietet zu zwei entscheidenden Zeitpunkten, an denen teure Fehler vermieden werden können, eine stärkere Argumentationsfähigkeit.

Dies ist kein allgemeiner Benchmark. Es zeigt eine Methode: Aufgabenumfang abschätzen, tatsächliche Nutzung messen und dort bezahlen, wo die Fähigkeit die Akzeptanzrate verändert.

Szenario C: Hinzufügen von Prompt-Caching

Angenommen, das Projekt sendet wiederholt eine 12.000 Wörter umfassende stabile Produktionsbibel, die eine Rollentabelle, einen Styleguide, Sicherheitsbeschränkungen, Terminologie und ein Ausgabemuster enthält, und dieser Inhalt erscheint in 12 Anfragen.

Ohne Verwendung des Caches generiert dieser Block 144.000 Eingabe-Token. Bei einer nicht gecachten Schreiboperation und 11 gecachten Lesevorgängen betragen die ungefähren Eingabekosten von Terra:

Die ersten 12.000 nicht zwischengespeicherten Token: 0,012 × $2,00 = $0,024 Als Nächstes 132.000 Cache: 0,132 × $0,20 = $0,0264 Stabiler Kontext Eingabe insgesamt: $0.0504

Wenn kein Cache verwendet wird, kostet derselbe Kontext:

0,144 × $2,00 = $0,288

Für diesen Kontextblock wurde eine Reduzierung um 82,5 % erzielt. Dies ist keine Einsparung für das gesamte Projekt, da variable Eingabeaufforderungen und Ausgaben weiterhin zum normalen Preis abgerechnet werden.

Um die Cache-Wiederverwendung zu verbessern:

  • Zuerst den stabilen Inhalt platzieren;
  • Behalten Sie die Formulierung und Reihenfolge bei;
  • Anweisung zum Trennen von Variablen nach einem Haltepunkt;
  • Vermeiden Sie es, Zeitstempel oder Anfrage-IDs in stabile Präfixe einzufügen;
  • Messen Sie die Cache-Trefferquote, anstatt sie vorauszusetzen.

Die wirklich wichtigen Kosten: Akzeptabler Output

Führen Sie die gleiche Kostenabrechnung für einen tatsächlichen Kurzfilm auf Elser AI durch. Registrieren Sie sich, erstellen Sie eine repräsentative Szene und messen Sie die genehmigten Liefergegenstände – nicht die ursprünglich generierten Inhalte.

Stellen Sie sich zwei Methoden zur Prompt-Erstellung vor:

  • Nach vier Überarbeitungen generierte Luna einen brauchbaren Aufnahmehinweis.
  • Terra hat nach zwei Überarbeitungen einen brauchbaren Aufnahmehinweis generiert.

Luna könnte bei den Token-Kosten immer noch günstiger sein, aber die zusätzliche manuelle Prüfzeit könnte dominieren. Nehmen wir nun an, dass ein schwächerer Prompt zu zwei fehlgeschlagenen Videorenderings führt, die jeweils 1 Dollar kosten. Die Einsparungen bei den Text-Tokens sind dann dahin.

Verfolgen Sie die Kosten jedes akzeptierten Shots, einschließlich:

Kosten für Textmodelle

  • Bild/Referenzgenerierung
  • Videogenerierung und -erweiterung
  • Sprache und Audio Vergrößern/Exportieren
  • Manuelle Prüfungszeit
  • Kosten für verworfene Ausgaben

Das richtige Modell ist dasjenige, das diese Gesamtmenge minimieren kann, während es gleichzeitig die Qualitäts- und Durchlaufzeitanforderungen erfüllt.

Stufenweise Empfehlungen

Voraussetzungen erkunden: Luna

In einer Tabelle 30 eingeschränkte Prämissen anfordern. Die manuelle Auswahl ist kostengünstig, daher ist es sinnvoll, mit Luna mehrere Optionen zu generieren.

Skript und Rollenlogik: Terra

Terra ist die Standardoption zum Verfassen und Überarbeiten. Es bietet mehr Platz für feine Gespräche und Kontinuität, ohne den vollen Preis von Sol zahlen zu müssen.

Storyboard und Prompt-Format: zuerst Terra, dann Luna

Verwenden Sie Terra, um die Aufnahmeabsicht und die Kamerlogik zu definieren. Nach Genehmigung des Modus kann Luna die wiederholten strukturierten Felder ausfüllen.

Diagnose von Hochrisikoszenarien: Sol

Senden Sie den Prompt, Referenzframes, fehlerhafte Ausgaben sowie eine prägnante Testhistorie. Bitte sortieren Sie die möglichen Ursachen und schlagen Sie ein univariates Experimentdesign vor.

Metadaten und Untertitelbereinigung: Luna

Dies sind hochkapazitive, testbare Aufgaben. Verwenden Sie eine strenge Architektur und automatisierte Prüfungen.

Endgültiges Kontinuitätsaudit: Sol oder Terra

Für komplexe Erzählungen mit vielen Referenzen verwenden Sie Sol. Für kurze Inhalte mit klaren Regeln ist Terra ausreichend.

Nach der Genehmigung das Asset zu Elser AI verschieben, um Szenen, Sprache, Musik und Effekte zu generieren und zusammenzustellen, während die Änderungen mit dem ursprünglichen Plan verknüpft bleiben.

Zahlen Sie nicht für unnötige Ausgaben

Die Kosten für Ausgabe-Token sind fünf- bis sechsmal so hoch wie für Eingabe-Token, und das gilt für alle drei Modelle. Die Anfrage unterstützt das minimale Produkt für die nächste Entscheidung.

Stattdessen:

Führen Sie eine umfassende Analyse jedes möglichen Problems mit diesem Foto durch.

Verwendung:

Geben Sie die fünf wahrscheinlichsten Fehlerursachen, die Beweise für jede Ursache und einen kontrollierten Test zurück. Maximal 500 Wörter.

Wenn Menschen oder Werkzeuge eine Antwort benötigen, fordern Sie eine Tabelle, JSON oder feste Felder an. Lange, motivierende Einleitungen verbessern nicht die Produktionsqualität.

Budgetbild-Eingabe und Werkzeuge

Die obige einfache Berechnung deckt nur Text-Token ab. Bildeingaben werden tokenisiert verarbeitet, Tool-Aufrufe können zusätzliche Kosten verursachen. Die schnelle Verarbeitung kann ebenfalls andere Preise haben. Bitte verwenden Sie das Nutzungs- und Abrechnungs-Dashboard von OpenAI zur Aufzeichnung:

  • Nicht zwischengespeicherte Eingabe;
  • zwischengespeicherte Eingabe;
  • Ausgabe- und Inferenz-Token;
  • Bildeingabe;
  • Nutzung von Websuche oder anderen Werkzeugen;
  • Verarbeitungsebene.

Wenden Sie keine reinen Textergebnisse auf visuell intensive Arbeitsabläufe an.

Aufbau des Produktionskostenhauptbuchs

Wenn Ihre Budgetannahmen bereit sind, beginnen Sie mit der Erstellung mit Elser AI und validieren Sie den vollständigen Pfad vom Drehbuch bis zur endgültigen Szene, bevor Sie sich zu monatlichen Ausgaben verpflichten.

Für jedes akzeptierte Deliverable eine Zeile erstellen:

| Liefergegenstand | Modell | Versuche | Eingabe | Cache | Ausgabe | Werkzeugkosten | Renderingkosten | Prüfminuten | Akzeptiert? | |---|---|---:|---:|---:|---:|---:|---:|---:|---|

Nach fünf Projekten wird das Muster deutlich sichtbar. Sie könnten feststellen, dass Sol die Anzahl der Skriptüberarbeitungen reduziert, aber keinen Mehrwert für das Schreiben von Untertiteln bietet, oder dass eine bessere Referenztabelle mehr Kosteneinsparungen bringt als jede Modelländerung.

Wenn Elser Ihre Produktionsumgebung ist, fügen Sie die Elser-Generierungsversion und die endgültige Schnittrevision in dasselbe Hauptbuch ein. Ziel ist es, den gesamten Prozess zu optimieren, nicht einzelne API-Posten.

Häufig gestellte Fragen

Wie viel kostet es, ein KI-Video mit GPT-5.6 zu erstellen?

Es gibt keinen festen Betrag. In unserem einminütigen Demo-Workflow kostet die Textnutzung von GPT-5.6 weniger als 1 US-Dollar, ohne Bilder, Videos, Audio, Tools und manuelle Arbeit. Ihre tatsächliche Nutzung kann stark variieren.

Ist Luna immer die günstigste Wahl?

Seine Token-Gebühren sind am niedrigsten. Bei vagen oder risikoreichen Aufgaben ist es jedoch möglicherweise nicht die kostengünstigste Wahl für jedes akzeptierte Ergebnis.

Wann sollte man Sol verwenden?

Für komplexe Planung, dokumentenübergreifendes Denken, schwierige Fehlerdiagnose oder abschließende Überprüfung – in diesen Szenarien kann eine bessere Entscheidung kostspielige Produktionsfehler vermeiden.

Was sind die besten Standardeinstellungen für Kreative?

Terra ist die Standardoption für das Gleichgewicht. Leite wiederholte strukturierte Aufgaben an Luna weiter und eskalierte die schwierigsten Entscheidungen an Sol.

Kann Caching die Ausgabekosten senken?

Nein. Es reduziert die Kosten für qualifizierte wiederholte Eingaben. Halten Sie die Ausgabe präzise und strukturiert, um die Ausgaben zu kontrollieren.

Fazit

Der günstigste KI-Video-Workflow nutzt nicht das günstigste Sprachmodell. Sondern den Workflow, der mit möglichst wenigen verschwendeten Schleifen ein akzeptables Endvideo erreicht. Weise repetitive Aufgaben Luna zu, Entwicklungsarbeit Terra, und teure Entscheidungen Sol. Cache stabilen Kontext, begrenze die Ausgabe und miss die Gesamtkosten pro akzeptablem Shot. Das verwandelt Preisgestaltung von einem Marketing-Slogan in einen echten Produktionsvorteil.

Neueste Beiträge