Weiter zum Inhalt

Sora 2: Beispiele, Kritik und erste Eindrücke

Erfahre, was Sora 2 ist, was schon gut funktioniert, wo es noch hakt und warum OpenAIs neues Videomodell und die Social‑App gerade massiv in KI‑generierte Medien drängen.
Aktualisiert 18. Sept. 2026  · 8 Min. lesen

Mit KI erkunden

ChatGPTClaudePerplexity

Viele meinten, 2025 wird das Jahr der KI‑Agenten. Mit nur noch drei Monaten auf der Uhr sieht es für mich aber eher danach aus, als würde es das Jahr der KI‑Medien werden – mit großen Releases wie Veo 3, Nano Banana und jetzt Sora 2.

Ich wollte Sora 2 eigentlich ausführlich testen – so wie Veo 3 –, aber ich habe trotz ChatGPT‑Pro‑Abo noch keinen Zugriff. Der Rollout ist derzeit sehr schleppend und läuft vor allem über Einladungscodes der neuen Social‑App Sora (gleich mehr dazu).

Vermutlich will OpenAI so mehr Nutzer in die App lenken. Aus meiner Sicht ist das allerdings ein Fehlstart – ich schätze, die meisten wollen mit Sora Videos erzeugen und nicht eine neue Social‑App nutzen.

OpenAI muss einiges aufholen, um zu Googles Duo aus Veo 3 und Nano Banana aufzuschließen. Und der Start geriet aus meiner Sicht unglücklich: Zugang nur mit iPhone in den USA oder Kanada – selbst für Leute, die bereits 200 $ für ChatGPT Pro zahlen.

Trotzdem fasse ich hier zusammen, was wir bisher über Sora 2 wissen – sowohl über das Modell als auch die neue Social‑App. Und – weil Meta letzte Woche auch noch Vibes gestartet hat, im Kern ein Feed für KI‑Videos – spreche ich darüber, warum KI‑Firmen plötzlich mit Vollgas auf Medien- und Entertainment‑Anwendungen setzen.

Wir halten unsere Leser mit The Median auf dem Laufenden: unser kostenloser Freitags‑Newsletter mit den wichtigsten KI‑Storys der Woche. Abonnier ihn und bleib in wenigen Minuten pro Woche auf dem Laufenden:

Was ist Sora 2?

Sora 2 ist nicht nur ein neues Videomodell – es ist auch der Name von OpenAIs jüngster Social‑App. Wenn aktuell von Sora die Rede ist, können damit zwei Dinge gemeint sein:

  1. Sora 2, das Modell, erzeugt Videos und Audio aus Text‑Prompts (ähnlich wie Veo 3), und
  2. Sora, die Social‑App, eine neue iOS‑Plattform nur auf Einladung, auf der du Videos mit dem Abbild anderer remixen, Inhalte im Feed entdecken und KI‑Clips teilen kannst.

Beides ist eng verknüpft, da die App auf dem Sora‑2‑Modell läuft – die Ziele sind jedoch unterschiedlich. Das Modell ist OpenAIs Versuch eines universellen Systems zur Video- und Audiogenerierung. Die App ist ein Experiment: Was passiert, wenn man diese Fähigkeit in ein kurzformatiges, remixbares, soziales Gewand packt?

Wir schauen uns beides gleich im Detail an. Starten wir mit dem Hauptact: Sora 2 als Videomodell.

Sora 2: Das Videomodell

Als Erstes fiel mir auf, dass das OpenAI‑Team endlich nativen Audio‑Output gelöst hat – bis dato einer der größten Pluspunkte von Veo 3. Sora 2 kann Dialoge, Hintergrundatmosphäre und Soundeffekte direkt zusammen mit den Bildern erzeugen – ohne späteres Zusammenstückeln.

Darüber hinaus verspricht das Modell eine Reihe weiterer Verbesserungen. Gehen wir die einzelnen Punkte durch und schauen kritisch auf ein paar Beispiele.

Physikalisch stimmiger

Sora 2 soll Konzepte wie Gewicht, Balance, Objektkonstanz und Ursache‑Wirkung besser verstehen. Verwirft jemand einen Korbleger, soll der Ball vom Ring abprallen – und nicht wie in älteren Modellen magisch im Korb landen. Analysieren wir dieses Beispiel:

Die Bewegungsdynamik wirkt über weite Strecken überzeugend. Siehst du dir aber die letzten Frames an (die letzten 0,5 Sekunden), strecken sich die Beine des Skaters in eine unmögliche, fast deformierte Form.

Als die Katze vom Kopf des Skaters fällt, wirkt der Fall schwerelos und unnatürlich. Und ganz am Ende vollführt die Katze eine unmögliche Pirouette.

Ein weiteres Problem: Wir haben akustische Kontinuität, aber keine visuelle. Aus dem durchgängigen Kommentar des Sprechers über das Hallen‑Mikrofon schließen wir, dass Handlung und Zeit ohne Schnitt weiterlaufen. Tatsächlich besteht der 10‑Sekunden‑Clip aber aus drei unterschiedlichen Einstellungen, die klar zu verschiedenen Zeitpunkten spielen. Für mich ist deutlich: Sora 2 hat bei grundlegenden Montageprinzipien noch wenig Gespür.

Scheitern simulieren

Eine subtile, aber nützliche Neuerung: Sora 2 kann realistische Fehler erzeugen. Ältere Modelle zeigten meist erfolgreiche Aktionen – Sprünge gelingen, Tore fallen. Sora 2 versucht, Scheitern glaubhaft zu simulieren, was schwerer ist, als es klingt. Für KI erfordert „sich realistisch vertun“ oft ein tieferes internes Modell von Physik und menschlichem Verhalten.

Schauen wir ein Beispiel an:

Den Clip finde ich tatsächlich ziemlich gelungen, der Sturz wirkt fast echt. Was die Illusion bricht, ist das unmögliche Gleichgewicht am Ende. Man kann streiten, aber ich denke, der Mann hätte viel früher fallen müssen.

Das Potenzial ist dennoch groß. Ein naheliegender Use Case: gefährliche Aufnahmen. Statt echte Personen zu riskieren, könnte KI helfen, Komplikationen zu vermeiden und Kosten zu sparen.

Bessere Kontinuität

Laut OpenAI kann Sora 2 komplexe Prompts über mehrere Einstellungen hinweg befolgen und dabei Figur, Licht und Weltzustand konsistent halten. Wenn du also bittest, dass ein Mann mit roter Jacke ein Gebäude betritt, den Flur entlanggeht und eine Zeitung vom Schreibtisch nimmt, bleibt die Jacke rot, der Flur konsistent – und es tauchen nicht plötzlich zwei Zeitungen oder drei Arme auf.

Das hier ist das treffendste Beispiel, das ich dafür gefunden habe:

In nur 10 Sekunden stecken beeindruckende sechs Einstellungen. Was die Kontinuität wirklich trägt, ist der Ton – Hintergrundstimmen, Feuerwerk, Dialoge sind bemerkenswert gut generiert. Inhaltlich kann ich es nicht beurteilen, da ich die Sprache nicht verstehe, akustisch funktioniert es.

Bei genauerem Hinsehen wird es visuell jedoch verwirrend. Der Abstand der Figuren verändert sich zu stark – mal weit auseinander, Sekunden später berühren sich die Hände. Die Kamera springt über die Achse, scheinbar zufällig – dadurch wird die Raumgeometrie und die Position der Figuren schwer zu erfassen.

Pluspunkte: Die Gesichter sind über alle Shots hinweg konsistent. Das Licht stimmt ebenfalls und das Schwarz‑Weiß‑Grading bleibt stabil.

Flexibel im Stil

OpenAI behauptet, das Modell könne fließend zwischen realistisch, filmisch und animiert – inklusive Anime – wechseln, ohne Bewegung und Identität zu verlieren. Für Kreative ist das hilfreich, wenn sie stilisierte Ausgaben wollen, aber die Szene dennoch kontrollieren möchten.

Das ist vermutlich mein Lieblingsbeispiel aus allem, was gezeigt wurde. Es gibt Dinge, die funktionieren, und andere nicht – erzählerisch ist die Szene aus meiner Sicht aber sehr gelungen, vor allem, weil die emotionale Dynamik trägt.

Die Welt um die Protagonisten ist heiter: ein nächtliches Fest, Feuerwerk am Himmel, Feierlaune. Mittendrin führen die beiden Hauptfiguren offenbar ein schwieriges Gespräch – es wirkt, als stünden sie vor einer endgültigen Trennung.

Ich verstehe die Sprache nicht, daher kann ich den Wortlaut nicht beurteilen, aber der Gefühlsraum ist klar. Die Musik ist sehr gut gewählt – leicht beschwingt, passend zum Setting – und die Nahaufnahme am Ende, mit dem Feuerwerk in den Augen der weiblichen Figur, setzt den Schlusspunkt.

Wenn ich etwas kritisieren müsste, dann, dass die Menschen um sie herum gar nicht agieren. Das könnte jedoch eine bewusste Entscheidung sein – eine subjektive Perspektive, in der die Außenwelt für einen Moment stillsteht, weil die beiden so in ihrer Spannung gefangen sind, dass sie alles um sich herum ausblenden.

Empfehlung am Rande: Unser Guide zu einem der stärksten Konkurrenten von Sora – ByteDances Seedance 2.0.

Sora: Die Social‑App

Parallel zum Modell hat OpenAI die iOS‑App Sora gestartet, die dem Videoerlebnis eine vollständige soziale Ebene hinzufügt. Aktuell ist die App der Hauptweg zu Sora 2 – vorerst nur auf Einladung und auf Nutzer in den USA und Kanada beschränkt.

Ich vermute, OpenAI will sehen, was passiert, wenn Leute gegenseitig Inhalte remixen, sich selbst in Szenen einfügen und KI‑Video wie eine soziale Sprache nutzen. Ob das das nächste TikTok wird, ist eine andere Frage (ich halte die Chancen für null), aber die Mechanik ist interessant.

Wie funktioniert die Sora‑Social‑App

Im Kern ist Sora eine Feed‑Plattform für remixbares KI‑Video. Du scrollst durch kurze Clips anderer Nutzer, viele mit echten Gesichtern über ein System namens Cameos (unten mehr). Für eigene Clips schreibst du einen Prompt von Grund auf oder remixt ein bestehendes Video mithilfe eines Cameos – mit Zustimmung der betreffenden Person.

Quelle: OpenAI’s X

Du kannst „liken“, remixen, reposten oder Nutzern folgen – wie auf jeder anderen Social‑Plattform. Der Feed ist personalisiert, OpenAI betont aber, nicht auf Watchtime zu optimieren. Stattdessen soll er Kreativität und Inspiration fördern. Es gibt zudem Well‑Being‑Kontrollen, inklusive täglichen Generationslimits für Teenager und elterlichen Overrides über ChatGPT.

Die App bietet außerdem eine Empfehlungssteuerung in natürlicher Sprache – du kannst also auf Englisch steuern, was du sehen willst (z. B. „show me funny videos with animals“ oder „less surreal stuff“).

Cameo‑Funktionen

Das ist vermutlich die neuartigste Funktion. Cameos lassen dich einen kurzen einmaligen Video‑ und Audioclip von dir aufnehmen, den das Modell dann nutzt, um ein vollkörperliches Abbild von dir zu generieren – Stimme, Aussehen, Mimik inklusive. Nach Verifizierung und Upload deines Cameos kannst du dich selbst in Szenen einsetzen oder Freunden erlauben, dich in ihre Clips zu remixen.

OpenAI stellt es so dar, dass du die Kontrolle über dein Abbild jederzeit behältst:

  • Du entscheidest, wer dein Cameo nutzen darf.
  • Du kannst Zugriffe widerrufen oder jedes Video mit dir entfernen.
  • Du siehst alle Videos (inklusive Entwürfen), in denen dein Abbild vorkommt.

Das ist clever, wirft aber viele Fragen auf – zu Einwilligung, Urheberrecht, Moderation und Skalierung. OpenAI sagt, man baue menschliche Review‑Teams auf, um Grenzfälle wie Mobbing zu erkennen; für jüngere Nutzer gelten strengere Berechtigungen.

Warum der plötzliche Run auf KI‑Medien?

Wie ein aktueller Stanford‑Bericht festhält, hat KI bislang gar nicht so viele Branchen umgekrempelt – mit einer klaren Ausnahme: Medien.

genai disruption by industry

Quelle: State of AI in Business 2025 Report

Ich halte das nicht für einen statistischen Ausreißer. Ich habe mit Produzenten aus der Werbung gesprochen – sie nehmen den Wandel ernst. Viele experimentieren aktiv mit KI, um Produktionskosten zu senken, Timelines zu verkürzen und den Dreh‑Aufwand vor Ort zu reduzieren.

Dasselbe sieht man öffentlich: Ein Blick durch LinkedIn, und du findest ständig KI‑Kurzfilme, Ads und Konzept‑Trailer. Ein gutes Beispiel ist dieser Kalshi‑Spot – eine echte Anzeige für ein reales Unternehmen – vollständig mit KI produziert:

Deshalb glaube ich, dass OpenAI, Google und Meta nun mit Vollgas auf KI‑generierte Medien setzen. Wenn es ein Feld gibt, in dem Generative KI bereits nützlich ist – und in das Zeit und Geld fließen –, dann hier. Es ist logisch, dass die Labs um Plattformen, Ökosysteme und soziale Ebenen rund um Video konkurrieren.

Erst letzte Woche hat Meta Vibes gestartet – einen neuen Kurzvideo‑Feed für KI‑Clips –, der offensichtlich denselben Raum wie OpenAIs Sora‑App adressiert. Das Muster ist klar: Jetzt bei Medien und Entertainment punkten, solange die Technik andere, stärker regulierte Branchen wie Gesundheit oder Finanzen noch nicht zuverlässig umkrempeln kann.

Kurz: Video ist die niedrig hängende Frucht – und alle greifen zuerst danach.

Fazit

Bei aller Kritik muss man anerkennen, wie weit diese Modelle gekommen sind. Erinner dich: Anfang 2023 war das Beste, was wir hatten, das „Will Smith isst Spaghetti“‑Video. Heute sprechen wir über nativen Ton, emotionale Kontinuität und Social‑Remix‑Apps, in denen du dich selbst in ein Piratenschiff‑Duell oder eine surreale Kochshow mit deinem Hund versetzen kannst.

Dennoch hat Sora 2 weiterhin Probleme mit räumlicher Kohärenz, grundlegender Schnittlogik und feiner physikalischer Plausibilität. Und OpenAIs Entscheidung, den Zugang hinter eine iOS‑App nur auf Einladung zu stellen, dürfte dem Ruf bei Pro‑Usern, die ernsthafte Tools suchen, nicht helfen. Da ist viel Potenzial – aber auch Reibung.

Klar ist: KI‑generierte Medien bleiben das Feld, das man im Blick behalten sollte.

FAQs

Wie erhalte ich Zugriff auf Sora 2, wenn ich ein ChatGPT Plus‑ oder Pro‑Abo habe?

Viele Nutzer auf X und Reddit mit bestehenden OpenAI‑Abos sind frustriert über den stufenweisen Rollout, der zunächst frühere Power‑User von Sora 1 priorisiert und erst danach die Plus‑ und Pro‑Stufen öffnet. Wenn du Pro hast, prüfe die Push‑Benachrichtigung in der ChatGPT‑App oder melde dich auf sora.com an – bald sollten unbegrenzte 720p/10s‑Generierungen freigeschaltet werden, mit 1080p/20s im "Sora 2 Pro"‑Modus für Pro. Plus erhält ähnliche Vorteile, teils mit Warteschlangen; die kostenlose Stufe bietet großzügige, aber limitierte Tests. Wenn du noch keine Einladung hast, liegt das an der hohen Nachfrage – erwarte Wellen über die nächste Woche, erst in den USA und Kanada, dann weltweit.

Welche Generationslimits und Preise gelten für Sora 2?

Limits sind heiß diskutiert – X‑Posts nennen OpenAIs "großzügige Limits" vage; Free‑User treffen auf Cooldowns (z. B. eine Generation alle 15 Minuten), während Plus unbegrenzte Standard‑Generierungen bietet und Pro schnellere, höher aufgelöste Ausgaben ohne Caps hinzufügt. Reddit spekuliert, dass Rechenkosten längere Videos (über 20 s) Premium‑only halten, aber es gibt noch keine harten Paywalls – zum Start ist es kostenlos, mit kostenpflichtigen Upgrades für Extras wie Massen‑Render. Beobachte dein Dashboard für Echtzeit‑Quoten, da OpenAI sie je nach Nutzung anpasst.

Gibt es Sora 2 auch außerhalb der USA und Kanadas?

Die iOS‑App und der volle Zugang starteten am 30. September 2025 zuerst in den USA/Kanada. OpenAI plant eine schnelle globale Ausweitung – EU‑Nutzer berichten bereits von Beta‑Zugängen über ChatGPT Pro, teils mit VPN‑Workarounds für den App‑Download. Prüfe den Help‑Center‑Artikel von OpenAI für den Status deines Landes; Verzögerungen hängen mit Datenschutzrecht zusammen, die meisten Regionen sollen binnen Wochen folgen.

Wie schneidet Sora 2 im Vergleich zu Veo 3 oder Runway ab?

Auf X wird es mit Googles Veo 3 (stärker bei Länge) und Runway (bessere Editing‑Tools) verglichen, doch Sora 2 punktet bei Physik‑Plausibilität, konsistenten Figuren und integriertem Audio – viele sagen, es fühle sich wie ein "World Simulator" für kohärente Stories an. Reddit‑Analysen sehen Veo vorne bei 4K, aber Soras Steuerbarkeit (Multi‑Shots, Styles) und die Social‑App machen es zugänglicher und spaßiger. Minuspunkte: langsamere Renders und aktuell 720p‑Deckel. Insgesamt SOTA bei Realismus, aber das Rennen ist eng – probiere Demos aus und bilde dir dein Urteil.


Alex Olteanu's photo
Author
Alex Olteanu
LinkedIn

Ich bin Redakteurin und Autorin für KI-Blogs, Tutorials und Nachrichten und sorge dafür, dass alles zu einer starken Content-Strategie und SEO-Best Practices passt. Ich habe Data-Science-Kurse über Python, Statistik, Wahrscheinlichkeit und Datenvisualisierung geschrieben. Außerdem habe ich einen preisgekrönten Roman veröffentlicht und verbringe meine Freizeit mit Drehbuchschreiben und Filmregie.

Themen
Künstliche Intelligenz
OpenAI

Lerne KI mit diesen Kursen!

Kurs

Einführung in KI-Agenten

1 Std. 30 Min.
137.1K
Lerne die Grundlagen von KI-Agenten, ihre Bausteine und echte Anwendungen kennen – ganz ohne Programmieren.
Details anzeigenRight Arrow
Kurs Starten
Mehr anzeigenRight Arrow
Verwandt

Blog

Arten von KI-Agenten: Ihre Rollen, Strukturen und Anwendungen verstehen

Lerne die wichtigsten Arten von KI-Agenten kennen, wie sie mit ihrer Umgebung interagieren und wie sie in verschiedenen Branchen eingesetzt werden. Verstehe einfache reflexive, modellbasierte, zielbasierte, nutzenbasierte, lernende Agenten und mehr.

Blog

Die 36 wichtigsten Fragen und Antworten zum Thema generative KI für 2026

Dieser Blog hat eine ganze Reihe von Fragen und Antworten zu generativer KI, von den Grundlagen bis hin zu fortgeschrittenen Themen.
Hesam Sheikh Hassani's photo

Hesam Sheikh Hassani

15 Min.

Blog

Top 50+ AWS-Interviewfragen und Antworten für 2026

Ein kompletter Guide mit grundlegenden, fortgeschrittenen und szenariobasierten AWS-Interviewfragen – mit Beispielen aus der Praxis.
Zoumana Keita 's photo

Zoumana Keita

15 Min.

Tutorial

30 coole Python-Tricks für besseren Code mit Beispielen

Wir haben 30 coole Python-Tricks zusammengestellt, mit denen du deinen Code verbesserst und deine Python-Kompetenzen ausbaust.
Kurtis Pykes 's photo

Kurtis Pykes

15 Min.

Tutorial

Python Switch Case Statement: Ein Leitfaden für Anfänger

Erforsche Pythons match-case: eine Anleitung zu seiner Syntax, Anwendungen in Data Science und ML sowie eine vergleichende Analyse mit dem traditionellen switch-case.
Matt Crabtree's photo

Matt Crabtree

5 Min.

Tutorial

Abstrakte Klassen in Python: Ein umfassender Leitfaden mit Beispielen

Lerne mehr über abstrakte Klassen in Python, wozu sie gut sind und wie du mit dem Modul „abc“ einheitliche Schnittstellen sicherstellen kannst. Enthält praktische Beispiele und bewährte Methoden für eine effektive Umsetzung.
Derrick Mwiti's photo

Derrick Mwiti

10 Min.

Mehr AnzeigenMehr Anzeigen