
Video zur künstlichen Intelligenz der nächsten Generation von OpenAI kommt mit einem sozialen Twist: Sora 2 Es wird nicht nur ein leistungsfähigeres Modell vorgestellt, sondern auch eine App, mit der Clips sofort erstellt und auf Wunsch sofort geteilt werden können. Das Versprechen ist einfach: Sie nehmen eine kurze Aufnahme auf Um Ihre Stimme und Ihr Gesicht einzufangen, wählen Sie die Szene aus und das System platziert Sie hinein, ohne den Faden zwischen den Aufnahmen zu verlieren.
Der Schritt stellt eine Reise in den Kontext, die mit ChatGPT begann und mit Bildmodellen fortgesetzt wurde: der erste Sora Es deutete bereits auf die Beständigkeit der Objekte und eine gewisse visuelle Kohärenz hin, doch nun konzentriert sich der Sprung auf die physische Treue und in der Tonintegration. Das Ziel besteht darin, dass sich die Störungen menschlich anfühlen und nicht wie algorithmische Störungen, und dass die Welt des Clips beim Verknüpfen von Aufnahmen ihren Zustand beibehält.
Was ist neu am Modell Sora 2?
OpenAI beschreibt Sora 2 als einen großen Fortschritt mit glaubwürdigerem Verhalten bei alltäglichen Aktionen und komplexen Szenen: Wenn ein Ball nicht hineingeht, springt er dort zurück, wo er landet. Und es verschwindet nicht; bei mehreren Aufnahmen bleibt der Umgebungszustand erhalten. Darüber hinaus akzeptiert das System ausführlichere Anweisungen und unterstützt kurze Erzählungen mit besserer Kontrolle über Stil, Dauer und Übergänge.
Eine weitere bemerkenswerte Neuerung ist der Soundteil: Das Modell erzeugt Stimmen, Effekte und Klanglandschaften mit dem Bild synchronisiert, sodass der Dialog zur Umgebung passt (von einer belebten Straße bis hin zu Feuerwerk). Das Ergebnis ist ein umfassenderes audiovisuelles Paket, das im Vergleich zur vorherigen Version die Messlatte höher legt.
Die Social-App: Vertikaler Feed, Remixe und Cameos
Zusammen mit dem Modell bringt OpenAI eine App auf den Markt, die für soziales Erstellen und Teilen konzipiert ist. Das Herzstück ist ein Feed vertikaler mobiler Typ mit Clips bis zu 10 Sekunden, Like-Buttons, Kommentare und die Möglichkeit, remixzu verbessern. Für Sie Seite Es passt sich durch natürliche Sprache an und priorisiert die Interaktion mit Menschen in der Nähe, um endlosen passiven Konsum zu vermeiden.
Um in einem Clip zu erscheinen, erfordert die App eine Bild- und Sprachüberprüfung und von dort aus erlaubt Cameos in von Ihnen oder anderen erstellten Szenen. Es gibt kein Hochladen von Ihrer Kamerarolle: Die Aufnahme erfolgt innerhalb der App selbst, was die Steuerung und Berechtigungsverfolgung zu allen Zeiten
Identität, Wohlbefinden und Sicherheit
Die Ähnlichkeitsprüfung wird begleitet von Benachrichtigungen jedes Mal, wenn jemand Ihr Bild verwendet, auch wenn das Video noch im Entwurfsstadium ist. Darüber hinaus können Sie Berechtigungen widerrufen und die Entfernung von Clips beantragen, in denen Sie erscheinen. Dabei wird eine menschliche Moderation eingesetzt, um Belästigungen und Identitätsdiebstahl zu verhindern.
OpenAI sagt, dass die Erfahrung die Schaffung von DoomscrollingFür Jugendliche gibt es Anzeige- und Generationsgrenzen, zusätzliche Kontrollen für Cameos und Kindersicherungstools von ChatGPT. Das Unternehmen gibt an, dass synthetische Inhalte mit Quellsignalen und digitalen Anmeldeinformationen gekennzeichnet sind, um die Rückverfolgbarkeit zu erleichtern.
Verfügbarkeit, Zugriff und Preise von Sora 2
Der Einsatz beginnt in iOS auf Einladung in den USA und Kanada, mit Plänen, den Zugang später auf weitere Länder auszuweiten. Derzeit ist es in Spanien nicht verfügbar. Der Dienst beginnt kostenlos mit Einschränkungen je nach Rechenkapazität und es wird eine höherwertige Sora 2 Pro-Variante für ChatGPT-Abonnenten geben, plus Webzugriff und eine zukünftige API.
Was Sora 2 gut macht und was ihm noch fehlt
Die Beispiele zeigen Kunstturnen, Saltos oder Actionszenen mit konsistenterer Physik, und in Animation oder Stop-Motion die Ergebnisse besonders solide aussehen. Dennoch gibt es weiterhin Mängel: In realistischen Sequenzen können Details wie unnatürliche Flugbahnen oder Abpraller (zum Beispiel bei einem Beachvolleyballspiel) und bei aufeinanderfolgenden Schlägen kann es an Kohärenz mangeln.
Wettbewerb und Marktkontext
Sora 2 landet in einem zunehmend wettbewerbsintensiven Umfeld: Landebahn mit Gen-4 Im kreativen Bereich integriert Google Veo 3 in YouTube und Meta testet einen Feed mit kurzen, von KI generierten Videos. TikTok verschärft unterdessen die Regeln für sensible synthetische Inhalte. OpenAIs Ansatz ist Setzen Sie auf Ihre eigene soziale Erfahrung rund um Ihre Video-Engine.
Urheberrecht und Schutzmaßnahmen
Das Unternehmen arbeitet mit Filter, die Anfragen blockieren potenziell problematisch aufgrund von Urheberrechtsproblemen, die manchmal die Generierung bestimmter Clips verhindern. Parallel dazu sieht sich OpenAI mit Urheberrechtsklagen konfrontiert, von denen der Fall der New York Times einer der bekanntesten ist, und verteidigt Mechanismen zum Ausschluss und zur Entfernung von Inhalten für Rechteinhaber.
Was der Benutzer tun kann
Für Kreative, kleine Agenturen oder individuelle Profile öffnet Sora 2 die Tür zu Produzieren Sie Clips mit Audio und Effekten kostengünstig und schnell. Cameo-Funktionen und Statuspersistenz zwischen den Aufnahmen ermöglichen kurze Stücke mit Kontinuität, während Remix-Optionen und ein Social Feed zum Erstellen einladen Kollaborative Formate Hin und her.
Mit einer Kombination aus audiovisuellem Modell und sozialer App zielt Sora 2 darauf ab, die Videoproduktion zu etwas Alltäglichem zu machen, aber mit klare Grenzen hinsichtlich Sicherheit, Identität und RechtenDas Angebot startet mit 10-Sekunden-Clips, obligatorischer Bildüberprüfung und Urheberrechtsfiltern, mit begrenzter Verfügbarkeit und einem Pro- und API-Pfad, der seine Weiterentwicklung bestimmen wird.