🚀 OpenAI stellt neuen Bild-Generator vor

PLUS: 4 weitere Stories, wöchentliche Shorts & Tipps sowie KI-Ranking

Guten Abend, 🌙

eine Woche ist vergangen, und KI WEEKLY+ hält Dich auf dem neuesten Stand des KI-Universums.

In eigener Sache: KI Weekly+ verabschiedet sich bis zum 9. Januar in die Weihnachtspause. Wir wünschen Dir ruhige Feiertage und einen schönen Jahreswechsel. Danke, dass Du KI Weekly in diesem Jahr begleitet hast. Wir freuen uns auf ein neues Jahr voller spannender Entwicklungen und noch mehr KI. 🎄🎆

KI-Tools der Woche

  1. 👀 Cursor - Neuer visueller Editor, der Drag-and-Drop mit KI-Agenten kombiniert

  2. 🤖 Nemotron 3 - Nvidias neue Familie von Open-Source-Modellen

  3. 📚 Gemini Deep Research Agent - Googles SOTA-Agent für lang andauernde Aufgaben

  4. 📜 Mistral OCR 3 - SOTA-Modell zum Extrahieren von Text und Bildern aus Dokumenten

  5. 🎬 Ray3 Modify - Bearbeite und gestalte Videos neu

- 01 -

🤝 Disney und OpenAI schließen Milliarden-Deal

disney dream

Bildquelle: Unsplash

Disney hat einen dreijährigen Lizenzvertrag mit OpenAI bekanntgegeben. Nutzer von Sora erhalten damit Zugriff auf mehr als 200 Figuren aus Disney, Marvel, Pixar und Star Wars. Gleichzeitig investiert Disney rund 1 Milliarde US-Dollar in OpenAI.

Die Details:

  • Nutzer können ikonische Figuren wie Micky Maus, Darth Vader oder die Avengers für eigene Videogenerierungen einsetzen, und ausgewählte Kreationen sollen sogar auf Disney+ erscheinen.

  • Disney integriert darüber hinaus die APIs von OpenAI in verschiedene Produkte und führt ChatGPT intern ein, um die digitale Transformation des Konzerns zu beschleunigen.

  • Der Vertrag schließt die Nutzung von Persönlichkeitsrechten, insbesondere von Stimmen und Gesichtern prominenter Darsteller, ausdrücklich aus. Damit vermeidet Disney die derzeit besonders heiklen IP-Konflikte in Hollywood.

  • Am selben Tag verschickte Disney eine Unterlassungsaufforderung an Google, da dort angeblich unerlaubt Disney-Inhalte in großem Umfang generiert worden seien.

Warum das wichtig ist: Disney CEO Bob Iger hatte bereits im vergangenen Monat angekündigt, dass KI eine zentrale Rolle für Disney+ spielen werde. Der nun geschlossene Deal geht allerdings weit über die Erwartungen hinaus. Für OpenAI entsteht ein strategischer Vorteil, weil das Unternehmen als einziges führendes KI-Modell legal auf weltweit bekannte Marken zugreifen darf. Gleichzeitig verschärft Disney damit den Ton gegenüber konkurrierenden Generatoren, um diesen Vorteil konsequent zu verteidigen.

- 02 -

🎧 Google bringt Echtzeit-Audioübersetzung

Bildquelle: Google

Google hat eine Reihe neuer Gemini-gestützter Übersetzungsfunktionen vorgestellt. Kern ist ein Beta-Feature, das gesprochene Sprache in Echtzeit an beliebige verbundene Kopfhörer überträgt. Bislang war diese Funktion ausschließlich den Pixel Buds vorbehalten.

Die Details:

  • Das neue Gemini-2.5-Flash-Native-Audio-Modell verbessert die Leistungsfähigkeit für stimmgesteuerte Agenten.

  • Die Integration in Google Übersetzer funktioniert mit jedem beliebigen Earbud auf Android und unterstützt mehr als 70 Sprachen, während Tonfall, Sprechtempo und Rhythmus der Sprecherin beziehungsweise des Sprechers möglichst präzise erhalten bleiben.

  • Das Weltwissen von 2.5 Flash Native Audio erleichtert ein differenziertes Verständnis von Slang oder kulturell geprägten Formulierungen, was zu deutlich nuancierteren Übersetzungen führt.

  • Google erweitert außerdem seinen Duolingo-ähnlichen Übungsmodus auf 20 weitere Länder, ergänzt um neue Funktionen wie Streak-Tracking und Feedback zur Aussprache.

Warum das wichtig ist: Die Sci-Fi-Vorstellung des universellen Übersetzers rückt spürbar näher. Mit Googles Update werden Gespräche über Sprachgrenzen hinweg so mühelos wie nie zuvor. Da künftig auch Plattformen wie YouTube oder soziale Netzwerke auf diese Technik setzen dürften, könnten Sprachbarrieren im KI-Zeitalter weitgehend verschwinden.

- 03 -

🚀 OpenAI kontert Googles Nano Banana Pro mit neuem Bild-Generator

Bildquelle: OpenAI

OpenAI hat GPT Image 1.5 vorgestellt, ein großes Update des ChatGPT-Bildgenerators. Das Modell erzeugt Grafiken bis zu viermal schneller, rendert Text deutlich sauberer und hält Motive über mehrere Bearbeitungen hinweg konsistent. Der Schritt gilt als direkte Antwort auf Googles jüngste Fortschritte mit Nano Banana Pro.

Die Details:

  • Image 1.5 steigert die Generierungsgeschwindigkeit spürbar und kann Gesichter, Beleuchtung und Bildkomposition bei Anpassungen zuverlässig beibehalten.