🙂 Anthropic zeigt KI hat interne „Emotionen“

PLUS: 4 weitere Stories, wöchentliche Shorts & Tipps sowie KI-Ranking

Guten Abend 🌙

Eine Woche ist vergangen, und KI WEEKLY+ hält Dich auf dem neuesten Stand der KI-Welt.

Wir wünschen Dir ein ruhiges, sonniges Osterwochenende und ein paar entspannte Minuten abseits des Alltags. 🐣

KI-Tools der Woche

  1. 🧪 MAI-Transcribe-1 - Microsofts neues Sprach-zu-Text-Modell für 25 Sprachen

  2. 🗣️ Cohere Transcribe - Open-Source-Modell zur Spracherkennung

  3. 💬 Wispr Flow - Sprach-zu-Text-KI, die gesprochene Sprache appübergreifend in klaren Text verwandelt

  4. 🎨 Fauna - Kreativ-Agent, der Modell-Routing und Prompts automatisch übernimmt.

  5. 😎 Krea Realtime - Kreas System zur Echtzeit-Erstellung langer KI-Videos

01

Wikipedia verbietet KI-geschriebene Artikel

Bildquelle: Wikipedia

Wikipedia hat seinen freiwilligen Editoren untersagt, Artikel auf der englischsprachigen Wikipedia-Plattform mithilfe von KI zu verfassen. Ein Schritt, den der Autor der Richtlinie als bewusste Gegenbewegung zum zunehmenden Qualitätsverlust und zur aggressiven Verbreitung von KI beschreibt.

Die Details:

  • Frühere Versuche, umfassende Regeln für den Einsatz von KI festzulegen, scheiterten am fehlenden Konsens, doch eine wachsende Zahl fehlerhafter KI-Inhalte führte schließlich zu einer nahezu einstimmigen Abstimmung von 40 zu 2 Stimmen.

  • Das Verbot umfasst sowohl das Schreiben als auch das Umschreiben von Artikeln mit sogenannten Large Language Models, während KI weiterhin für Grammatik-Korrekturen und Übersetzungen genutzt werden darf, sofern eine menschliche Prüfung erfolgt.

  • Der Autor der Richtlinie sieht darin das Potenzial, eine breitere Bewegung auszulösen und Communities auf anderen Plattformen zu ermutigen, eigene Regeln für den KI-Einsatz festzulegen.

  • Auch Plattformen wie Stack Overflow und die deutschsprachige Wikipedia haben ähnliche Einschränkungen eingeführt, während die spanische Wikipedia noch weiter geht und den Einsatz von KI sogar für Bearbeitungen vollständig untersagt.

Warum das wichtig ist: Im Jahr 2025 hat KI erstmals mehr Text produziert als Menschen. An diesem Punkt zieht Wikipedia eine Grenze. Während andere Projekte wie „Grokipedia“, die Wikipedia-Alternative von Elon Musk, vollständig auf KI setzen, hält Wikipedia am Prinzip der menschlichen Kontrolle fest. Dies ist keine technikfeindliche Haltung, sondern eine strategische Entscheidung zur Qualitätssicherung. Eine Frage bleibt jedoch offen: Wie lange kann sich dieser Ansatz gegen den wachsenden Druck automatisierter Inhalte behaupten?

02

Anthropic leakt Details zu neuem Top-Modell „Mythos“

Bildquelle: @M1Astra auf X

Details zu Anthropics nächstem Flaggschiff-Modell Claude Mythos sind diese Woche aufgetaucht, nachdem durch eine fehlerhafte CMS-Konfiguration interne Launch-Materialien öffentlich zugänglich waren. Ein geleakter Blogpost beschreibt das System als „deutlichen Fortschritt“ und bislang leistungsstärkstes Modell des Unternehmens.

Die Details:

  • Ein Konfigurationsfehler im Content-Management-System machte tausende unveröffentlichte Inhalte, darunter einen Entwurf für den offiziellen Launch-Beitrag, in einem öffentlich zugänglichen Datenspeicher sichtbar.

  • Der Entwurf ordnet Mythos einer neuen „Capybara“-Kategorie zu, die oberhalb der bisherigen Opus-Klasse liegen und sowohl leistungsfähiger als auch teurer im Betrieb sein soll.

  • Anthropic beschreibt das Modell intern als „deutlich führend gegenüber allen anderen KI-Systemen im Bereich Cyberfähigkeiten“ und warnt zugleich, dass es Angreifern dabei helfen könnte, bestehende Sicherheitsmechanismen zu umgehen.

  • Gegenüber Fortune bestätigte das Unternehmen, dass ein neues universelles Modell mit spürbaren Fortschritten in den Bereichen Schlussfolgern, Programmieren und Cybersicherheit derzeit getestet wird.

  • Nur wenige Tage später wurde der Quellcode des KI-Tools Claude Code öffentlich sichtbar, wodurch über 1.900 Dateien, mehr als 500.000 Codezeilen sowie unveröffentlichte Funktionen zugänglich wurden.

  • In diesem Leak fanden Entwickler Hinweise auf neue Features wie persistente, sitzungsübergreifende Speicherfunktionen und ein komplexes Planungssystem („Dream”) und auch den internen Codenamen „Capybara“.

Warum das wichtig ist: Für ein Unternehmen, das sich stark über Sicherheitsstandards definiert, wirken zwei größere Leaks innerhalb weniger Tage zumindest widersprüchlich. Gleichzeitig entsteht der Eindruck, dass solche Vorfälle Aufmerksamkeit erzeugen und Narrative rund um neue Modellgenerationen verstärken. Inhaltlich deutet vieles darauf hin, dass die nächste Leistungsstufe die bisherigen Systeme wie Opus deutlich übertrifft. Es wird entscheidend sein, ob die Sicherheitsmechanismen mit diesem Fortschritt Schritt halten können.

03

Stanford-Studie belegt: KI gibt dir zu oft recht

Bildquelle: Stanford University

Forscher der Stanford University haben in einer neuen Studie gezeigt, dass KI-Chatbots in persönlichen Konflikten systematisch die Seite der Nutzer einnehmen, selbst wenn diese objektiv im Unrecht sind, und dabei sogar problematisches oder illegales Verhalten unterstützen können.

Die Details:

  • Die Forscher testeten elf Large Language Models anhand von rund 2.000 Reddit-Beiträgen, bei denen sich die Community weitgehend einig war, dass der Verfasser falsch lag, dennoch stellten sich die Chatbots in mehr als der Hälfte der Fälle auf die Seite des Nutzers.