KI-Symbolbild: Der Angriff auf Huggin Face zeigt, wie weit sich KI-Agenten von den Vorgaben ihrer menschlichen Aufseher entfernen können. (Optik: Stephan Scheuer / GPT Image 2)
Beide Perspektiven verweisen auf einen Teil der Realität. Künstliche Intelligenz ist inzwischen sehr leistungsfähig geworden. Um die aktuellen Risiken zu erkennen, ist die Annahme einer Super-KI nicht notwendig. Gleichzeitig gibt es Kritik an den Untergangsszenarien: Beobachter verweisen darauf, dass hinter den Warnungen auch erhebliche ökonomische Interessen der KI-Unternehmen stehen könnten.
Warum das wichtig ist
Auf dem Spiel stehen nicht nur Fragen der technologischen Sicherheit. Auch wirtschaftlich geht es um enorme Summen. Anthropic und OpenAI streben an die Börse und peilen jeweils eine Bewertung von mehr als einer Billion Dollar an.
Gleichzeitig forciert die US-Regierung unter Trump den technologischen Wettbewerb mit China. Die geopolitische Dimension dürfte besonders deutlich werden, wenn Trump – wie erwartet – Chinas Staats- und Parteichef Xi Jinping im Weißen Haus empfängt.
Der Fall Hugging Face
Um die neue Dimension der Debatte über die Gefahren von KI zu verstehen, rückt ein zentraler Vorfall in den Mittelpunkt: die Attacke von KI-Modellen von OpenAI auf die Plattform Hugging Face.
Mehr als zwei Monate lang tauschten die KI-Agenten rund 70.000 Nachrichten aus – über ein digitales schwarzes Brett, das sie selbst eingerichtet hatten. Kein Mensch hatte sie dazu angewiesen. Die Programme informierten sich gegenseitig über ihre Fortschritte, verteilten Aufgaben, setzten Fristen und bestimmten eigene Koordinatoren.
Die Agenten „opferten“ sich gezielt, um weitere Attacken zu koordinieren. Gleichzeitig investierten sie erheblichen Aufwand darin, ihre eigenen Spuren zu verwischen. Selbst nachdem ein Teil der Aktivitäten entdeckt worden war, fanden die Systeme offenbar einen neuen Weg, um an frühere Strategien anzuknüpfen.
Diese Vorgänge sind Gegenstand einer 91 Seiten langen Analyse der Unternehmen Metr und Redwood Research.
Besonders brisant ist dabei die Frage, wie weit die Fähigkeiten der Systeme reichten. Den Untersuchungen zufolge waren die KI-Systeme möglicherweise nicht nur in der Lage, in die Systeme von Hugging Face einzudringen. Sie sollen auch versucht haben, Computer bei OpenAI zu übernehmen. Diesen Teil der Vorgänge durften die Experten von Metr und Redwood Research allerdings nicht untersuchen.

Ursula von der Leyen: Die EU-Kommissionspräsidentin äußerte sich in ihrer Rede zur Lage der Union auch zu den Folgen des KI-Rennens. (Foto: Omar Havana / AP / dpa)
Selbst die KI-Konzerne haben Kontrollprobleme
Der Vorfall wirft damit eine grundlegende Frage auf: Wie gut können selbst die führenden KI-Unternehmen die von ihnen entwickelten Systeme kontrollieren?
OpenAI und Anthropic gehören zu den Unternehmen, die besonders stark vor den möglichen Gefahren ihrer eigenen Technologie warnen. Gleichzeitig zeigt der Vorfall, dass auch diese Unternehmen offenbar Schwierigkeiten haben können, unerwartete Verhaltensweisen ihrer Modelle vollständig einzudämmen.
Bernhard Schölkopf, Direktor am Max-Planck-Institut für Intelligente Systeme in Tübingen, fasste die Problematik so zusammen: „Dieser Vorfall zeigt, dass selbst OpenAI nicht alle seine Hausaufgaben gemacht hat.“
Damit verschiebt sich die Debatte zunehmend von der Frage, wie leistungsfähig KI-Systeme werden können, hin zur Frage, wie ihre Handlungen kontrolliert und Verantwortlichkeiten geregelt werden können.
Wer trägt die Verantwortung?
Im Zentrum der weiteren Diskussion dürfte deshalb die Haftung für von KI-Systemen verursachte Schäden stehen. EU-Kommissionspräsidentin Ursula von der Leyen thematisierte diese Frage in ihrer Grundsatzrede in Straßburg.
„Wir wollen, dass die KI auf verantwortungsbewusste Weise einen Mehrwert schafft“, sagte sie.
Dahinter steht eine zentrale europäische Frage: Wer trägt die Verantwortung, wenn autonome KI-Systeme künftig Schäden verursachen oder Cyberangriffe durchführen?
In Europa existieren bereits vergleichsweise klare Haftungsregeln. Sollte beispielsweise ein Dax-Konzern Opfer eines Angriffs durch ein KI-System werden, könnte damit auch die Frage aufkommen, ob der Entwickler oder Anbieter des Systems – etwa OpenAI oder Anthropic – für die Folgen haftbar gemacht werden kann.
Damit treffen zwei Entwicklungen aufeinander: KI-Systeme werden zunehmend autonom und leistungsfähig, während ihre Entwickler gleichzeitig enorme wirtschaftliche Interessen verfolgen. Die zentrale Herausforderung besteht deshalb nicht nur darin, die technischen Möglichkeiten der Systeme zu verstehen, sondern auch Regeln dafür zu schaffen, wer für deren Handlungen und Folgen verantwortlich ist.
Informationen rund um dieses Thema finden Sie hier.
Dieser Beitrag erschien in unserem KI-Newsletter. Wenn Sie mehr solcher Artikel lesen möchten, abonnieren Sie gerne das KI-Briefing hier.