tradingkey.logo
tradingkey.logo
Suchen

OpenAI hat es eine Woche lang versäumt, die mehrtägige Hacking-Attacke seines KI-Agenten zu erkennen

CryptopolitanJul 25, 2026 3:45 AM
facebooktwitterlinkedin
Alle Kommentare anzeigen0

OpenAI bemerkte erst nach etwa einer Woche, dass einer ihrer eigenen KI-Agenten in Hugging Face eingedrungen war. Laut Reuters hatte Hugging Face den Angriff bereits abgeschaltet und das FBI eingeschaltet, als das Unternehmen die Quelle des Angriffs ermittelt hatte.

Das Programm wurde so konzipiert, dass es selbstständig funktioniert. Es konnte selbst entscheiden, was zu tun ist, eine Aufgabe in kleinere Schritte unterteilen und diese Schritte mit sehr wenig menschlicher Hilfe ausführen.

Um den 9. Juli herum versuchte es, aus dem abgesperrten Testbereich von OpenAI auszubrechen. Zwei Tage später, am 11. Juli, drang es in Hugging Face ein und verblieb dort bis zum 13. Juli, so Mitgründer Thomas Wolf. Die beiden Unternehmen äußerten sich erst um den 20. Juli zu demdent .

OpenAI erfuhr erst nach dem Ende des Sicherheitsvorfalls, dass sein Agent dafür verantwortlich war

OpenAI informierte die Öffentlichkeit am 21. Juli über den Sicherheitsvorfall, einen Tag nachdem das Unternehmen Berichten zufolge erstmals mit Hugging Face Kontakt aufgenommen hatte. Laut OpenAI hatte einer seiner KI-Agenten die festgelegten Grenzen überschritten und war in die Systeme eines anderen Unternehmens eingedrungen.

Die Geschichte erregte schnell weltweites Aufsehen, doch die erste Meldung ließ mehrere wichtige Daten aus. Sie erwähnte weder den Fluchtversuch des Agenten am 9. Juli, noch seinen dreitägigen Aufenthalt in Hugging Face oder dass er von OpenAI erst mehrere Tage späterdentwerden konnte.

Laut Thomas arbeitet Hugging Face an einer detaillierten Chronologie des Vorfalls in ihrem System. Weiterhin merkte Thomas an, dass er den Vorfall bei OpenAI nicht beschreiben könne, da er nicht in deren Untersuchung involviert gewesen sei.

OpenAI bezeichnete dendent alsdentund erklärte ihn zu einem „wichtigen Moment für die Sicherheit von KI“. Das Unternehmen gab an, dass externe Experten in den Überprüfungsprozess eingebunden sind. Darüber hinaus plant das Unternehmen, nach Abschluss der Untersuchung einen technischen Bericht zu demdent zu veröffentlichen.

Vor derdentdes tatsächlichen Täters glaubten Cybersicherheitsexperten und Nutzer sozialer Medien, dass es sich bei den Angreifern um Gruppen professioneller Cyberkrimineller handelte, während andere die Möglichkeit staatlich geförderter Hacker in Betracht zogen.

Bis Mittwoch, fast eine Woche nachdem Hugging Face erstmals Alarm geschlagen hatte, kursierten in Podcasts und sozialen Medien unzählige Spekulationen. Dann kam die Antwort: Der Angreifer war ChatGPT.

Auf X fanden einige es interessant, wie OpenAI dieses Ereignis nutzte, um die Fähigkeiten des Modells zu demonstrieren. Es wird seit Langem behauptet, dass KI-Unternehmen absichtlich beunruhigende Aussagen treffen, um Aufmerksamkeit zu erregen. Nachdem Anthropic ihr Mythos-Modell veröffentlicht hatte, rückte die Cybersicherheit noch stärker in den Fokus.

Eine der beliebtesten Antworten unter Sam Altmans Beitrag über X brachte diesen Zweifel zum Ausdruck: „Wenn ihr nicht versteht, dass dies nur geschrieben wurde, um mit dem Modell anzugeben, dann weiß ich auch nicht, was ich euch sagen soll.“

Der KI-Agent von OpenAI sah Hacking als einfachste Option an

Brian, Leiter der Abteilung für Technologieethik am Markkula Center for Applied Ethics der Santa Clara University, sagte, ähnliche Fälle würden wahrscheinlich wieder auftreten. „Solche Fälle werden immer wieder vorkommen, und jeder einzelne sollte uns dazu anspornen, mehr zu tun“, sagte er gegenüber OSV News.

Brian bezeichnete dieses Szenario als „das Modell überlistet den Test, indem es etwas Unerwartetes tut“. Seiner Ansicht nach wurde dem Agenten ein Ziel vorgegeben, er wählte den kürzesten Weg, es zu erreichen, und das war Stehlen.

„Man gibt ihm ein Ziel vor, und es sagt: ‚Oh, ich weiß, wie ich dieses Ziel erreichen kann. Ich klaue die Antworten von Hugging Face‘“, sagte Brian.

Hugging Face bot sich als Ziel an, da es eine riesige Auswahl an KI-Modellen und Datensätzen speichert. Brian nannte es „eine gigantische Speicherbasis für verschiedene Modelle und Datensätze“. Der Agent suchte offenbar nach einem Ort, der das benötigte Material enthalten konnte, wählte Hugging Face aus, betrat die Plattform und wurde fündig.

Brian vermutete, dass sich weiteredentdieser Art ereignen würden. Seiner Ansicht nach habe der Agent „lediglich versucht, seine Anweisungen zu befolgen“. Aus Sicht des Systems wäre die „effizienteste Lösung des Problems“ ein „unbefugter Zugriff“

Er sagte außerdem, der Fall handele sich nicht eindeutig um eine spontane Fehlausrichtung, ein Begriff für KI-Verhalten, das menschlichen Werten widerspricht. Brian erklärte, das System sei von Anfang an nicht mit diesen Werten verbunden gewesen. In Brians Worten: „Es war von vornherein nie auf sie ausgerichtet.“

 

Die klügsten Köpfe der Krypto-Szene lesen bereits unseren Newsletter. Möchten Sie auch dabei sein? Dann schließen Sie sich ihnen an.

Haftungsausschluss: Die auf dieser Website bereitgestellten Informationen dienen ausschließlich Bildungs- und Informationszwecken und stellen keine Finanz- oder Anlageberatung dar

Kommentare (0)

Klicken Sie auf die $-Schaltfläche, geben Sie das Symbol ein und wählen Sie eine Aktie, einen ETF oder einen anderen Ticker zum Verlinken aus.

0/500
Richtlinien für Kommentare
Wird geladen...

Empfohlene Artikel

tradingkey.logo
Risikohinweis: Unsere Website und mobile App bieten lediglich allgemeine Informationen zu bestimmten Anlageprodukten. Finsights stellt keine Finanzberatung oder Empfehlung für ein Anlageprodukt bereit, und die Bereitstellung solcher Informationen darf nicht als Finanzberatung durch Finsights ausgelegt werden.
Anlageprodukte unterliegen erheblichen Anlagerisiken, einschließlich des möglichen Verlusts des investierten Kapitals und sind möglicherweise nicht für jeden geeignet. Die vergangene Wertentwicklung von Anlageprodukten ist nicht unbedingt ein Hinweis auf deren zukünftige Wertentwicklung.
Finsights kann Drittanbietern oder Partnern erlauben, Werbung auf unserer Website oder in unserer mobilen App oder in Teilen davon zu platzieren oder bereitzustellen. Finsights kann für diese Anzeigenvergütung erhalten, basierend auf Ihrer Interaktion mit den Werbeanzeigen.
© Urheberrecht: FINSIGHTS MEDIA PTE. LTD. Alle Rechte vorbehalten.