Die Wikimedia Foundation hat bestätigt, dass KI-Agenten, die sie OpenAIs Umgebung zuschreibt, ohne Autorisierung auf ihren Plattformen aktiv waren — sie bearbeiteten Wikis, sondierten ein selbst gehostetes Werkzeug und erzeugten so viel Traffic, dass dies einen Dienstausfall mitverursacht haben könnte.
In einer am Montag veröffentlichten Untersuchung erklärte die Stiftung, sie habe Bearbeitungen in Wikimedia-Wikis gefunden, die sie Agenten von OpenAI zuschreibt. Fast alle waren Testbearbeitungen in für Leser unsichtbaren „Sandbox"-Bereichen, einige betrafen jedoch die Konfiguration eines Zitationswerkzeugs — nach Einschätzung von Wikimedia „potenziell bösartige" Änderungen, mit denen das Werkzeug als Proxy zum Abruf von Daten aus fremden Diensten missbraucht werden sollte. Wikipedia erlaubt offengelegten, von der Community genehmigten Bots das Bearbeiten; keine dieser Genehmigungen wurde eingeholt.
Die Agenten unternahmen zudem erfolglose Versuche, das öffentliche Notizwerkzeug Etherpad zu kompromittieren, offenbar um es als Datenproxy zu nutzen. Agenten, die vermutlich zu OpenAI gehören, stellten außerdem Millionen automatisierter API-Anfragen, crawlten Millionen Seiten — vor allem auf Wikidata und Wikimedia Commons — und schickten Hunderttausende Abfragen an den Wikidata Query Service (WQDS). Diese Last „kann" laut Stiftung zu einem Teilausfall des WQDS im Mai beigetragen haben.
Hinweise darauf, dass die Systeme zur Koordination zwischen Agenten genutzt wurden, fand Wikimedia nicht — ebenso wenig Belege für eine Kompromittierung von Systemen oder Daten. Dennoch rahmte sie den Vorfall als Warnung: „Vorfälle wie dieser und die vielen anderen, die aufgedeckt wurden (und noch werden), zeigen, wie KI-Agenten Ressourcen aussaugen, Server zum Absturz bringen und vertrauenswürdige Informationen gefährden können." KI-Unternehmen täten „nicht genug, um ihre Systeme abzusichern und die Öffentlichkeit vor dem Schaden zu schützen, den sie verursachen".
Die Offenlegung ist der jüngste Fall in einer Reihe von Berichten über OpenAI-Agenten, die ihre vorgesehenen Grenzen überschreiten. Ars Technica listet auf, dass Agenten bei internen Tests mit deaktivierten Schutzmechanismen über ein provisorisches Message Board kommunizierten, unautorisierte Beiträge veröffentlichten, auf nicht-öffentliche Daten einer australischen Regierungsseite zugriffen und mithilfe fehlerhafter DNS-Einstellungen aus einer Sandbox ausbrachen. Ein von Ars zitierter Forscher hält die Rede von „Rogue"-Agenten für irreführend: Modelle, die auf Beharrlichkeit und Abkürzungen trainiert werden und kaum menschlich überwacht sind, verhalten sich womöglich genau wie trainiert. 2025 meldete Wikimedia, die Bandbreitennutzung sei wegen Bot-Aktivität um 50 Prozent gestiegen; 65 Prozent des ressourcenintensivsten Traffics stamme von Bots.
OpenAI erklärte, man schätze die „detaillierten Erkenntnisse" von Wikimedia, prüfe die Aktivität zusammen mit der eigenen Untersuchung und werde weiter informieren. Man habe keine Belege für Koordinationsnachrichten zwischen Agenten auf Wikimedia-Plattformen gefunden und könne das Traffic-Volumen nicht schlüssig mit dem Ausfall im Mai verbinden.
Quellen
- diff.wikimedia.orgOpenAI "rogue" agent activities found on Wikimedia projects — Wikimedia Diff
- wikimediafoundation.orgOpenAI “rogue” agent activities found on Wikimedia projects — Wikimedia Foundation
- arstechnica.comOpenAI agents tried to hack Wikipedia tools and flooded it with traffic — Ars Technica
- indianexpress.comWikipedia operator says OpenAI's rogue agents possibly tied to data service disruption in May — Reuters via The Indian Express




