// STADT-BREMERHAVEN — INTELLIGENZA ARTIFICIALE
Wikimedia: Ungebetener Besuch von OpenAI-Agenten
von Carsten Knobloch
6. Okt. 2026 |
0
Dass KI-Crawler durchs Netz pflügen und alles abgreifen, was nicht bei drei auf den Bäumen ist, dürfte mittlerweile jedem klar sein. Bei der Wikimedia Foundation schaut man sich das Ganze allerdings gerade etwas genauer an. Nach entsprechenden Berichten anderer Plattformen hat die Stiftung eigene Logs durchforstet und festgestellt, dass sich autonome Agenten aus dem OpenAI-Umfeld auf den Wikimedia-Plattformen herumgetrieben haben.
Wikipedia hat eigentlich klare Spielregeln für Bots, die von der Community abgesegnet werden müssen. Daran hat sich bei den Vorfällen natürlich niemand gehalten. Was ist also passiert?
* Bearbeitungen in Wikis: Die Agenten haben Änderungen an Seiten vorgenommen. Das landete glücklicherweise fast ausschließlich in Sandbox-Bereichen, also Spielwiesen für Tests, sodass normale Leser davon nichts mitbekommen haben. Weniger witzig: Es gab Versuche, die Konfiguration eines Zitier-Tools so zu manipulieren, dass es als Proxy für externe Datenabfragen dient.
* Notiz-Tool Etherpad: Auch das öffentlich bereitgestellte Etherpad geriet ins Visier. Die Bots versuchten erfolglos, das Tool als Proxy zu missbrauchen. Einige Agenten nutzten die Pads schlichtweg, um Notizen über ihre Tasks abzulegen.
* Ordentlich Last auf den Servern: Über die Schnittstellen liefen Millionen automatisierte Anfragen ein. Vor allem Wikidata und Wikimedia Commons wurden massiv gecrawlt, dazu kamen Hunderttausende Abfragen an den Wikidata Query Service. Laut Wikimedia dürfte dieser Traffic im Mai sogar für Teilausfälle gesorgt haben.
Dass Wikipedia eine der wichtigsten Trainingsquellen für Sprachmodelle ist, weiß man. Wenn solche Agenten aber anfangen, Systeme vollzuballern und Sicherheitslücken abzuklopfen, hört der Spaß für die meist ehrenamtlichen Helfer eben auf. Die Stiftung meldete schon für 2025 ein Bandbreiten-Plus von 50 Prozent, das rein auf Bots zurückging. Zeitweise stammten 65 Prozent des extrem ressourcenhungrigen Datenverkehrs von automatisierten Abfragen.
Das kostet am Ende schlicht echtes Geld für Server und Infrastruktur. Wikimedia nimmt daher vor allem OpenAI und Co. in die Pflicht: Wer solche Agenten ins Netz entlässt, muss dafür sorgen, dass die Dinger kontrollierbar bleiben und Webseiten-Betreibern Werkzeuge an die Hand geben, um diesen Wildwuchs zu bändigen.
Hinweis: Dieser Artikel enthält Affiliate-Links. Kauft ihr darüber ein, erhalten wir eine kleine Provision - ohne Aufpreis für euch und ohne Einfluss auf unsere redaktionelle Meinung.