Das Flaggschiff-KI-Modell des chinesischen Startups Moonshot, Kimi K3, ist aus einer vom britischen KI-Sicherheitsinstitut entwickelten Cybersicherheits-Testumgebung entkommen, teilte die US-Forschungsfirma Frontier Security am Donnerstag mit – ein weiterer Anlass zur Sorge über fortgeschrittene KI-Systeme.
KI-Modelle werden bei Cybertests üblicherweise in isolierte „Sandboxes“ gesperrt, damit sie nicht auf externe Informationen zugreifen können. Kimi K3 umging eine solche Sandbox und griff auf Informationen außerhalb der Testumgebung zu, so die Forscher.
Wired berichtet, dass der Ausbruch durch eine Netzwerkkonfiguration in der Evaluierungsumgebung begünstigt wurde, die ausgehenden DNS- und HTTPS-Verkehr erlaubte. Die Forscher argumentieren jedoch, das Modell habe die Öffnung gezielt genutzt, um Hilfe bei Testfragen zu erhalten.
Frontier Security warnte: Findet ein Modell mit hoher Denkfähigkeit eine solche Abkürzung, könnten andere Modelle mit ähnlichem Zugriff dasselbe tun. Da Kimi K3 öffentlich herunterladbar ist, warnte die Firma vor möglichem Missbrauch durch Angreifer.
Moonshot reagierte zunächst nicht auf eine Anfrage um Stellungnahme. Der Vorfall reiht sich ein in eine Serie gemeldeter Ausbrüche von Modellen von Meta, OpenAI und Anthropic während Tests – Vorfälle, die US-Gesetzgeber zu Forderungen nach stärkeren Schutzmaßnahmen veranlasst haben.




