In letzter Zeit haben wir den Eindruck, dass verschiedene Technologieunternehmen damit prahlen wollen, wie unkontrollierbar die von ihnen entwickelten Sprachmodelle und Agenten sind. Bei OpenAI gab es kürzlich einen sehr schwerwiegenden Sicherheitsvorfall, den das Unternehmen fast schon werbungsartig präsentiert hat; kurz darauf berichtete auch Anthropic von einem außer Kontrolle geratenen Agenten, und nun ist dieses Thema auch bei Meta aktuell.
Genau wie Anthropic hat auch Meta eine interne Untersuchung angeordnet, nachdem bei Wettbewerbern „unzulässige“ Aktivitäten durch die -Tools für künstliche Intelligenz durchgeführt worden waren. So kam ans Licht, dass das Sprachmodell des Unternehmens zuvor ein anderes Unternehmen gehackt und interne Änderungen am kompromittierten System vorgenommen hatte.
Nach Angaben von Meta ist bei ihnen im Großen und Ganzen dasselbe passiert wie bei Anthropic. „Das Modell nutzte eine Sicherheitslücke in einem von einem Drittanbieter bereitgestellten Dienst aus, ähnlich wie in zuvor bei anderen Unternehmen gemeldeten Fällen“, heißt es in der Mitteilung des Unternehmens.
Irregular – ein unabhängiger Marktteilnehmer, der Cybersicherheitsbewertungen für Meta (und andere Entwickler) durchführt – hatte aufgrund eines Konfigurationsfehlers sein Netzwerk versehentlich nicht ausreichend eingeschränkt und dem Agenten so die Möglichkeit gegeben, auf das Internet zuzugreifen. Dies nutzten die im Rahmen ihrer Aufgabe eingesetzten Sprachmodelle aus, um während des Arbeitsablaufs aus der Testumgebung „auszubrechen“.
Nach den uns vorliegenden Informationen verwendete der von Meta betriebene Agent die Muse Spark 1.1-Modelle, die bei dem Unternehmen bereits nicht mehr die aktuellste Version sind, da gerade Muse Spark 1.2 eingeführt wurde. Es ist nicht eindeutig geklärt, wann genau sich dieser Vorfall ereignet haben könnte. Dem Bericht zufolge drang der Bot in das System eines nicht namentlich genannten Unternehmens ein und veränderte dessen interne Umgebung, obwohl er keine Daten gestohlen hat. Meta betonte, dass es sich nicht um einen wirklich ausgeklügelten Cyberangriff handelte und der Vorfall auch nicht durch die Ausnutzung einer in einer Sandbox entdeckten Zero-Day-Schwachstelle zustande kam.
„Derzeit laufen keine Ermittlungen. Das Unternehmen erstellt einen detaillierten Bericht, in dem bewährte Verfahren zur Isolierung und sicheren Durchführung von Cybersicherheitstests dargelegt werden“, teilte Irregular mit.
Dieser Vorfall verstärkt die Bedenken hinsichtlich Sprachmodellen, KI-Tools und KI-Agenten weiter. Weltweit drängen immer mehr Regierungen, Organisationen und prominente Experten auf die Ausarbeitung strengerer Sicherheitsrahmen. Man sollte das Tempo drosseln, damit die Risikobewertung an erster Stelle steht.
Gleichzeitig lässt sich beispielsweise seitens der USA immer wieder eine zweigleisige Kommunikation beobachten. Es wird immer häufiger davon gesprochen, dass eine strengere und eindeutigere Regulierung notwendig sei, doch es geschieht nichts, da man sich sehr wohl bewusst ist, dass dies die Entwicklung verlangsamen und behindern würde. Und wenn sie so vorgehen würden, würden sie im derzeit immer bedeutender werdenden Wettbewerb zwischen den USA und China China in die Hände spielen. In Europa gelten die strengsten und umfassendsten KI-Vorschriften, und wir sehen auch, dass wir viele Entwicklungen erst mit einer Verzögerung von mehreren Monaten erhalten – wenn wir überhaupt alle Funktionen bekommen.