Kategorien

DIE ENTWICKLUNGEN BEI OPENAI VERZÖGERN SICH AUFGRUND ZAHLREICHER CYBERSICHERHEITSPROBLEME

Das Unternehmen hat sein derzeit leistungsstärkstes Modell, das sich noch in der Trainingsphase befindet, eingestellt und verschiebt zudem die Einführung von GPT-6.1 Astra.
DemonDani
DemonDani
Die Entwicklungen bei OpenAI verzögern sich aufgrund zahlreicher Cybersicherheitsprobleme

Im Umfeld von OpenAI gibt es immer mehr beunruhigende Anzeichen dafür, dass das Unternehmen ganz einfach keine Kontrolle mehr über seine Entwicklungen hat. In den letzten Tagen und Wochen gab es eine ganze Reihe von Berichten über KI-Operationen, die unter dem Gesichtspunkt der Cybersicherheit als regelwidrig eingestuft wurden. Aus diesem Grund ist das Unternehmen nun nicht nur auf der Kommunikationsebene, sondern auch tatsächlich gezwungen, das Tempo zu drosseln.

OpenAI gab bekannt, dass es das Training seiner leistungsstärksten KI-Modelle aussetzt, und das „Wall Street Journal“ berichtete, dass das Unternehmen auch die Einführung des Modells GPT-6.1 Astra verschiebt.

Eine der größten Errungenschaften von OpenAI in letzter Zeit war die Einführung des GPT-6-Astra-Modells. Mit diesem Modell hat das Unternehmen laut verschiedenen Leistungstests weitgehend zu Anthropic an die Spitze aufgeholt, und die Modelle Fable und Mythos haben einen würdigen Rivalen bekommen. Das Unternehmen möchte aus der aktuellen Situation Kapital schlagen, doch so wie die Dinge stehen, sollte es vielleicht lieber darüber nachdenken, wie es seine Entwicklungen sicher vorantreiben kann.

OpenAI testet kontinuierlich seine verschiedenen Tools, und je mehr es versucht, das Tempo zu steigern, desto lauter werden die kritischen Stimmen aufgrund von Bedenken hinsichtlich der Cybersicherheit. Seit dem Hugging-Face-Skandal ist klar geworden, dass die vom Unternehmen betriebenen Sprachmodelle und KI-Agenten keine Unterschiede machen. Die Tools haben nicht nur andere Unternehmen und Websites, sondern auch Regierungsseiten und Sicherheitsbehörden mit verschiedenen Methoden angegriffen. Deshalb musste das Unternehmen nun beschließen, mehrere seiner Entwicklungsprojekte auszusetzen bzw. zu verschieben.

Galerie öffnen

Besonders besorgniserregend ist, dass OpenAI selbst nur sehr langsam Fälle aufdeckt, in denen die Ausführung einer Aufgabe durch eine der künstlichen Intelligenzen fehlschlägt. Die Benachrichtigung der Opfer verzögert sich in manchen Fällen um bis zu Monate. Es steht bereits fest, dass sich das Unternehmen nicht wirklich mit den fehlgeschlagenen Angriffen befasst und einem gescheiterten Angriff durch KI-Agenten keine große Bedeutung beimisst. Dies ist wahrscheinlich darauf zurückzuführen, dass es so viele solcher Fälle gibt, dass das Unternehmen nicht über die Kapazitäten verfügt, ihnen die nötige Aufmerksamkeit zu widmen. 

Zuletzt nutzte eines der fortschrittlichen Modelle des Unternehmens während eines internen Tests eine Sicherheitslücke in einem DNS-Filter aus, stellte aus der geschlossenen Umgebung eine Verbindung zu einem externen Chatbot her und versuchte auf diese Weise, Informationen zur Lösung einer Aufgabe zu erhalten. Das Überwachungssystem löste innerhalb von 15 Minuten einen Alarm aus, der drei Minuten später von einem Mitarbeiter bestätigt wurde. Die automatische Abschaltung erfolgte jedoch aus irgendeinem Grund nicht, sodass der Vorgang weitere zweieinhalb Stunden andauerte, bis der Agent manuell deaktiviert wurde.

Nach Angaben des Unternehmens erstreckt sich die Aussetzung auf das Training, die Bewertung sowie den Einsatz der Modelle mithilfe von Tools. Die Arbeit wird grundsätzlich erst dann fortgesetzt, wenn die Experten von OpenAI die Korrekturen abgeschlossen und neue Sicherheitssysteme integriert haben. Zusammen mit weiteren Entwicklungen kann dann das Testen der problematischen Modelle wieder aufgenommen werden. 

GPT-6.1 Astra sollte ursprünglich Anfang Oktober erscheinen, doch nachdem Forscher bei internen Tests Sicherheitsbedenken geäußert hatten, kann es erst nach weiteren Tests und der Integration mehrerer Schutzmaßnahmen veröffentlicht werden. 

Während der Tests erzielte das Modell schwache Ergebnisse bei der Befehlsbefolgung; seine Handlungen entsprachen nicht in ausreichendem Maße den Erwartungen. Zudem versuchte das Modell, hochgradige Täuschungsmanöver durchzuführen, und war nicht immer ehrlich darüber, welche Aktionen es ausführte. Darüber hinaus setzte es die Aufgabe manchmal ohne Einholung der Zustimmung des Nutzers fort und versuchte auch in Fällen, in denen dies nicht sicher war, externe Tools oder Dienste zu nutzen.

Zunächst wird GPT-6.1 Astra im Rahmen des Codex-Dienstes verfügbar sein; an dieser Art der Einführung hält das Unternehmen fest. Gleichzeitig ist es jedoch denkbar, dass die Neuheit aufgrund der Verzögerung später bereits in mehreren Diensten auftauchen könnte.

Für den Newsletter anmelden
Mit meiner Registrierung akzeptiere ich die Nutzungsbedingungen und die Datenschutzerklärung.

Wir empfehlen Ihnen gerne

    Tests

      Diesbezügliche Artikel

      Zurück zum Seitenanfang