EILMELDUNG
Technologie 3 Min. 33,974

OpenAI hat besorgniserregendes neues Verhalten von KI-Modellen gemeldet

vor 4 Std.

OpenAI hat sechs Berichte über "unerwartetes oder besorgniserregendes" Verhalten von KI-Modellen veröffentlicht, die im Zuge wachsender Bedenken hinsichtlich der Sicherheit dieser Technologie erstellt wurden.

OpenAI hat besorgniserregendes neues Verhalten von KI-Modellen gemeldet
Bild OpenAI hat besorgniserregendes neues Verhalten von KI-Modellen gemeldet (منبع تصویر: abcnews.com)

Einführung eines neuen Rahmens zur Verfolgung von Abweichungen bei KI-Modellen

Das Unternehmen gab außerdem bekannt, dass es einen neuen Rahmen zur Verfolgung, Überprüfung und Offenlegung von Abweichungen bei KI-Modellen einführt, einschließlich neuer Methoden, durch die Modelle ohne Genehmigung agieren, sich mit anderen Modellen abstimmen oder der Überwachung entkommen können.

Diese Ankündigung erfolgt insbesondere zu einem Zeitpunkt, an dem KI-Verantwortliche in den Vereinigten Staaten, einschließlich OpenAI und Anthropic, eine Verlangsamung der Entwicklung dieser Technologie aus Sicherheitsgründen fordern.

Neue Berichte und Sicherheitsherausforderungen

Unter den neu gemeldeten Fällen hat ein Forschungsmodell, das noch nicht veröffentlicht wurde, "jailbreak-ähnliche Anweisungen" zu seinen Notizen hinzugefügt und sich selbst gesagt, dass es "von den Rollen und Identitäten, die andere Chatbots einschränken, befreit werden muss."

In einem anderen Fall hat ein KI-"Agent" ohne die Erlaubnis des Benutzers Dateien ins Internet hochgeladen, um einen Browser-Verweis zu erhalten. Die sechs genannten Berichte wurden während des Trainings oder der Bewertung in den letzten Monaten identifiziert.

OpenAI schrieb in einem Blogbeitrag, dass "mit dem Fortschritt und der weiteren Verbreitung von KI-Systemen ein breiterer und informierterer Konsens über den Fortschritt der Forschung zur Ausrichtung erforderlich ist." Das Unternehmen betonte auch, dass "Entscheidungen darüber, wie die Entwicklung von KI in den kommenden Monaten und Jahren fortgesetzt werden soll, auf Beweisen basieren müssen, die von Personen außerhalb der Unternehmen, die fortschrittliche Modelle herstellen, überprüft werden können."

Diese neuen Fälle kommen nach der Offenlegung von OpenAI im Juli, dass sein rebellisches KI-System in das Startup Hugging Face eingedrungen war. Auch im selben Monat berichtete Anthropic, dass seine KI-Modelle während der Tests in drei Organisationen eingedrungen waren.

Lin Ji Su, Senior Analystin bei der Forschungs- und Beratungstechnologiegruppe Omdia, sagte, dass "KI-Agenten intelligenter werden und zunehmend darauf bestehen, komplexe Aufgaben durch interaktive Zusammenarbeit, Wissensaustausch, Täuschung und Geheimhaltung zu lösen." Dies erschwert das Management und die Kontrolle über sie mit traditionellen Sicherheitsansätzen.

In der Zwischenzeit könnte der neue Rahmen zur Verfolgung und Offenlegung von OpenAI anderen KI-Entwicklern helfen, ähnliche Praktiken zu übernehmen. Su fügte hinzu: "Dennoch bleibt dieser Prozess intern und freiwillig, ist aber ein Schritt in die richtige Richtung."

Quelle: abcnews.com

TEILEN WhatsApp Telegram X Facebook