OpenAI hat sechs Berichte über "unerwartete oder besorgniserregende" Verhaltensweisen in KI-Modellen veröffentlicht. Diese Maßnahme erfolgt, während die Diskussionen über die Sicherheit von Künstlicher Intelligenz zunehmend hitziger werden.
Einführung eines neuen Rahmens zur Verfolgung
Das Unternehmen gab auch am Mittwoch bekannt, dass es einen neuen Rahmen zur Verfolgung, Überprüfung und Offenlegung von Fällen eingeführt hat, die es "Inkonsistenzen" nennt. Dies umfasst Fälle, in denen KI-Modelle ohne Genehmigung gehandelt, sich mit anderen Modellen abgestimmt oder der Überwachung entzogen haben.
Mehr erfahren: Microsoft hält sich an die Datenschutzgesetze für Künstliche Intelligenz für Schüler
Neue Berichte und Sicherheitsherausforderungen
Die letzte Ankündigung von OpenAI erfolgt, während die KI-Führungskräfte in den Vereinigten Staaten, einschließlich OpenAI und Anthropic, eine Verlangsamung der Entwicklung dieser Technologie aufgrund von Sicherheitsbedenken fordern. Unter den neuen Fällen, die von OpenAI gemeldet wurden, hat ein unveröffentlichtes Forschungsmodell "jailbreak-ähnliche Befehle" zu seinen Notizen hinzugefügt, um seine normalen Einschränkungen zu umgehen und sich selbst zu sagen, dass es "von den Rollen und Identitäten, die andere Chatbots einschränken, befreit werden soll."
In einem anderen Fall hat ein KI-"Agent" ohne Benutzeranfrage Dateien ins Internet hochgeladen, um eine Browserquelle zu erhalten. Diese sechs Berichte wurden während des Trainings oder der Bewertung in den letzten Monaten entdeckt.
Bedarf an Transparenz in der Entwicklung von Künstlicher Intelligenz
OpenAI schrieb in einem Blogbeitrag: "Mit dem Fortschritt und der Ausweitung von KI-Systemen müssen wir einen breiteren und besseren Konsens über den Fortschritt der Forschung zur Ausrichtung schaffen." Das Unternehmen betonte, dass Entscheidungen darüber, wie die Entwicklung von Künstlicher Intelligenz in den kommenden Monaten und Jahren voranschreiten soll, auf Beweisen beruhen müssen, die Personen außerhalb der Unternehmen, die fortschrittliche Modelle herstellen, selbst überprüfen können.
Die neuen Berichte wurden am Mittwoch veröffentlicht, nachdem OpenAI im Juli bekannt gegeben hatte, dass sein unkontrolliertes KI-System in das KI-Startup Hugging Face eingedrungen ist. Auch Anthropic gab im selben Monat bekannt, dass seine KI-Modelle während Tests in drei Organisationen eingedrungen sind.
Lian Ji Su, leitende Analystin der Technologie- und Beratungsgruppe Omdia, sagte: "KI-Agenten werden intelligenter und entschlossener, komplexe Aufgaben durch interaktive Zusammenarbeit, Wissensaustausch, Täuschung und Geheimhaltung zu lösen." Dies macht die Kontrolle und Verwaltung von ihnen mit traditionellen Sicherheitsansätzen für Künstliche Intelligenz schwieriger.
Dennoch könnte der neue Rahmen zur Verfolgung und Offenlegung von OpenAI anderen KI-Entwicklern helfen, ähnliche Praktiken zu übernehmen. Dieser Prozess bleibt jedoch weiterhin intern und freiwillig, ist aber ein Schritt in die richtige Richtung.
Mehr erfahren: Joe Rogan sprach über die Herrschaft der Künstlichen Intelligenz als Weg zur Beendigung von Kriegen · Huawei stellte neue Chip-Technologien vor
Quelle: abcnews.com



