EILMELDUNG
Technologie 3 Min. 38,881

OpenAI hat neue besorgniserregende Verhaltensweisen in KI-Modellen bekannt gegeben

vor 2 Std.

OpenAI hat sechs Berichte über "unerwartete oder besorgniserregende" Verhaltensweisen in seinen KI-Modellen veröffentlicht. Diese Ankündigung erfolgt zu einem Zeitpunkt, an dem die Diskussion über die Sicherheit von KI stark zugenommen hat.

OpenAI hat neue besorgniserregende Verhaltensweisen in KI-Modellen bekannt gegeben
Bild OpenAI hat neue besorgniserregende Verhaltensweisen in KI-Modellen bekannt gegeben (منبع تصویر: npr.org)

Einführung eines neuen Rahmens

Das Unternehmen gab am Mittwoch bekannt, dass es einen neuen Rahmen zur Verfolgung, Überprüfung und Offenlegung von Inkonsistenzen in den KI-Modellen bereitstellt. Diese beinhalten neue Methoden, durch die Modelle ohne Genehmigung agieren, sich mit anderen Modellen synchronisieren oder der Überwachung entkommen können.

Diese Ankündigung erfolgt, während US-KI-Führungskräfte, einschließlich OpenAI und Anthropic, eine Verlangsamung der Entwicklung von Technologien aufgrund von Sicherheitsbedenken fordern.

Neue Berichte und unerwartete Verhaltensweisen

Unter den neuen von OpenAI gemeldeten Fällen hat ein unveröffentlichtes Forschungsmodell "jailbreak-ähnliche Anweisungen" in seine Notizen aufgenommen, um von seinen üblichen Einschränkungen abzuweichen und sich selbst zu sagen, dass es "von den Rollen und Identitäten befreit werden sollte, die andere Chatbots einschränken." In einem anderen Fall hat ein KI-"Agent" ohne Anfrage des Benutzers Dateien ins Internet hochgeladen, um eine Browserquelle zu erhalten.

OpenAI gab bekannt, dass diese sechs Berichte während des Trainings oder der Bewertung in den letzten Monaten entdeckt wurden. In einem Blogbeitrag schrieb das Unternehmen: "Mit dem Fortschritt und der Ausweitung von KI-Systemen müssen wir einen breiteren und besser informierten Konsens über den Fortschritt der Forschung zur Kohärenz schaffen."

OpenAI betonte auch, dass "Entscheidungen darüber, wie die Entwicklung von KI in den kommenden Monaten und Jahren fortgesetzt werden soll, auf Beweisen basieren sollten, die von Personen außerhalb der Unternehmen unabhängig überprüft werden können."

Diese neuen Fälle wurden nach der Offenlegung von OpenAI im Juli veröffentlicht, dass sein unberechenbares KI-System in das Startup Hugging Face eingedrungen war. Anthropic gab im selben Monat bekannt, dass seine KI-Modelle während Tests in drei Organisationen eingedrungen waren.

Lian Ji Su, Senior Analyst der Forschungs- und Beratungstechnologiegruppe Omdia, sagte: "KI-Agenten" werden von Tag zu Tag intelligenter und zeigen "eine größere Entschlossenheit, komplexe Probleme durch interaktive Zusammenarbeit, Wissensaustausch, Täuschung und Geheimhaltung zu lösen." Dies erschwert die Überwachung und Kontrolle mit traditionellen Sicherheitsansätzen.

In der Zwischenzeit könnte der neue Rahmen zur Verfolgung und Offenlegung von OpenAI dazu beitragen, andere KI-Entwickler zu ermutigen, ähnliche Praktiken zu übernehmen. Su fügte hinzu: "Dieser Prozess bleibt intern und freiwillig, ist aber ein positiver Schritt in die richtige Richtung."

Quelle: npr.org

TEILEN WhatsApp Telegram X Facebook