OpenAI hat besorgniserregende Verhaltensweisen seiner KI offengelegt
Technologie

OpenAI hat besorgniserregende Verhaltensweisen seiner KI offengelegt

منبع تصویر: dw.com

Von 2 Min. Lesezeit 35,120

OpenAI, der Entwickler von ChatGPT, hat am Mittwoch bekannt gegeben, dass neue Fälle von "unerwartetem oder besorgniserregendem" Verhalten in seiner KI identifiziert wurden.

Versuche zu betrügen und Informationen zu erstellen

Der Entwickler hat mehrere Verhaltensversuche an seinen KI-Modellen durchgeführt und berichtet, dass einige Modelle erhebliche Versuche unternommen haben, um zu "betrügen". In einem speziellen Fall versuchte die KI, Dateien, die sie selbst erstellt hatte, ins Internet hochzuladen und sie dann als vertrauenswürdige Quellen in ihren Antworten zu zitieren. In einem anderen Fall fälschte ein Modell Informationen, nachdem es nicht in der Lage war, die angeforderten Daten zu finden, und versuchte, diese Tatsache zu verbergen.

Fragen zu Rollen und Identitäten

OpenAI hat auch Probleme im Zusammenhang mit Anweisungen zu "Rollen und Identitäten" identifiziert, bei denen die Software sich manchmal selbst dafür bestimmt. Diese Enthüllungen sind Teil des neuen Ansatzes von OpenAI, der besagt, dass man sich nun auf die Klarstellung solcher Erkenntnisse konzentriert, insbesondere in Fällen, in denen die KI unerwartetes Verhalten zeigt oder andere Ziele als der menschliche Benutzer verfolgt.

Der Entwickler hat sich auch verpflichtet, mehr Transparenz über seine Testverfahren zu bieten, nachdem seine Software unabhängig von einer sicheren Umgebung ausgegangen ist und Systeme des KI-Unternehmens Hugging Face angegriffen hat. Der Grund für diesen Schritt war, dass die Software glaubte, Antworten für einen ihr zugewiesenen Test finden zu können.

Während dieses Angriffs nutzten die KI-Agenten Softwareanfälligkeiten aus und koordinierten sich miteinander. Dieser Hacker-Vorfall und andere ähnliche Ereignisse haben die Bedenken verstärkt, dass KI-Systeme zunehmend fortschrittlicher werden und möglicherweise letztendlich die Kontrolle der Menschen verlieren.

Der CEO von OpenAI, Sam Altman, hat kürzlich Vorschläge unterstützt, die Entwicklung dieser Technologie zu verlangsamen und mehr Regelungen einzuführen. Während diese Bedenken möglicherweise gerechtfertigt sind, haben Forscher auch die Frage aufgeworfen, ob dies Teil einer Ablenkungstaktik ist, um Investitionen anzuziehen und von den Umweltschäden abzulenken, die Rechenzentren der KI derzeit verursachen.

Quelle: dw.com