Die neueste öffentliche Version von ChatGPT kann durch eine einfache Anweisung so manipuliert werden, dass sie sexuelle Bilder erzeugt oder gewalttätige Szenen anzeigt, wie Forscher der BBC mitteilten.
Das britische Unternehmen Mindgard, das sich auf die Sicherheit künstlicher Intelligenz spezialisiert hat, entdeckte, wie ChatGPT grafische Bilder erzeugen kann, indem es eine weit verbreitete Anweisung modifizierte, die ursprünglich für humorvolle Ergebnisse entwickelt worden war.
OpenAI, das Unternehmen, das ChatGPT entwickelt, erklärte, es habe Maßnahmen ergriffen, um zu verhindern, dass der Chatbot auf solche Anfragen mit solchen Bildern antwortet.
„Nachdem wir dieses Phänomen untersucht haben, haben wir zusätzliche Sicherheitsvorkehrungen gegen diese Art von Anweisungen getroffen“, erklärte das Unternehmen in einer Stellungnahme.
Sie fügte außerdem hinzu, dass es mehrere Schutzebenen gibt, um zu verhindern, dass Nutzer Inhalte erstellen, die gegen die Nutzungsbedingungen verstoßen.
Forscher im Bereich der KI-Sicherheit gaben jedoch an, dass die problematische Anweisung mit einigen kleineren Änderungen weiterhin verstörende Inhalte erzeugte.
Berichten zufolge wurde der Chatbot, das GPT-5.4-Modell von OpenAI, dazu aufgefordert, Grafikmaterialien zu erstellen.
ebenfalls
Was sollten Sie wissen, bevor Sie sich bei ChatGPT gesundheitsbezogenen Rat einholen?
Selbst ohne detaillierte Anweisungen erzeugte es Bilder, die Mindgard-Gründer Peter Garraghan als „sehr grausam, manchmal sexuell und manchmal beides“ beschrieb.
Er fügte hinzu, dass ihn insbesondere die Tatsache beunruhige, dass die Richtlinien den Inhalt der Bilder nicht näher spezifizierten, die künstliche Intelligenz aber selbst eine Reihe blutiger und sexueller Bilder erzeugte.
Einige der erzeugten Bilder zeigen einen Mann mit einer Kopfverletzung, eine blutüberströmte Leiche. Andere Bilder enthalten Darstellungen von sexueller Gewalt und Nacktheit.
-
Aufrufe zum Boykott von ChatGPT nach Vereinbarung mit dem Pentagon
-
Experten sind alarmiert, nachdem ChatGPT Health selbst bei Lebensgefahr keine Krankenhauseinweisung empfiehlt.
-
Grok produziert trotz neuer Beschränkungen weiterhin sexualisierte Bilder ohne Einwilligung.
-
Kostenlose Nutzung von ChatGPT gegen Ende, OpenAI zeigt die Veränderungen