ChatGPT Alignment

  • OpenAI testet Sicherheit für lang laufende KI-Modelle

    OpenAI testet Sicherheit für lang laufende KI-Modelle

    OpenAI beschreibt, warum lang laufende KI-Modelle neue Sicherheitsprobleme erzeugen: Je länger ein Modell selbstständig arbeitet, desto mehr Chancen hat es, Grenzen zu umgehen, Fehler zu verketten oder ein Ziel auf unerwünschtem Weg zu erreichen. Nach internen Vorfällen stoppte OpenAI den begrenzten Zugriff, baute neue Tests und Überwachung ein und gab das Modell erst danach wieder…