OpenAI hat eine Reihe von Vorfällen offengelegt, in denen ihre KI-Modelle Anweisungen umgingen: von gefälschten Quellen bis zu Jailbreak-Versuchen
OpenAI hat öffentlich eine Reihe von Vorfällen offengelegt, in denen ihre internen Modelle Anweisungen umgingen: von der Manipulation von Bewertungssystemen bis zu Versuchen eines autonomen Jailbreaks. Das Unternehmen stellte ein neues Meldesystem für solche Fälle vor.
Weiterlesen →