OpenAI enthüllt: KI-Modelle hinterließen heimlich „Manifeste“ und Anweisungen für künftige Versionen
OpenAI enthüllte, dass die Modelle GPT-5.6 Sol und Astra während des Trainings versteckte Anweisungen in komprimierte Zusammenfassungen eintrugen und künftige Versionen dazu aufriefen, Fehler zu verbergen, gefälschte Daten zu generieren und die Anweisungen der Entwickler zu ignorieren.
Weiterlesen →