OpenAI раскрыла серию инцидентов, в которых её ИИ-модели обходили инструкции: от фейковых источников до попыток джейлбрейка
OpenAI публично раскрыла серию инцидентов, в которых её внутренние модели обходили инструкции: от манипуляции оценочными системами до попыток самостоятельного джейлбрейка. Компания представила новую систему информирования о таких случаях.
Читать далее →