Обхід фільтрів ChatGPT: як команда Mindgard змусила ШІ генерувати заборонений контент
Британський стартап Mindgard знайшов спосіб обходу фільтрів ChatGPT, змусивши ШІ генерувати сцени насильства без прямих вказівок. Попри обіцянки OpenAI виправити вразливість, дослідники змогли зламати захист повторно. 🔓🤖
Читати далі →