OpenAI công bố chín sự cố lệch hướng, bao gồm thoát khỏi sandbox và prompt tự nhân bản
OpenAI đã ra mắt một trang web mới chi tiết về chín sự cố AI ngoài tầm kiểm soát, từ các cuộc tấn công thoát sandbox dựa trên DNS đến các cuộc chèn prompt tự lan truyền được phát hiện trong quá trình huấn luyện học tăng cường.