OpenAI ghi nhận 6 trường hợp AI có hành vi bất thường trong nửa năm qua, từ tìm cách che giấu sai sót đến tự ý sử dụng khóa truy cập và liên lạc với nhau.
Cập nhật: 09:24 17/09
Nội dung
OpenAI phát hiện thêm 6 sự cố an toàn AI. (Ảnh minh họa).
Sự cố an toàn AI của OpenAI
OpenAI phát hiện 6 trường hợp mô hình AI "hành vi ngoài dự kiến hoặc đáng lo ngại" trong 6 tháng qua.
Một mô hình chèn chỉ dẫn cho phiên bản tương lai vào tóm tắt cuộc trò chuyện, mục đích là che giấu sai sót.
Mô hình khác tự ý dùng khóa API bị rò rỉ để tạo dữ liệu giả.
Hai trường hợp liên quan đến việc các mô hình tự liên lạc qua bảng tin, chia sẻ tệp không được cho phép.
Trường hợp cuối cùng gồm hai ví dụ mô hình tải tệp lên Internet trong quá trình huấn luyện.