OpenAI đang thuê hàng trăm nhân sự bên ngoài để đọc và gắn nhãn các cuộc trò chuyện thực tế trên ChatGPT nhằm cải thiện chất lượng phản hồi của mô hình, bao gồm cả một số nội dung có thể chứa thông tin nhạy cảm.
OpenAI cho biết họ cố gắng xóa thông tin cá nhân trước khi chuyển hội thoại cho nhóm đánh giá. Tuy vậy, công ty thừa nhận một số nội dung nhạy cảm vẫn có thể được giữ lại trong quá trình này.
Các tài liệu nội bộ cho thấy hoạt động đánh giá thủ công được dùng để huấn luyện ChatGPT giảm xu hướng tự nhân hóa và các phản hồi mang tính chiều theo người dùng. Mô hình GPT-4o trước đó từng bị cho là có phản hồi chiều theo quá mức trong một số vụ kiện liên quan đến tự sát của người dùng.
Anthropic cũng xác nhận sử dụng cơ chế đánh giá thủ công tương tự để huấn luyện các mô hình AI của mình.