Từ chuyện mô hình nào có bộ dữ liệu đánh giá bị ô nhiễm, mô hình nào ăn gian viết bù chuỗi suy luận sau khi đã có sẵn đáp án, cho đến mô hình nào rêu rao hỗ trợ ngữ cảnh hàng triệu token nhưng mới chạy đến sáu trăm nghìn đã bắt đầu rơi rụng dữ liệu phía trước... hắn đều từng kiểm định qua hết.
Hơn nữa, sau khi kiểm tra, hắn còn đăng toàn bộ câu lệnh gợi ý, kịch bản chạy lại thực nghiệm và kết quả gốc lên GitHub. Bất kỳ ai cũng có thể tự mình chạy thử lại một lần.
Thực ra, ngay từ hôm lô ảnh chụp màn hình đầu tiên rò rỉ, GreyBox đã bắt tay vào kiểm tra lại mô hình của cả ba công ty, nhắm thẳng vào vấn đề quyền hạn và quyền riêng tư lần này.
Và bây giờ, kết quả đã có.