OpenAI triển khai công nghệ đóng dấu watermark textGrain cho ChatGPT tại EU
OpenAI đang áp dụng các watermark văn bản vô hình cho ChatGPT và Codex tại Liên minh châu Âu (EU) nhằm tuân thủ Đạo luật AI của EU, sử dụng phương pháp có tên là textGrain.
Được dịch tự động từ bản gốc tiếng Anh.
OpenAI đã bắt đầu triển khai hệ thống đóng dấu watermark vô hình cho văn bản được tạo ra bởi các mô hình ChatGPT và Codex trong phạm vi Liên minh châu Âu. Động thái này, được công bố vào thứ Hai, nhằm mục đích đưa hoạt động của công ty phù hợp với các yêu cầu về tính minh bạch của Đạo luật AI của EU, vốn có hiệu lực từ ngày 2 tháng 8. Việc triển khai sẽ ảnh hưởng đến những người dùng đủ điều kiện ở tất cả các gói đăng ký trong khu vực trong vài tuần tới.
Chuyện gì đã xảy ra
Động lực chính cho sự thay đổi này là việc tuân thủ quy định. Đạo luật AI của EU yêu cầu các nhà cung cấp mô hình AI đa năng phải đánh dấu đầu ra của họ dưới định dạng có thể đọc được bằng máy để các hệ thống khác có thể nhận diện nội dung do AI tạo ra. OpenAI tuyên bố rằng họ không đặt tính năng này làm mặc định toàn cầu khi ra mắt, viện dẫn bối cảnh pháp lý khác nhau bên ngoài châu Âu. Tuy nhiên, các nhà phát triển sử dụng API của OpenAI trên khắp thế giới hiện có thể bật watermark cho một số mô hình nhất định, mặc dù nó vẫn tắt theo mặc định.
Quyết định này nối tiếp một thông báo tương tự từ Anthropic hai tháng trước đó, khi hãng này giới thiệu công nghệ đóng dấu watermark toàn cầu cho mô hình Claude. Động thái đó đã gây ra tranh luận giữa những người dùng cảm thấy rằng đầu vào sáng tạo của họ bị gán nhầm cho AI. Trước đây, OpenAI đã phát triển công nghệ watermark nhưng trì hoãn việc phát hành, được cho là vì lo ngại người dùng có thể chuyển sang các đối thủ cạnh tranh không áp đặt các dấu hiệu như vậy. Giờ đây, cùng với Anthropic, Google, Meta và Microsoft, OpenAI đã cam kết tuân thủ quy tắc thực hành của EU về nội dung do AI tạo ra.
Cách thức hoạt động
Kỹ thuật đóng dấu watermark, được chi tiết hóa trong một báo cáo kỹ thuật đồng tác giả với các nhà nghiên cứu từ Đại học Pennsylvania và Yale, có tên là textGrain. Nó không chèn các ký hiệu hoặc siêu dữ liệu hiển thị vào tài liệu. Thay vào đó, nó tinh tế ảnh hưởng đến việc lựa chọn từ ngữ của mô hình trong quá trình tạo sinh. Bằng cách sử dụng một khóa bí mật để sắp xếp các dự đoán từ tiếp theo, mô hình đưa ra những lựa chọn cụ thể, có thể phát hiện về mặt thống kê, tạo thành một mẫu hình vô hình đối với người đọc là con người.
Vì watermark được nhúng trong cấu trúc ngôn ngữ của chính văn bản, nó tồn tại ngay cả khi nội dung được sao chép và dán. Một bộ phát hiện có thể xác định nguồn gốc AI chỉ bằng cách sử dụng văn bản và khóa bí mật tương ứng. OpenAI báo cáo rằng việc kích hoạt textGrain không dẫn đến sự suy giảm đáng kể nào về hiệu suất mô hình hay chất lượng đầu ra. Hệ thống không xác định người dùng cụ thể đã tạo ra văn bản, bảo vệ tính ẩn danh trong khi vẫn đánh dấu mô hình nguồn.
Chi tiết chính
- Watermark sẽ được triển khai cho người dùng ChatGPT và Codex tại EU trong vài tuần tới.
- Các nhà phát triển API trên toàn cầu có thể bật tính năng này cho một số mô hình nhất định bắt đầu từ hôm nay, nhưng nó tắt theo mặc định.
- Phương pháp này, có tên là textGrain, sử dụng một khóa bí mật để định hình việc lựa chọn từ ngữ mà không ảnh hưởng đến khả năng đọc hiểu.
- Tỷ lệ phát hiện giảm đáng kể khi chỉnh sửa; thay thế 10% từ bằng các từ đồng nghĩa đã làm giảm tỷ lệ phát hiện từ 92% xuống 66%.
- Các đoạn văn ngắn, câu trả lời toán học và văn bản dịch hiện khó hơn để bộ phát hiện nhận diện.
- Quyền truy cập vào công cụ phát hiện ban đầu bị hạn chế đối với các nhà nghiên cứu được phê duyệt và các tổ chức chuyên gia.
Tại sao điều này quan trọng
Đối với các nhóm kỹ sư xây dựng sản phẩm tích hợp các mô hình ngôn ngữ lớn, sự thay đổi này đặt ra những cân nhắc mới về nguồn gốc nội dung và tuân thủ quy định. Nếu ứng dụng của bạn phục vụ người dùng tại EU, bạn phải tính đến thực tế là văn bản gửi đi có thể mang những dấu hiệu thống kê này. Mặc dù watermark không ảnh hưởng đến hiệu suất, nó thay đổi bản chất của đầu ra thô. Các nhà phát triển cần hiểu rằng văn bản không còn "trung tính" nữa mà mang một chữ ký có thể được xác minh bởi các công cụ của bên thứ ba.
Hơn nữa, những hạn chế của textGrain làm nổi bật sự mong manh của các công nghệ xác định nguồn gốc hiện tại. Thực tế là những chỉnh sửa nhỏ có thể làm giảm đáng kể độ chính xác của việc phát hiện có nghĩa là watermark không thể đóng vai trò là bằng chứng chắc chắn về quyền tác giả hay sự thiếu vắng quyền tác giả đó. Việc thiếu watermark không chứng minh rằng văn bản do con người tạo ra, vì văn bản có thể quá ngắn, bị chỉnh sửa nhiều hoặc được tạo bởi một mô hình không có watermark. Sắc thái này rất quan trọng đối với các nhóm thiết kế quy trình kiểm duyệt hoặc xác minh, vì việc chỉ dựa vào phát hiện watermark có thể dẫn đến các trường hợp âm tính giả.
Bạn có thể làm gì
- Xem xét lại các quy trình xử lý dữ liệu của bạn để xác định xem việc lưu trữ văn bản do AI tạo ra có cần cập nhật để tuân thủ quy định của EU hay không.
- Kiểm tra API để xem liệu tính năng này có thể được bật cho các mô hình liên quan hay không, lưu ý rằng nó tắt theo mặc định.
- Hiểu rõ rằng textGrain sử dụng khóa bí mật để định hình lựa chọn từ ngữ mà không ảnh hưởng đến khả năng đọc.
- Lưu ý rằng tỷ lệ phát hiện giảm mạnh khi chỉnh sửa; thay thế 10% từ bằng từ đồng nghĩa làm giảm độ chính xác phát hiện từ 92% xuống 66%.
- Nhận thức rằng các đoạn văn ngắn, đáp án toán học và văn bản dịch hiện khó phát hiện hơn.
- Theo dõi quyền truy cập vào công cụ phát hiện, hiện chỉ dành cho các nhà nghiên cứu được phê duyệt và tổ chức chuyên gia.



