OpenAI gắn watermark vô hình vào văn bản ChatGPT tại EU (5/10/2026): thay 10% từ, tỷ lệ phát hiện giảm từ 92% xuống 66%
Văn bản do ChatGPT viết cho người dùng tại Liên minh châu Âu (EU) sắp mang một "dấu vết" mà người đọc không nhìn thấy. Theo TechCrunch, ngày 5/10/2026, OpenAI cho biết sẽ gắn watermark (dấu nhận diện) vô hình vào văn bản do ChatGPT và Codex tạo ra tại EU để tuân thủ Đạo luật AI của khối này.
Tóm tắt nhanh: watermark sẽ được triển khai trong vài tuần tới cho người dùng ChatGPT và Codex đủ điều kiện ở mọi gói, nhưng chỉ tại EU. Khách hàng API trên toàn thế giới có thể tự bật cho một số mô hình từ ngày 5/10; mặc định vẫn tắt. OpenAI thừa nhận watermark có thể bị làm yếu bằng cách sửa câu chữ.
Vì sao OpenAI làm lúc này
Các quy định minh bạch trong Đạo luật AI của EU (EU AI Act) có hiệu lực từ ngày 2/8. Theo đó, công ty AI phải đánh dấu nội dung do AI tạo ra theo cách mà các hệ thống khác có thể nhận diện được.
OpenAI cho biết không đặt watermark văn bản thành mặc định toàn cầu ở giai đoạn đầu. Cách làm theo khu vực giúp công ty học hỏi từ thực tế sử dụng và phản hồi. Công ty cũng mở đơn đăng ký dùng công cụ phát hiện watermark, ban đầu chỉ dành cho nhà nghiên cứu và tổ chức chuyên môn được duyệt.
Watermark văn bản hoạt động thế nào
Watermark này không phải ký hiệu hay dòng chữ chèn vào cuối bài. Theo TechCrunch, mô hình được "nắn" nhẹ lựa chọn từ ngữ khi viết, để lại một mẫu hình mà người đọc không nhận ra nhưng công cụ phát hiện có thể nhận diện. Vì nằm ngay trong câu chữ, watermark đi theo văn bản khi người dùng sao chép và dán sang nơi khác.
OpenAI công bố báo cáo kỹ thuật về phương pháp này, gọi là textGrain, viết cùng các nhà nghiên cứu Đại học Pennsylvania và Đại học Yale. Phương pháp dùng một khóa bí mật để sắp xếp các khả năng chọn từ tiếp theo. Cộng hàng trăm lần "nắn" như vậy, công cụ phát hiện chỉ cần văn bản và khóa là nhận ra nội dung do AI tạo.
OpenAI khẳng định watermark không chứa thông tin nhận diện người dùng và không thấy hiệu năng mô hình thay đổi đáng kể khi bật.
Giới hạn được chính OpenAI thừa nhận
Watermark có thể bị làm yếu bằng chỉnh sửa. Trong một thử nghiệm của OpenAI, thay 10% số từ bằng từ đồng nghĩa khiến tỷ lệ phát hiện giảm từ khoảng 92% xuống 66%. Đoạn văn ngắn, lời giải toán và văn bản đã dịch cũng khó phát hiện hơn.
OpenAI lưu ý việc không có watermark "không chứng minh văn bản do con người viết", vì văn bản có thể quá ngắn, bị sửa nhiều hoặc do AI của hãng khác tạo ra. Ngược lại, watermark chỉ cho thấy hệ thống của OpenAI đã tạo hoặc xử lý một phần đoạn văn, chứ không cho biết con người đã đóng góp bao nhiêu phần biên tập hay sáng tạo.
Cuộc đua đánh dấu nội dung AI
Thông báo của OpenAI đến hai tháng sau khi Anthropic cho biết sẽ gắn watermark vào văn bản do Claude tạo ra và áp dụng trên toàn cầu. Quyết định đó từng vấp phản ứng từ một số người dùng Claude. Theo TechCrunch, Anthropic, Google, Meta, Microsoft và OpenAI đều đã cam kết tuân theo bộ quy tắc thực hành của EU về nội dung do AI tạo ra.
Doanh nghiệp Việt chịu tác động gì?
Doanh nghiệp Việt viết nội dung, tài liệu sản phẩm, hồ sơ chào hàng hay mã nguồn cho khách hàng EU nên giả định rằng văn bản tạo bằng ChatGPT có thể bị nhận diện là nội dung AI. Nếu hợp đồng với đối tác châu Âu có điều khoản công bố việc dùng AI, doanh nghiệp cần cập nhật quy trình để khai báo rõ phần nào do AI hỗ trợ và phần nào do người biên tập.
Doanh nghiệp dùng API của OpenAI để làm sản phẩm cho thị trường EU có thể chủ động bật watermark nhằm đáp ứng nghĩa vụ minh bạch. Trong nước, nên đưa nội dung này vào quy chế sử dụng AI nội bộ và đối chiếu với các yêu cầu của luật AI Việt Nam.
Nguồn
- TechCrunch, "OpenAI will start watermarking ChatGPT's text in the EU" (5/10/2026): techcrunch.com
- OpenAI, bài blog "Our approach to EU text provenance rules" (5/10/2026), được TechCrunch dẫn lại



