OpenAI sẽ đánh dấu văn bản ChatGPT tại EU

OpenAI sẽ thêm dấu chìm vô hình vào văn bản ChatGPT và Codex cho người dùng đủ điều kiện tại EU. Cơ chế này điều chỉnh cách mô hình chọn từ để công cụ chuyên dụng có thể nhận diện nội dung.

Minh họa cơ chế phát hiện dấu chìm trong văn bản do OpenAI tạo
Cơ chế nhận diện dấu chìm trong văn bản OpenAI

OpenAI sẽ thêm dấu chìm vô hình vào văn bản do ChatGPT và Codex tạo ra cho những người dùng đủ điều kiện tại Liên minh châu Âu. Dấu chìm được tạo bằng những điều chỉnh nhỏ trong cách mô hình chọn từ, cho phép công cụ chuyên dụng nhận diện mẫu mà người đọc không nhìn thấy. Phạm vi triển khai ban đầu không bao gồm người dùng ChatGPT tại Việt Nam.

Theo bài viết gốc của TechCrunch ngày 5/10/2026, công ty công bố kế hoạch trong một bài đăng của OpenAI vào thứ Hai. Kế hoạch nhằm đáp ứng quy định minh bạch của Đạo luật AI châu Âu.

Quy định này có hiệu lực từ ngày 2/8 và yêu cầu các công ty AI đánh dấu nội dung do trí tuệ nhân tạo tạo ra theo cách mà những hệ thống khác có thể nhận diện. Liên minh châu Âu trình bày yêu cầu trong hướng dẫn về nghĩa vụ minh bạch đối với AI.

Nội dung triển khai dấu chìm

OpenAI sẽ triển khai dấu chìm cho những người dùng ChatGPT và Codex đủ điều kiện tại Liên minh châu Âu trên tất cả các gói. Nhà phát triển ở các quốc gia khác có thể chủ động bật tính năng cho một số mô hình qua giao diện lập trình, nhưng dấu chìm không được bật mặc định.

Theo OpenAI, người dùng ChatGPT và Codex thuộc phạm vi áp dụng sẽ nhận tính năng trong vài tuần sau thông báo. Các nhà phát triển sử dụng giao diện lập trình của OpenAI có thể bật dấu chìm cho một số mô hình ngay từ ngày công bố.

OpenAI chưa áp dụng dấu chìm văn bản làm thiết lập mặc định trên toàn cầu. Vì vậy, người dùng ChatGPT tại Việt Nam không tự động nhận cơ chế này chỉ vì sử dụng cùng một sản phẩm. Phạm vi bắt buộc ban đầu gắn với người dùng đủ điều kiện tại Liên minh châu Âu.

Dấu chìm nằm trong cách mô hình chọn từ

Dấu chìm của OpenAI không phải biểu tượng được chèn vào tài liệu. Hệ thống điều chỉnh nhẹ cách mô hình chọn từ để tạo ra một mẫu vô hình. Vì mẫu nằm trong chính các từ được sử dụng, nó vẫn tồn tại khi người dùng sao chép và dán văn bản sang nơi khác.

OpenAI cho biết dấu chìm không được dùng để xác định người dùng. Công ty cũng không ghi nhận thay đổi đáng kể về hiệu suất của mô hình khi bật tính năng.

OpenAI đặt tên phương pháp này là textGrain. Báo cáo kỹ thuật đi kèm do OpenAI thực hiện cùng các nhà nghiên cứu từ Đại học Pennsylvania và Đại học Yale.

Một ví dụ trong báo cáo mô tả cách khóa bí mật sắp xếp các dự đoán cho từ tiếp theo khi mô hình hoàn thành câu. Sau khi hàng trăm điều chỉnh nhỏ được tích lũy, bộ phát hiện có thể dùng văn bản và khóa tương ứng để nhận diện nội dung do AI tạo ra.

Cách đánh dấu này bổ sung một lớp truy xuất nguồn gốc cho nội dung do máy tạo ra, nhưng không xác định cách con người đã sử dụng hoặc biên tập nội dung. Vấn đề đó cũng xuất hiện trong các cuộc thảo luận về an toàn AI và trách nhiệm của người vận hành hệ thống.

Chỉnh sửa có thể làm suy yếu khả năng phát hiện

Dấu chìm có thể khó phát hiện hơn sau khi văn bản bị chỉnh sửa, rút ngắn hoặc dịch sang ngôn ngữ khác. Theo OpenAI, trong một thử nghiệm, việc thay 10% số từ bằng từ đồng nghĩa làm tỷ lệ phát hiện giảm từ khoảng 92% xuống 66%.

OpenAI cũng cho biết các đoạn văn ngắn, câu trả lời toán học và văn bản đã qua dịch thuật khó phát hiện hơn. Vì những hạn chế này, công ty ban đầu chỉ cung cấp bộ phát hiện cho các nhà nghiên cứu và tổ chức chuyên môn đã được phê duyệt. Các đơn vị đó sẽ hỗ trợ đánh giá độ tin cậy và cách sử dụng công cụ có trách nhiệm.

OpenAI cảnh báo rằng việc không tìm thấy dấu chìm không chứng minh văn bản do con người viết. Nội dung có thể quá ngắn, đã bị chỉnh sửa nhiều hoặc được tạo bởi hệ thống AI của một công ty khác.

Dấu chìm cũng không đo được mức độ phán đoán, công sức biên tập hoặc sáng tạo mà con người đóng góp. Nó chỉ có thể cho thấy một hệ thống của OpenAI đã tạo hoặc xử lý một phần nội dung.

OpenAI chọn phạm vi hẹp hơn Anthropic

OpenAI giới hạn đợt triển khai bắt buộc ban đầu tại Liên minh châu Âu, trong khi Anthropic cho biết sẽ đánh dấu văn bản do Claude tạo ra trên toàn thế giới. Hai cách tiếp cận khác nhau về phạm vi, dù cả hai công ty đều cam kết tuân thủ bộ quy tắc thực hành của Liên minh châu Âu.

Thông báo của OpenAI xuất hiện hai tháng sau khi Anthropic công bố kế hoạch dành cho Claude. Quyết định của Anthropic gặp phản ứng từ một số người dùng. Họ cho rằng mình đã cung cấp chỉ dẫn, bối cảnh và quyết định, còn Claude chỉ thực hiện yêu cầu.

OpenAI từng xây dựng một hệ thống đánh dấu văn bản nhưng chưa phát hành. Theo thông tin The Wall Street Journal đăng năm 2024 và được TechCrunch dẫn lại, một phần nguyên nhân là lo ngại người dùng sẽ chuyển sang đối thủ không áp dụng dấu chìm.

Anthropic, Google, Meta, Microsoft và OpenAI đều thuộc nhóm công ty cam kết tuân thủ bộ quy tắc thực hành của Liên minh châu Âu về nội dung do AI tạo ra. Với các hệ thống sinh mã như Codex, cơ chế truy xuất nguồn gốc cũng liên quan đến cách tác tử AI viết mã hoạt động trong quy trình của nhà phát triển.

Hãy tiếp tục theo dõi Sine để cập nhật cách các quy định mới thay đổi việc sử dụng nội dung do AI tạo ra tại Việt Nam.