OpenAI đưa dấu chìm văn bản vào API, mặc định tắt

OpenAI cho phép khách hàng API bật dấu chìm văn bản textGrain nhưng để tính năng này tắt theo mặc định, khác với cách Anthropic triển khai cho Claude.

Biểu đồ tỷ lệ phát hiện dấu chìm theo độ dài và loại văn bản
Độ dài và loại nội dung ảnh hưởng đến khả năng phát hiện.

OpenAI đã cho phép khách hàng API chủ động bật textGrain, hệ thống dấu chìm dành cho văn bản do các mô hình được hỗ trợ tạo ra. Theo The New Stack, tính năng này được cung cấp trên toàn cầu nhưng bị tắt theo mặc định. Anthropic chọn cách khác khi áp dụng dấu chìm ở cấp mô hình cho Claude trên toàn cầu.

TextGrain tạo tín hiệu thống kê bằng cách tác động nhẹ đến lựa chọn từ của mô hình. Khi nhiều từ đều phù hợp với một câu, hệ thống có thể ưu tiên một từ nhất định. Qua một đoạn văn đủ dài, các lựa chọn đó hình thành mẫu mà công cụ phát hiện của OpenAI có thể nhận ra.

Khách hàng API phải tự bật textGrain

TextGrain không tự động hoạt động trên OpenAI API. Khách hàng phải bật tính năng ở cấp dự án hoặc tổ chức và có thể chọn những mô hình sẽ dùng dấu chìm. Sau khi thiết lập, nhà phát triển không phải sửa từng yêu cầu gửi đến API.

OpenAI cho biết dấu chìm sẽ tiếp tục bị tắt theo mặc định trong API. Khách hàng có thể tự quyết định cách dùng dấu chìm để đáp ứng nghĩa vụ minh bạch. Họ cũng có thể cân nhắc trải nghiệm cung cấp cho người dùng.

Trong những tuần tới, OpenAI dự kiến tự động thêm dấu chìm vào phần văn bản đủ điều kiện do ChatGPT và Codex tạo ra tại Liên minh châu Âu. Động thái này nhằm đáp ứng các yêu cầu minh bạch mới trong Đạo luật AI của Liên minh châu Âu.

Anthropic áp dụng dấu chìm theo cách khác

Anthropic áp dụng dấu chìm ở cấp mô hình cho các mô hình Claude được hỗ trợ. Hãng không để từng khách hàng API tự lựa chọn. Tín hiệu xuất hiện trong sản phẩm Claude, Claude Code và nội dung do nhà phát triển tạo qua API.

Anthropic cho biết họ triển khai dấu chìm trên toàn cầu vì chưa có cách đáng tin cậy để giới hạn công nghệ theo khu vực. Tài liệu của Anthropic về cách Claude đánh dấu nội dung AI cho biết tín hiệu xuất hiện trên mọi sản phẩm và giao diện của Claude. Anthropic không mô tả một lựa chọn tắt tương đương dành cho nhà phát triển API.

Khác biệt chính nằm ở quyền kiểm soát. OpenAI để khách hàng API lựa chọn có bật textGrain hay không, còn Anthropic đưa dấu chìm vào đầu ra của các mô hình được hỗ trợ trên toàn cầu. Với các doanh nghiệp Việt Nam tích hợp mô hình qua API, chính sách dấu chìm vì thế có thể khác nhau tùy nhà cung cấp, ngay cả khi sản phẩm cuối cùng đều tạo văn bản cho người dùng.

OpenAI đã xác thực nội dung hình ảnh và âm thanh

TextGrain mở rộng các biện pháp xác định nguồn gốc mà OpenAI đã áp dụng cho hình ảnh và âm thanh. Các biện pháp này gồm thông tin xác thực nội dung, dấu chìm SynthID và API xác minh nguồn gốc cho những định dạng được hỗ trợ.

Năm 2024, OpenAI bắt đầu thêm thông tin xác thực nội dung vào hình ảnh tạo sinh theo tiêu chuẩn mở của Liên minh Xác thực và Nguồn gốc Nội dung. Thông tin xác thực ghi lại nguồn gốc và lịch sử của tệp.

Theo OpenAI, hãng bổ sung dấu chìm SynthID của Google cho hình ảnh được hỗ trợ vào tháng 5 năm 2026 và cho âm thanh vào tháng 7. Công ty cũng cung cấp API xác minh nguồn gốc nội dung để kiểm tra những tín hiệu này trong hình ảnh và âm thanh được hỗ trợ.

OpenAI cho biết hãng tự phát triển textGrain để cân bằng khả năng phát hiện dấu chìm với mức độ đa dạng của câu trả lời. Những câu trả lời này có thể được tạo từ cùng một yêu cầu. Trong thử nghiệm của công ty, textGrain đạt kết quả phát hiện bằng hoặc cao hơn SynthID. OpenAI cũng dự định công bố mã nguồn để các bên khác có thể tiếp tục phát triển công nghệ dấu chìm văn bản.

Tín hiệu mạnh hơn trong đoạn văn dài

TextGrain dễ được phát hiện hơn trong văn xuôi dài vì mô hình có nhiều lựa chọn từ phù hợp để tạo mẫu thống kê. Hệ thống kém hiệu quả hơn với văn bản ngắn và nội dung bị ràng buộc chặt, chẳng hạn toán học hoặc mã nguồn.

Theo OpenAI, công cụ phát hiện hoạt động với tỷ lệ dương tính giả mục tiêu là 1%. Trong những lĩnh vực như tâm lý học, công cụ nhận ra khoảng 80% đoạn có dấu chìm dài 200 token và 95% đoạn dài 400 token. Công ty cảnh báo rằng văn bản ngắn có thể không chứa đủ dữ liệu để công cụ xác định dấu chìm một cách đáng tin cậy.

Giới hạn này đáng chú ý với các hệ thống tạo nội dung ngắn và những sản phẩm dựa trên tác tử AI viết mã. Dấu chìm không phải nhãn nhìn thấy bằng mắt thường. Đây là mẫu thống kê cần đủ lượng văn bản để phân tích.

Chỉnh sửa có thể làm dấu chìm suy yếu nhanh

Việc thay từ có thể làm tỷ lệ phát hiện textGrain giảm mạnh. Trong thử nghiệm của OpenAI với đoạn văn dài 400 token, thay 10% số từ bằng từ đồng nghĩa làm tỷ lệ phát hiện giảm từ khoảng 92% xuống 66%. Khi thay 25% số từ, tỷ lệ còn 17%.

Biểu đồ mức suy giảm phát hiện dấu chìm sau khi thay thế từ
Việc thay từ làm tín hiệu textGrain suy yếu rõ rệt.

Kết quả này cho thấy textGrain không phải bằng chứng bất biến về nguồn gốc văn bản. Nội dung qua nhiều vòng biên tập có thể mất phần đáng kể tín hiệu ban đầu. Công cụ phát hiện vì thế cần được đánh giá về cả trường hợp bỏ sót và dương tính giả, thay vì được xem như kết luận duy nhất.

Với các tòa soạn và nhóm truyền thông phải xử lý số lượng nội dung lớn, việc xác minh nguồn gốc thông tin vẫn cần quy trình biên tập riêng. Dấu chìm có thể bổ sung tín hiệu kỹ thuật, nhưng kết quả thử nghiệm của OpenAI cho thấy tín hiệu đó không phải lúc nào cũng tồn tại sau chỉnh sửa.

Mã nguồn là trường hợp khó hơn

Mã nguồn khó gắn dấu chìm hơn văn xuôi vì mô hình có ít lựa chọn hợp lý hơn cho token tiếp theo. Việc thay một token có thể ảnh hưởng đến hành vi của chương trình, trong khi văn bản tự nhiên thường cho phép thay từ mà vẫn giữ nguyên ý nghĩa.

Giới hạn này khiến kế hoạch triển khai cho Codex tại Liên minh châu Âu cần được theo dõi. OpenAI dự định tự động gắn dấu chìm cho đầu ra văn bản Codex đủ điều kiện, nhưng chưa giải thích cụ thể thế nào là đủ điều kiện hoặc liệu dấu chìm có áp dụng trực tiếp cho mã được tạo hay không.

Anthropic cũng gặp giới hạn tương tự với Claude. Mã nguồn tạo ra ít cơ hội chèn tín hiệu mà không làm thay đổi cách chương trình vận hành. Phần ngôn ngữ tự nhiên bên trong mã, chẳng hạn chú thích, dễ gắn dấu chìm hơn. Vấn đề này liên quan trực tiếp đến cuộc tranh luận về cách AI thay đổi hoạt động rà soát mã. Khả năng xác định nguồn gốc không đồng nghĩa với việc mã đã được kiểm tra về chất lượng hoặc an toàn.

Thử nghiệm chưa cho thấy hiệu năng viết mã suy giảm

Trong các bộ đánh giá được OpenAI công bố, việc bật textGrain không tạo ra khác biệt đáng kể về hiệu năng của mô hình Astra. Các phép thử tập trung vào lập trình và tác tử, gồm DeepSWE, AutomationBench và Terminal-Bench.

Kết quả này cho thấy textGrain có thể được bật mà không làm giảm đáng kể khả năng viết mã của Astra trong các phép thử nói trên. Tuy nhiên, thử nghiệm không cho biết mã được tạo sau đó có thể được nhận diện là mang dấu chìm với độ tin cậy ra sao.

Bật dấu chìm không đồng nghĩa được dùng công cụ phát hiện

Khách hàng API có thể bật textGrain nhưng không tự động được dùng công cụ phát hiện của OpenAI. Ở giai đoạn đầu, công ty giới hạn quyền truy cập cho các tổ chức nghiên cứu và học thuật đã được phê duyệt, tập trung vào nguồn gốc văn bản và độ tin cậy của việc phát hiện.

Quyền truy cập này có thể giúp giới nghiên cứu kiểm tra dấu chìm còn tồn tại ra sao sau biên tập hoặc các biến đổi khác. Họ cũng có thể xác định những điều kiện khiến hệ thống báo dương tính giả hoặc bỏ sót văn bản đã được đánh dấu.

Với doanh nghiệp sử dụng API, lựa chọn thực tế hiện nay chủ yếu là có bật dấu chìm hay không. Lựa chọn đó chưa bao gồm khả năng tự kiểm tra mọi đầu ra bằng bộ phát hiện chính thức.

Hãy tiếp tục theo dõi Sine để cập nhật cách dấu chìm văn bản ảnh hưởng đến sản phẩm AI, quy trình biên tập và việc xác minh nội dung tại Việt Nam.