Việc OpenAI triển khai textGrain trực tiếp đáp ứng yêu cầu của Đạo luật AI EU, theo đó nội dung do AI tạo ra phải có thể được nhận diện bằng máy. Về nguyên lý, textGrain điều chỉnh lựa chọn token của mô hình để chuỗi đầu ra tạo thành một mẫu thống kê có thể phát hiện. Dấu thủy vân này vô hình với người đọc và được thiết kế để công cụ phát hiện có thể nhận diện; OpenAI sẽ cấp quyền sử dụng có chọn lọc. Với các nhóm sản phẩm và tuân thủ, ý nghĩa trước mắt rất rõ: giờ đây đã có một cơ chế đạt tiêu chuẩn ngành để báo hiệu sự tham gia của mô hình vào quá trình tạo văn bản, nhưng đặc tính và giá trị pháp lý của cơ chế này vẫn có giới hạn, tùy thuộc vào bối cảnh.
Các đánh giá thực nghiệm cho thấy textGrain hoạt động tốt trong điều kiện lý tưởng: tỷ lệ phát hiện tăng theo độ dài đoạn văn và mức độ linh hoạt của vốn từ. Khi đặt ngưỡng dương tính giả ở mức thận trọng, tỷ lệ phát hiện đạt khoảng giữa 90% với các đoạn dài, không bị giới hạn về cách diễn đạt, nhưng giảm còn khoảng 80% với đoạn ngắn 200 token và thấp hơn đáng kể ở những lĩnh vực có lựa chọn từ ngữ hạn chế như toán học. Việc biên tập hoặc viết lại một phần làm giảm mạnh khả năng phát hiện: chỉ cần thay một tỷ lệ vừa phải các từ bằng từ đồng nghĩa, kết quả có thể chuyển từ phát hiện tốt sang kém. Những đặc điểm này tạo ra các điểm mù có thể dự đoán trong thực tế và khi tuân thủ pháp lý.
Kế hoạch triển khai của OpenAI cân bằng giữa nghĩa vụ pháp lý và sự thận trọng về kỹ thuật. Khách hàng API trên toàn cầu có thể chọn bật dấu thủy vân cho đầu ra, trong khi công ty sẽ tự động áp dụng textGrain cho các đầu ra đủ điều kiện của ChatGPT và Codex tại EU. Thay vì mở công cụ phát hiện cho công chúng, ban đầu OpenAI chỉ cấp quyền cho các nhà nghiên cứu và tổ chức chuyên môn được phê duyệt để nghiên cứu hiệu quả cũng như giới hạn của công cụ. Mô hình truy cập hạn chế này phản ánh rủi ro rằng kết quả dương tính giả hoặc không phát hiện được dấu thủy vân có thể dẫn đến việc thực thi quy định hoặc kiểm duyệt nền tảng sai lệch; đồng thời nhấn mạnh rằng cần xem xét kết quả phát hiện cùng với các tín hiệu khác.
Trên thực tế, xác minh nguồn gốc văn bản khó hơn hình ảnh hoặc âm thanh vì ngôn ngữ dễ chỉnh sửa, nén, dịch và diễn đạt lại — những thao tác nhanh chóng làm suy yếu tín hiệu thống kê. Dấu thủy vân hình ảnh và thông tin xác thực của tệp có thể tồn tại ngay cả khi siêu dữ liệu bị xóa hoặc tệp được nén lại; còn văn bản không có “vật chứa” cố định, và nội dung có thể được viết lại mà không để lại lớp thông tin nguồn gốc bền vững. Vì vậy, các nhà hoạch định cần xem việc đóng dấu thủy vân là một phần trong chiến lược xác minh nguồn gốc nhiều lớp: siêu dữ liệu, thông báo cho người dùng, tín hiệu hành vi và biện pháp kiểm soát của nền tảng vẫn là những yếu tố bổ trợ cần thiết cho textGrain.


