OpenAI bắt đầu gắn dấu bản quyền văn bản tạo bởi ChatGPT tại EU

OpenAI triển khai giải pháp gắn dấu ẩn lên văn bản tạo bởi ChatGPT tại Liên minh châu Âu nhằm tuân thủ quy định minh bạch của Đạo luật AI.

OpenAI thông báo bắt đầu tích hợp kỹ thuật gắn dấu bản quyền vô hình (invisible watermark) vào các đoạn văn bản được tạo bởi ChatGPT và công cụ lập trình Codex tại thị trường Liên minh châu Âu (EU), nhằm tuân thủ trực tiếp các quy chuẩn trong Đạo luật Trí tuệ Nhân tạo châu Âu (EU AI Act).

Các điều khoản minh bạch của EU AI Act có hiệu lực từ ngày 2/8 quy định các tổ chức phát triển công nghệ phải đánh dấu nội dung do máy tạo ra để hệ thống khác có thể nhận biết. Tính năng này được triển khai theo lộ trình trong vài tuần tới cho người dùng đủ điều kiện thuộc mọi gói dịch vụ tại EU. Đối với các lập trình viên sử dụng giao diện lập trình ứng dụng (API) của OpenAI trên phạm vi toàn cầu, tuỳ chọn kích hoạt đã mở từ ngày 24/3 cho một số mô hình cụ thể, nhưng mặc định tắt. Doanh nghiệp khẳng định chưa áp dụng dấu bản quyền văn bản làm cài đặt mặc định trên toàn cầu.

Nguyên lý vận hành của kỹ thuật textGrain

Dấu bản quyền này không phải là một ký tự hiển thị trực quan mà vận hành bằng cách định hướng tinh tế xác suất lựa chọn từ ngữ của mô hình ngôn ngữ lớn (LLMs). Cách tiếp cận này tạo nên một mẫu hình ẩn mà mắt thường không thể nhận biết nhưng công cụ rà soát chuyên dụng có thể giải mã. Do dấu bản quyền gắn liền với cấu trúc câu từ, dấu vết kỹ thuật vẫn được duy trì khi người dùng sao chép và dán nội dung sang nền tảng khác.

Biểu trưng OpenAI và các quy định pháp lý tại thị trường châu Âu
Quy định minh bạch của Đạo luật AI châu Âu buộc các đơn vị phát triển phải có biện pháp nhận diện nội dung do máy tạo ra.

OpenAI công bố báo cáo kỹ thuật về phương pháp mang tên textGrain, được thực hiện cùng các nhà nghiên cứu từ Đại học Pennsylvania và Đại học Yale. Giải pháp này sử dụng một mã khóa bí mật (secret key) để sắp xếp các phương án dự đoán từ kế tiếp khi hoàn thiện câu. Khi tổng hợp hàng trăm điều chỉnh xác suất này, công cụ đối soát có thể xác định văn bản do AI sinh ra chỉ bằng nội dung và mã khóa tương ứng. Phía nhà phát triển cho biết kỹ thuật không định danh người dùng cụ thể và không làm suy giảm hiệu năng sinh văn bản của mô hình.

Giới hạn kỹ thuật và khả năng phát hiện

Khả năng duy trì dấu ẩn bị suy giảm rõ rệt khi văn bản trải qua quá trình chỉnh sửa thủ công. Thử nghiệm nội bộ của OpenAI chỉ ra rằng nếu thay thế 10% lượng từ vựng bằng từ đồng nghĩa, độ chính xác của công cụ phát hiện giảm từ khoảng 92% xuống còn 66%. Các đoạn văn ngắn, lời giải toán học hoặc nội dung dịch thuật đa ngôn ngữ cũng là những trường hợp rất khó để truy vết.

Xuất phát từ những rào cản này, OpenAI ban đầu chỉ cấp quyền tiếp cận công cụ phát hiện cho các tổ chức chuyên môn và nhà nghiên cứu được phê duyệt nhằm đánh giá mức độ tin cậy. Doanh nghiệp nhấn mạnh việc không tìm thấy dấu ẩn không đồng nghĩa với việc văn bản hoàn toàn do con người chắp bút, bởi dữ liệu có thể bị biên tập kỹ lưỡng hoặc sinh ra từ một hệ thống của đối thủ cạnh tranh.

Áp lực cạnh tranh và cam kết tuân thủ pháp lý

Động thái của OpenAI diễn ra hai tháng sau khi Anthropic áp dụng gắn dấu bản quyền văn bản trên toàn cầu cho mô hình Claude. Quyết định của Anthropic từng vấp phải phản ứng từ người dùng, những người cho rằng họ là bên cung cấp ngữ cảnh và đưa ra quyết định sáng tạo, trong khi mô hình chỉ đóng vai trò phương tiện hỗ trợ.

Vào năm 2024, The Wall Street Journal từng đưa tin OpenAI đã phát triển xong công cụ gắn dấu bản quyền văn bản nhưng trì hoãn thương mại hóa vì lo ngại rủi ro mất thị phần vào tay các đối thủ cạnh tranh không gắn nhãn. Hiện tại, cùng với Anthropic, Google, Meta và Microsoft, OpenAI đã cam kết thực thi bộ quy tắc ứng xử của EU đối với nội dung do trí tuệ nhân tạo tạo ra.

Nguồn: TechCrunch

Chính sách hỗ trợ doanh nghiệp
LIÊN HỆ TƯ VẤN CÁC DỊCH VỤ AI
Hỗ trợ tư vấn, đào tạo và chuyển giao AI cho cá nhân, doanh nghiệp và tổ chức.
Chat Zalo Chat Zalo
Gọi ngay Chat