LIÊN HỆ HOTLINE/ZALO: 0981.243.678

FBI và NSA cáo buộc 6 công ty AI Trung Quốc đánh cắp mô hình của Mỹ
Mỹ cáo buộc DeepSeek và Alibaba trích xuất dữ liệu từ ChatGPT, Claude để phát triển AI. Tìm hiểu ngay về vụ bê bối chưng cất mô hình ảnh hưởng đến an ninh quốc gia.
Ba cơ quan tình báo hàng đầu của Hoa Kỳ bao gồm FBI, NSA và CISA vừa chính thức công bố tài liệu cáo buộc DeepSeek, Alibaba cùng bốn doanh nghiệp công nghệ khác của Trung Quốc đã thực hiện các chiến dịch trích xuất năng lực từ các mô hình ngôn ngữ lớn của Mỹ. Theo báo cáo liên kết mang số hiệu AA26-251A, các công ty này bị cho là đã sử dụng phương pháp chưng cất mô hình (distillation) một cách có hệ thống để sao chép trí tuệ từ Claude, ChatGPT, Gemini và Grok. Các cơ quan an ninh nhận định đây là những hoạt động “xâm nhập, độc hại và có mục tiêu” diễn ra liên tục từ cuối năm 2024, với hàng tỷ token dữ liệu được trích xuất thông qua hàng triệu lượt truy vấn. Đáng chú ý, các báo cáo cho thấy chính quyền Bắc Kinh có khả năng đã nhận biết toàn bộ quá trình này.
Việc chưng cất mô hình vốn là một kỹ thuật phổ biến trong giới công nghệ, nơi một mô hình nhỏ hơn được huấn luyện dựa trên đầu ra của một mô hình lớn hơn. Tuy nhiên, điểm mấu chốt nằm ở quy mô và phương thức thực hiện. DeepSeek bị cáo buộc đã truy vấn đồng thời nhiều phiên bản của Claude, Gemini và ChatGPT để tạo ra dữ liệu huấn luyện tổng hợp cho các dòng mô hình R1 và R3 của mình. Tương tự, MiniMax bị cho là đã rút trích các tín hiệu suy luận chuỗi tư duy (chain-of-thought) và khả năng lập trình từ các phiên bản cao cấp nhất của Claude và Gemini. Để che giấu hành vi, các công ty này đã định tuyến yêu cầu qua các API nội địa, nhà cung cấp đám mây từ xa và các bên trung gian nhằm xóa bỏ siêu dữ liệu người dùng, gây khó khăn cho việc truy vết nguồn gốc lưu lượng truy cập.
Cuộc chiến pháp lý và hệ lụy đối với thị trường AI toàn cầu
Cáo buộc của chính phủ Mỹ không dựa trên luật bản quyền mà tập trung vào việc vi phạm điều khoản dịch vụ của các nhà cung cấp như Anthropic, OpenAI và xAI. Các nền tảng này nghiêm cấm việc trích xuất dữ liệu khối lượng lớn để xây dựng mô hình đối thủ. Sự tham gia của FBI đã nâng tầm vụ việc từ một tranh chấp kinh doanh thông thường thành một vấn đề an ninh quốc gia. Trước đó, OpenAI và Anthropic cũng từng công bố các bằng chứng về việc bị trích xuất năng lực một cách có hệ thống, nhưng đây là lần đầu tiên các cơ quan tình báo Mỹ trực tiếp ký tên vào bản cáo buộc. Điều này làm thay đổi hoàn toàn nhận định về sự đột phá của các mô hình nguồn mở Trung Quốc, khi cho rằng một phần hiệu quả của chúng không đến từ sự tối ưu hóa độc lập mà từ việc tận dụng thành quả của các phòng thí nghiệm Mỹ.
Hệ quả trực tiếp của vụ việc này có thể khiến các nhà phát triển tại Mỹ và quốc tế phải đối mặt với các rào cản kỹ thuật mới. Để bảo vệ tài sản trí tuệ, các ông lớn công nghệ có thể sẽ thắt chặt giới hạn tốc độ (rate limits) và áp dụng các điều khoản cấp phép API nghiêm ngặt hơn. Điều này vô tình gây khó khăn cho các startup chân chính khi chi phí tiếp cận công nghệ tăng cao và các quy trình xác thực trở nên phức tạp. Trong khi đó, các công ty bị nêu tên như Moonshot AI, StepFun, Z.AI vẫn chưa đưa ra phản hồi chính thức. Sự rạn nứt này dự báo một giai đoạn quản lý AI đầy biến động, nơi các yếu tố chính trị và an ninh sẽ chi phối mạnh mẽ đến lộ trình phát triển của công nghệ toàn cầu.
Sự kiện này là lời nhắc nhở quan trọng cho các doanh nghiệp và nhà phát triển về việc lựa chọn nền tảng và xây dựng chiến lược dữ liệu bền vững. Trong bối cảnh các quy định về an ninh AI ngày càng thắt chặt, việc phụ thuộc vào các mô hình có nguồn gốc không rõ ràng hoặc vướng vào tranh chấp pháp lý có thể mang lại rủi ro lớn. Các đơn vị phát triển nên ưu tiên các giải pháp có tính minh bạch cao về dữ liệu huấn luyện và tuân thủ nghiêm túc các thỏa thuận sử dụng để đảm bảo tính ổn định cho sản phẩm của mình.

Liên hệ qua Zalo