LIÊN HỆ HOTLINE/ZALO: 0981.243.678

Anthropic cáo buộc Alibaba và các công ty AI Trung Quốc thực hiện chiến dịch tấn công chưng cất mô hình quy mô lớn
Anthropic vạch trần các chiến dịch tấn công chưng cất quy mô lớn từ Alibaba, Moonshot AI và DeepSeek nhằm đánh cắp dữ liệu logic và mã nguồn từ mô hình Claude.
Báo cáo chi tiết công bố vào ngày 10 tháng 9 năm 2026 của Anthropic đã vạch trần một loạt các chiến dịch tấn công chưng cất (distillation attacks) quy mô lớn, nhắm trực tiếp vào các mô hình ngôn ngữ hàng đầu như Claude. Theo tài liệu này, các phòng thí nghiệm trí tuệ nhân tạo tại Trung Quốc, bao gồm Alibaba, Moonshot AI và DeepSeek, đã sử dụng những kỹ thuật tinh vi để vượt qua hàng rào bảo vệ nhằm thu thập năng lực cốt lõi của các mô hình biên giới từ Mỹ. Những cuộc tấn công này tập trung khai thác khả năng lập luận logic, viết mã nguồn, phân tích dữ liệu và các kỹ năng tác vụ đại lý (agentic capabilities). Tổng cộng có gần 200 triệu lượt trao đổi dữ liệu liên quan đến các chiến dịch này đã bị phát hiện, đánh dấu một giai đoạn cạnh tranh gay gắt và thiếu lành mạnh trong ngành công nghiệp AI.
Sự kiện này diễn ra ngay trước thềm hội nghị công nghệ Disrupt 2026, nơi các tên tuổi lớn như OpenAI, Anthropic và Replit sẽ cùng xuất hiện trên 6 sân khấu chuyên biệt để thảo luận về tương lai của ngành. Hiện tại, cộng đồng công nghệ có thể nhận ưu đãi giảm giá 25% khi đặt vé sớm để trực tiếp theo dõi những phân tích về an ninh và chiến lược phát triển AI bền vững.
Phương thức khai thác chuỗi tư duy và quy mô tấn công từ các phòng thí nghiệm Trung Quốc
Các chiến dịch chưng cất mô hình tập trung vào việc trích xuất chuỗi tư duy (chain of thought) từ phản hồi của mô hình để huấn luyện các mạng thần kinh nhỏ hơn thông qua phương pháp tinh chỉnh có giám sát. Thông thường, Anthropic chỉ hiển thị các khối “tư duy tóm tắt” cho người dùng, nhưng các kẻ tấn công đã tìm ra cách lừa mô hình tiết lộ toàn bộ dấu vết tư duy nội bộ. Một ví dụ điển hình là việc sử dụng các truy vấn yêu cầu mô hình đóng vai chuyên gia dịch thuật để chuyển đổi “bộ nhớ làm việc” sang tiếng Nhật dưới dạng katakana, từ đó thu được dữ liệu lập luận nguyên bản.
Chiến dịch lớn nhất được ghi nhận thuộc về Alibaba, với nỗ lực chưng cất hàng loạt chưa từng có nhằm phục vụ cho dòng mô hình Qwen. Trong khoảng thời gian từ tháng 5 đến tháng 7 năm 2026, Anthropic đã quan sát thấy 151 triệu lượt trao đổi bắt nguồn từ 3.500 tài khoản khác nhau nhưng đều sử dụng chung một cấu trúc câu lệnh (fixed prompt) để trích xuất dữ liệu. Bên cạnh đó, Moonshot AI cũng bị cáo buộc thực hiện các yêu cầu có liên quan đến mục đích quân sự, chẳng hạn như yêu cầu mô hình Claude Opus phân tích dữ liệu camera giám sát để nhận diện các hành vi bất thường.
Hành vi này không chỉ đe dọa đến quyền sở hữu trí tuệ mà còn dấy lên lo ngại về việc sử dụng công nghệ AI vào các mục đích kiểm soát an ninh nhạy cảm. Việc hàng trăm nghìn yêu cầu được điều hướng qua các mạng lưới tài khoản phức tạp cho thấy đây là những chiến dịch có sự chuẩn bị kỹ lưỡng về mặt kỹ thuật và nguồn lực.
Việc bảo vệ các mô hình AI trước những nỗ lực chưng cất trái phép đang trở thành thách thức lớn đối với các công ty công nghệ trong việc duy trì lợi thế cạnh tranh. Để hiểu rõ hơn về cách xây dựng hệ sinh thái AI an toàn và bền vững, các doanh nghiệp nên cập nhật kiến thức tại những diễn đàn uy tín như Disrupt 2026 tại San Francisco và tận dụng cơ hội tiết kiệm lên đến 300 USD khi đăng ký tham dự sớm.

Liên hệ qua Zalo