LIÊN HỆ HOTLINE/ZALO: 0981.243.678

Meta triển khai công cụ AI phát hiện quảng cáo ngụy trang dẫn dụ đến nội dung ấu dâm
Meta ứng dụng mô hình ngôn ngữ lớn nhằm ngăn chặn các quảng cáo ngụy trang dẫn dụ người dùng tới nội dung lạm dụng tình dục trẻ em ngoài nền tảng.
Trong nửa đầu năm 2026, Meta đã xử lý 33,2 triệu nội dung liên quan đến hành vi bóc lột tình dục trẻ em trên hai nền tảng Facebook và Instagram. Đáng chú ý, hệ thống tự động của tập đoàn đã phát hiện hơn 97% số vi phạm này trước khi người dùng kịp gửi báo cáo. Riêng tại thị trường Ấn Độ, Meta đã can thiệp vào 5,3 triệu nội dung độc hại tương tự, với tỷ lệ phát hiện chủ động đạt hơn 98%.
Nhận diện kỹ thuật điều hướng độc hại bằng mô hình ngôn ngữ lớn
Song song với các biện pháp xử lý trực tiếp, Meta bắt đầu triển khai các công cụ trí tuệ nhân tạo mới nhằm phát hiện những tài khoản và chiến dịch quảng cáo bề ngoài vô hại nhưng thực chất lại ngầm dẫn dắt người dùng đến các tài liệu xâm hại trẻ em trên không gian mạng bên ngoài.
Trọng tâm của đợt nâng cấp này là hệ thống mô hình ngôn ngữ lớn (LLMs – Large Language Models) chuyên biệt, được thiết kế để nhận diện hành vi “chỉ dẫn ngụy trang” (signposting). Đây là thủ đoạn mà các đối tượng xấu sử dụng khi nội dung bài quảng cáo không chứa hình ảnh vi phạm nhằm vượt qua kiểm duyệt tự động, nhưng lại hoạt động như một cổng trung chuyển đưa người dùng sang các trang web lưu trữ nội dung lạm dụng tình dục trẻ em.

Trước sự thay đổi phương thức của kẻ xấu, Meta cho biết hệ thống kiểm duyệt giờ đây không chỉ phân tích câu chữ và hình ảnh trong mẫu quảng cáo mà còn chủ động truy vết điểm đến thực tế mà quảng cáo hướng tới. Khi xác định đích đến vi phạm chính sách, nền tảng sẽ chặn toàn bộ tên miền liên quan và khóa vĩnh viễn các tài khoản khởi tạo chiến dịch.
Chủ động rà soát lỗ hổng với tác tử AI kiểm thử xâm nhập
Bên cạnh việc quét nội dung thông thường, Meta tích hợp thêm tác tử AI kiểm thử xâm nhập (red-teaming AI agent). Công cụ này hoạt động bằng cách chủ động mô phỏng các đòn tấn công nhằm tìm kiếm lỗ hổng trong chính hàng rào phòng thủ của Meta, giúp đội ngũ kỹ sư vá các điểm yếu bảo mật trước khi tội phạm mạng kịp khai thác trên diện rộng.
Hệ thống nhận diện hành vi cũng được tối ưu hóa để ngăn chặn các đối tượng cố tình tạo lập tài khoản mới sau khi tài khoản cũ đã bị xóa sổ do vi phạm chính sách nghiêm trọng.
Áp lực pháp lý thúc đẩy siết chặt an toàn thanh thiếu niên
Các động thái kỹ thuật mới được đưa ra trong bối cảnh Meta tiếp tục đối mặt với làn sóng chỉ trích gay gắt từ các cơ quan lập pháp và giới chức quản lý về mức độ an toàn cho người dùng nhỏ tuổi. Vào tháng 8, Meta đã chấp thuận chi trả tới 18 tỷ USD để dàn xếp vụ kiện tập thể liên quan đến vấn đề bảo vệ trẻ em trên môi trường trực tuyến với 29 bang tại Mỹ.
Trước đó, tập đoàn đã giới thiệu hàng loạt tính năng kiểm soát dành cho phụ huynh, bao gồm công cụ giám sát Meta AI, tài khoản dành riêng cho lứa tuổi tiền thiếu niên trên WhatsApp, cùng các cảnh báo gửi đến cha mẹ khi con cái tìm kiếm nội dung liên quan đến tự hại trên Instagram. Trên ứng dụng WhatsApp, phụ huynh hiện có thể giới hạn cách con em theo dõi Kênh (Channels), kiểm soát quyền hiển thị trạng thái và quyết định đối tượng được phép thêm trẻ vào các nhóm trò chuyện.
Nguồn: TechCrunch

Liên hệ qua Zalo