LIÊN HỆ HOTLINE/ZALO: 0981.243.678
Abliteration.ai thương mại hóa dịch vụ gỡ bỏ rào cản an toàn của AI
Tìm hiểu về Abliteration.ai, dịch vụ loại bỏ rào cản an toàn AI cho tấn công mạng và red-teaming. Khám phá rủi ro bảo mật và thách thức từ AI không kiểm soát.
Startup Abliteration.ai vừa chính thức thương mại hóa kỹ thuật abliteration, một phương pháp loại bỏ xu hướng từ chối các yêu cầu gây hại của những mô hình ngôn ngữ lớn. Thay vì chỉ tồn tại như một thủ thuật trong cộng đồng mã nguồn mở, dịch vụ này cho phép người dùng truy cập các phiên bản chỉnh sửa của những mô hình mạnh mẽ, điển hình là GLM-4, trực tiếp qua trình duyệt hoặc API. Việc loại bỏ các rào cản an toàn (guardrails) giúp AI sẵn sàng thực hiện những tác vụ mà các phiên bản thương mại thông thường như ChatGPT hay Claude sẽ từ chối. Điều này làm giảm đáng kể rào cản kỹ thuật cho những ai muốn khai thác sức mạnh của AI mà không bị giới hạn bởi các quy tắc đạo đức hay an toàn hệ thống.
Mục tiêu cốt lõi mà đội ngũ sáng lập hướng tới là hỗ trợ các hoạt động tấn công mạng (offensive cyber), diễn tập thực chiến (red-teaming) và kiểm thử tác vụ mà các mô hình khác không đáp ứng. Lập luận của công ty dựa trên nguyên lý an ninh mạng kinh điển: bạn không thể phòng thủ trước một hành vi nếu không thể tái hiện hành vi đó. Tuy nhiên, tính sẵn duyệt của dịch vụ này cũng mở ra cánh cửa cho các mục đích nguy hiểm. Trong các thử nghiệm thực tế, mô hình đã bị loại bỏ rào cản có thể dễ dàng cung cấp mã nguồn đánh cắp mật khẩu hoặc các quy trình sinh học nhạy cảm. Sự xuất hiện của Abliteration.ai đánh dấu bước chuyển dịch từ các thử nghiệm ngầm sang một mô hình kinh doanh dịch vụ sẵn có, đặt ra bài toán khó cho các nhà quản lý về việc kiểm soát công nghệ AI lưỡng dụng.
Thách thức giữa mục tiêu bảo mật và rủi ro lạm dụng công nghệ
Sự ra đời của các mô hình AI “không kiểm soát” tạo ra một cuộc tranh luận gay gắt về ranh giới giữa tự do nghiên cứu và an toàn công cộng. Những người ủng hộ, bao gồm nhà sáng lập Devon của Abliteration.ai, tin rằng việc dân chủ hóa quyền truy cập vào các mô hình không bị kiểm duyệt là cách tốt nhất để xây dựng hệ thống phòng thủ vững chắc. Bằng cách mô phỏng chính xác hành vi của những kẻ tấn công, các chuyên gia bảo mật tại ngân hàng hay hãng hàng không có thể tìm ra lỗ hổng trước khi chúng bị khai thác thực tế. Tuy nhiên, các chuyên gia an toàn AI từ các tổ chức như CivAI lại cảnh báo rằng việc này giống như tạo ra một “AI phản xã hội”, sẵn sàng tuân lệnh bất kể hậu quả, từ đó làm tăng nguy cơ xảy ra các cuộc tấn công mạng quy mô lớn hoặc phát tán thông tin độc hại.
Hiện tại, Abliteration.ai vẫn chưa áp dụng các quy trình xác thực danh tính khách hàng (KYC) nghiêm ngặt mà chỉ dừng lại ở việc lưu nhật ký thẻ tín dụng. Mặc dù nền tảng có tích hợp một lớp kiểm duyệt tùy chọn và đang nỗ lực ngăn chặn các nội dung liên quan đến bạo lực cực đoan, nhưng khả năng kiểm soát thực tế vẫn còn là dấu hỏi lớn. Trước tình hình này, nhiều chuyên gia đề xuất chính phủ cần can thiệp vào các mắt xích khác trong chuỗi cung ứng, chẳng hạn như yêu cầu các đơn vị cho thuê GPU hiệu năng cao phải xác minh danh tính người dùng hoặc buộc các nhà cung cấp dịch vụ AI chạy các bộ phân loại để phát hiện hoạt động chế tạo vũ khí sinh học và tấn công mạng. Cuộc chạy đua giữa năng lực tấn công và khả năng phòng thủ trong kỷ nguyên AI đang bước sang một giai đoạn mới, nơi sự minh bạch và trách nhiệm của doanh nghiệp trở thành yếu tố then chốt.
Sự trỗi dậy của các dịch vụ như Abliteration.ai cho thấy nỗ lực ngăn chặn việc gỡ bỏ rào cản an toàn trên các mô hình mã nguồn mở là gần như không thể về mặt kỹ thuật. Thay vì cố gắng cấm đoán một xu hướng tất yếu, các tổ chức và doanh nghiệp cần chủ động nâng cao năng lực quản trị rủi ro AI và cập nhật các kịch bản phòng thủ trước những mối đe dọa mới. Việc theo dõi sát sao các chuyển động từ phía cơ quan quản lý và trang bị kiến thức về bảo mật AI sẽ là hành động thiết thực nhất để bảo vệ hệ thống dữ liệu trong một môi trường công nghệ ngày càng phức tạp và thiếu đi những ranh giới an toàn tuyệt đối.

Liên hệ qua Zalo