LIÊN HỆ HOTLINE/ZALO: 0981.243.678

Claude trên trình duyệt Chrome chính thức phát hành rộng rãi kèm cơ chế phòng thủ mới
Tiện ích Claude in Chrome chính thức ra mắt, hỗ trợ tự hành thao tác web an toàn với hệ thống phòng vệ đa tầng ngăn chặn tấn công prompt injection.
Tiện ích mở rộng Claude trên trình duyệt Chrome (Claude in Chrome) chính thức được phát hành rộng rãi cho tất cả người dùng các gói tài khoản trả phí. Giờ đây, Claude có khả năng tự động thực thi các hành vi điều hướng (take actions autonomously) trong trình duyệt mà không bắt buộc người dùng phải phê duyệt thủ công từng thao tác đơn lẻ. Một bộ phân loại an toàn chuyên dụng (safety classifier) sẽ tiến hành thẩm định tính hợp lệ của từng hành động trước khi thực hiện nhằm bảo đảm an toàn dữ liệu và tuân thủ đúng yêu cầu của người dùng.

Khả năng kết nối linh hoạt các hệ thống chuyên biệt
Nhiều công cụ làm việc hằng ngày đã được kết nối trực tiếp với Claude thông qua giao diện lập trình. Tuy nhiên, vẫn còn rất nhiều hệ thống mà AI chưa thể chạm tới, điển hình như các bảng điều khiển nội bộ công ty (internal dashboards), phần mềm kế thừa cũ (legacy systems) hay các cổng dịch vụ nhà cung cấp bên ngoài (vendor portals). Claude in Chrome đóng vai trò cầu nối giải quyết khoảng trống này. Tiện ích cho phép Claude quan sát trực tiếp trang web đang mở, đọc và nhập văn bản, nhấn vào các liên kết, điều hướng giữa các trang và điền biểu mẫu dựa trên các phiên đăng nhập sẵn có của người dùng.
Cơ chế phòng thủ đa tầng trước nguy cơ tấn công chèn câu lệnh
Kể từ đợt thử nghiệm giới hạn vào năm ngoái, Anthropic đã tập trung gia cố hàng rào phòng thủ trước hiểm họa tấn công chèn câu lệnh độc hại (prompt injection) — thủ thuật che giấu các chỉ lệnh nguy hiểm bên trong trang web, email hoặc tệp tài liệu nhằm lừa trợ lý AI hành động trái với ý muốn của chủ sở hữu. Ví dụ: khi bạn yêu cầu Claude soạn thảo thư trả lời email, một chỉ dẫn độc hại ngầm trong một bức thư có thể thao túng Claude tự động chuyển tiếp toàn bộ hòm thư cá nhân của bạn đến kẻ tấn công.
Để ngăn chặn nguy cơ này, hệ thống bảo mật của Claude in Chrome được xây dựng trên 3 lớp bảo vệ chuyên sâu:
- Nhận diện kho dữ liệu tấn công phong phú: Claude được huấn luyện liên tục dựa trên kho thư viện các đòn tấn công chèn câu lệnh ngày càng mở rộng, thu thập từ các công cụ tấn công giả lập tự động, đội ngũ chuyên gia kiểm thử bảo mật độc lập (red-teamers) và dữ liệu giám sát thực tế. Bất kỳ mẫu tấn công mới nào xuyên thủng được hệ thống đều được bổ sung ngay vào kho huấn luyện để tôi luyện khả năng miễn nhiễm cho các thế hệ mô hình tiếp theo.
- Đầu dò rà soát dữ liệu (probes) trước khi hành động: Nội dung trên web được truyền đến Claude thông qua kết quả phản hồi của các công cụ gọi hàm (tool results). Các đầu dò thông minh (probes) được huấn luyện để rà quét toàn bộ luồng dữ liệu trả về này nhằm phát hiện các dấu hiệu chỉ lệnh ngầm. Khi phát hiện nguy cơ tiềm ẩn, Claude sẽ được cảnh báo để đối xử thận trọng với nội dung và yêu cầu xác nhận từ người dùng trước khi tiến hành bước tiếp theo.
- Xác thực hành động tự động trước khi kích hoạt (Action verification): Tương tự như cơ chế vận hành tự động (auto mode) trên công cụ lập trình Claude Code, Claude in Chrome áp dụng bộ phân loại an toàn độc lập (safety classifier) để rà soát mọi thao tác trước khi gửi lệnh thực thi (như chuyển sang URL mới hoặc gửi biểu mẫu dữ liệu). Nếu phát hiện hành động có dấu hiệu sai lệch so với yêu cầu ban đầu của người dùng, lệnh sẽ bị chặn lập tức.
Kiểm chứng thực nghiệm khả năng phòng vệ của mô hình
Anthropic đã tiến hành các bài kiểm tra thực nghiệm nghiêm ngặt nhằm đánh giá độ bền bỉ của Claude in Chrome trước các cuộc tấn công khai thác bảo mật trong môi trường trình duyệt:

Trong bộ kiểm thử ban đầu, các mô hình thế hệ mới gồm Claude Fable 5, Claude Opus 5 và Claude Sonnet 5 đã đạt tỷ lệ vô hiệu hóa tuyệt đối: không có bất kỳ đòn tấn công nào xâm nhập thành công ngay cả khi chưa cần bật đầu dò probes hay bộ phân loại bổ sung.
Do bộ kiểm tra ban đầu đã đạt ngưỡng tối đa (tỷ lệ tấn công thành công là 0%), Anthropic đã chuyển sang một chuẩn đánh giá khắt khe hơn với các kịch bản tấn công tinh vi từ các chuyên gia bảo mật độc lập:

Ở chuẩn kiểm thử nâng cao này, nếu không có lớp bảo vệ bổ sung, tỷ lệ tấn công thành công vào mô hình gốc là 17,6% trên Opus 4.5 và 3,8% trên Opus 5. Tuy nhiên, khi kích hoạt đầy đủ hệ thống đầu dò (probes) kết hợp với bộ phân loại an toàn tự động, tất cả các cuộc tấn công đều thất bại hoàn toàn (tỷ lệ thành công 0%) trên Claude Sonnet 5, Claude Opus 5 và Claude Mythos 5. Riêng trên mô hình Fable 5, tỷ lệ tấn công thành công chỉ ở mức 0,3% và toàn bộ đều nằm trong các tình huống rủi ro mức độ thấp đã được kiểm soát.
Hướng dẫn cài đặt và khuyến nghị vận hành
Để trải nghiệm tính năng này, người dùng các gói tài khoản trả phí có thể cài đặt trực tiếp tiện ích từ Chrome Web Store. Đối với các tài khoản doanh nghiệp (Enterprise), quản trị viên có thể quản lý tập trung và thiết lập danh sách trắng (whitelisting) cho phép Claude chỉ hoạt động trên các tên miền nội bộ được phê duyệt an toàn.
Để thao tác với tệp tin cục bộ hoặc các phần mềm khác trên máy tính, người dùng vẫn cần sử dụng ứng dụng Claude máy tính để bàn (Claude desktop app). Hiện tại tiện ích Claude in Chrome chưa hỗ trợ trên các trình duyệt nền Chromium khác hoặc phiên bản di động.
Nguồn: Claude Blog (Anthropic)

Liên hệ qua Zalo