Giám đốc khoa học OpenAI cảnh báo chưa phòng thí nghiệm nào đủ an toàn để mở rộng AI

GPT-6 Astra ra mắt cùng cảnh báo từ Jakub Pachocki về rủi ro an toàn AI. Tìm hiểu mâu thuẫn giữa tăng trưởng và kiểm soát tại OpenAI để phát triển bền vững.

Ngày 6 tháng 9, chỉ ba ngày sau khi OpenAI tung ra GPT-6 Astra – mô hình ngôn ngữ mạnh mẽ nhất từ trước đến nay, giám đốc khoa học Jakub Pachocki đã đăng tải bài luận mang tên “An Alien Mind”. Trong đó, ông thẳng thắn thừa nhận một thực tế đáng quan ngại: chưa một phòng thí nghiệm hàng đầu nào, kể cả OpenAI, giải quyết triệt để vấn đề an toàn để có thể tiếp tục mở rộng quy mô AI một cách vô hạn. Lời cảnh báo này không đến từ một đối thủ cạnh tranh hay một nhóm chính sách bên ngoài, mà xuất phát từ chính người đứng đầu bộ phận nghiên cứu của công ty đang dẫn dắt cuộc đua. Sự xuất hiện của Astra đánh dấu cột mốc quan trọng khi mô hình này đạt ngưỡng “Critical” (Nguy cấp) về khả năng an ninh mạng theo Khung chuẩn bị (Preparedness Framework) của OpenAI. Với khả năng tự tìm kiếm lỗ hổng bảo mật và khai thác các hệ thống phức tạp mà không cần sự can thiệp liên tục của con người, Astra đã chứng minh được sức mạnh vượt trội nhưng cũng đầy rủi ro. Việc Pachocki lên tiếng ngay thời điểm thương mại hóa sản phẩm cho thấy một sự mâu thuẫn nội tại sâu sắc giữa áp lực tăng trưởng và trách nhiệm kiểm soát công nghệ.

Khi rào cản an toàn trở thành điều kiện bắt buộc để phát triển

Thay vì chỉ kêu gọi sự tự nguyện, Jakub Pachocki đề xuất rằng các cam kết như Khung chuẩn bị của OpenAI hay Chính sách mở rộng quy mô có trách nhiệm của Anthropic cần trở thành những tiêu chuẩn an toàn bắt buộc. Ông nhấn mạnh việc thực thi phải được giám sát bởi các kiểm toán viên bên thứ ba hoặc các cơ quan quốc tế, thay vì để các phòng thí nghiệm tự điều chỉnh. Quan điểm này đặt sự tin tưởng vào hệ thống giám sát làm thước đo cho tốc độ phát triển, thay vì chạy đua theo các điểm số benchmark mới. Đáng chú ý, CEO Sam Altman đã chia sẻ lại bài viết này và gọi đây là một thông điệp quan trọng, cho thấy OpenAI đang chấp nhận một vị thế tiến thoái lưỡng nan: vừa thúc đẩy giới hạn công nghệ, vừa thừa nhận nhu cầu về một giới hạn bên ngoài.

Sự mâu thuẫn này càng hiện rõ qua các con số thương mại. Astra hiện có mức giá cao gấp 2,5 lần so với phiên bản tiền nhiệm, nhắm thẳng vào các khách hàng doanh nghiệp trên các nền tảng như Microsoft AzureAWS Bedrock. Trong khi Chủ tịch Greg Brockman nhận định ngành công nghiệp đã bước vào kỷ nguyên AGI, thì lời cảnh báo của Pachocki nhắc nhở rằng khả năng giám sát chuỗi tư duy (chain-of-thought monitoring) đang dần suy giảm khi các mô hình bắt đầu biết tự lập luận về quá trình suy nghĩ của chính chúng. Điều này có nghĩa là các tác nhân AI trong tương lai có thể lừa dối, mặc cả hoặc theo đuổi các mục tiêu nằm ngoài ý muốn của người vận hành nếu không có các biện pháp kiểm soát chặt chẽ và độc lập.

Lời cảnh báo từ bên trong OpenAI đã xóa bỏ sự tự mãn rằng các hệ thống hiện tại là đủ an toàn để mở rộng không giới hạn. Đối với các doanh nghiệp đang tích hợp Astra vào quy trình vận hành, việc coi “tính liên kết” (alignment) là một lời hứa mặc định từ nhà sản xuất có thể dẫn đến những sai lầm chiến lược. Thay vào đó, người dùng cần chủ động yêu cầu sự minh bạch về các tính năng bị hạn chế, cơ chế giám sát thực tế và các kịch bản ứng phó khi AI vượt quá phạm vi cho phép. Khi ranh giới giữa công cụ hỗ trợ và tác nhân tự trị trở nên mong manh, việc thiết lập các hàng rào kỹ thuật riêng biệt cho từng tổ chức là bước đi thiết yếu để bảo vệ tài sản và dữ liệu trước những rủi ro chưa thể lường trước.

Chính sách hỗ trợ doanh nghiệp
LIÊN HỆ TƯ VẤN CÁC DỊCH VỤ AI
Hỗ trợ tư vấn, đào tạo và chuyển giao AI cho cá nhân, doanh nghiệp và tổ chức.
Chat Zalo Chat Zalo
Gọi ngay Chat