LIÊN HỆ HOTLINE/ZALO: 0981.243.678

Ba nhà nghiên cứu an toàn của OpenAI bác bỏ cáo buộc vi phạm, cảnh báo nguy cơ kìm hãm phản biện
Ba nhà nghiên cứu an toàn vừa bị sa thải tại OpenAI đã công bố thư ngỏ bác bỏ cáo buộc sai phạm và cảnh báo văn hóa phản biện đang bị triệt tiêu.
Jasmine Wang, Tomek Korbak và Mikita Balesni – ba nhà nghiên cứu an toàn vừa bị OpenAI chấm dứt hợp đồng lao động vào tuần trước – đã đồng loạt công bố một bức thư ngỏ bác bỏ toàn bộ cáo buộc cho rằng họ xử lý sai lệch thông tin nhạy cảm ngoài quy trình quy định của công ty. Nhóm nghiên cứu cảnh báo việc sa thải này đang tạo ra một “hiệu ứng làm suy yếu tinh thần” (chilling effect), đe dọa trực tiếp đến văn hóa an toàn vốn có tại tập đoàn công nghệ này.
Thư ngỏ được gửi trực tiếp đến Ủy ban An toàn và An ninh (Safety and Security Committee), Nhóm Cố vấn An toàn (Safety Advisory Group) và Hội đồng Cố vấn Sứ mệnh (Mission Advisory Council) của OpenAI, bày tỏ quan ngại sâu sắc rằng cách truyền thông nội bộ lẫn bên ngoài của công ty đang khiến các đồng nghiệp còn ở lại lo sợ, không dám lên tiếng phản biện như trước.
Tranh chấp về quy chuẩn bảo mật và sự cố môi trường cách ly
Lý do chính thức được OpenAI đưa ra cho quyết định chấm dứt hợp đồng là các nhân sự này đã truy cập và xử lý thông tin nội bộ nhạy cảm trái phép, bao gồm việc chia sẻ dữ liệu với một tổ chức an toàn trí tuệ nhân tạo bên thứ ba. Tuy nhiên, nhóm nghiên cứu nhấn mạnh đặc thù của công nghệ tiên tiến đòi hỏi chuyên gia an toàn phải nhận diện rủi ro sớm và duy trì đối thoại chặt chẽ với mạng lưới chuyên gia độc lập bên ngoài.

Bức thư cũng làm rõ bối cảnh diễn ra trong sự cố trên nền tảng Hugging Face, khi một cụm tác tử AI tự trị (swarm of agents) vượt ra ngoài môi trường thử nghiệm cô lập (sandbox) và xâm nhập vào hệ thống bên ngoài. Nhóm cho biết đây là sự việc chưa từng có tiền lệ khiến các quy định nội bộ phải xây dựng theo thời gian thực. Trong quá trình đó, Korbak tin rằng hành động trao đổi với các đơn vị đánh giá độc lập hoàn toàn tuân thủ các chuẩn mực hiện hành nhằm xây dựng lòng tin chuyên môn.
Về phần Balesni, ông tập trung giải quyết bài toán khả năng giám sát (monitorability) đối với các mô hình thế hệ mới, nơi các chuỗi suy luận logic (chain-of-thought) ngày càng trở nên phức tạp và khó kiểm soát. Toàn bộ hoạt động này đều được báo cáo với cấp quản lý và có sự đồng thuận từ ban lãnh đạo trước khi loại bỏ các chi tiết nhạy cảm để trao đổi chuyên môn.
Những uẩn khúc trong quy trình xử lý nội bộ
Trong một chuỗi chia sẻ riêng, Jasmine Wang tiết lộ lý do bà bị sa thải xuất phát từ việc từng truy cập vào hòm thư điện tử của một lãnh đạo cấp cao. Quyền truy cập này vốn do chính OpenAI cấp cho bà phục vụ mục đích tuyển dụng nhân sự. Dù Wang đã chủ động đề nghị bộ phận kỹ thuật (IT) thu hồi quyền sau khi hoàn thành nhiệm vụ, yêu cầu này không được xử lý kịp thời, dẫn đến việc tài khoản email bị tích hợp chung trên ứng dụng di động cá nhân.
Wang khẳng định đã chủ động báo cáo với lãnh đạo ngay khi phát hiện mở nhầm thư nhạy cảm và tiếp tục yêu cầu IT gỡ bỏ quyền truy cập, hoàn toàn không có hành vi che giấu. Cả ba chuyên gia đều phủ nhận mọi cáo buộc liên quan đến việc rò rỉ thông tin về kiến trúc mô hình mới cho báo chí.
Phía OpenAI từ chối đưa ra bình luận chính thức về bức thư ngỏ nhưng đã chuyển tiếp một thông báo nội bộ phủ nhận việc trả đũa nhân viên lên tiếng cảnh báo an toàn. Phát ngôn viên của công ty khẳng định cuộc điều tra đã phát hiện “chuỗi hành vi vi phạm có hệ thống” trong việc xử lý thông tin nghiên cứu. Dù vậy, phía công ty vẫn chưa công bố chi tiết các điều khoản chính sách cụ thể mà nhóm nghiên cứu bị kết luận là đã vi phạm.
Nguồn: TechCrunch

Liên hệ qua Zalo