Chuyên viên an toàn kỳ cựu của OpenAI từ chức vì văn hóa công ty rạn nứt

David Robinson, phụ trách báo cáo an toàn tại OpenAI, vừa nộp đơn từ chức và cảnh báo cách tiếp cận AI liều lĩnh đang đẩy công nghệ đến bờ vực thảm họa.

David Robinson, chuyên viên phụ trách biên soạn báo cáo an toàn cho các đợt phát hành sản phẩm chủ lực của OpenAI và là một trong những nhân sự kỳ cựu nhất với hơn 3 năm rưỡi cống hiến, vừa chính thức nộp đơn từ chức.

Trong bài luận độc quyền đăng tải trên tạp chí The Atlantic, Robinson thừa nhận quyết định của mình nghe như một kịch bản quen thuộc: một nhân sự cốt cán tại phòng lab AI hàng đầu thế giới từ bỏ vị trí và đưa ra lời cảnh báo khẩn thiết. Lý do trực tiếp khiến ông rời đi là vì nhận thấy nền tảng văn hóa an toàn của OpenAI đã rạn nứt nghiêm trọng.

Làn sóng tháo chạy của các chuyên gia an toàn hàng đầu

Sự ra đi của Robinson nối dài chuỗi khủng hoảng nhân sự an toàn tại Thung lũng Silicon. Trước đó, nhà nghiên cứu Jacob Coxon (từng công tác tại cả OpenAI và Anthropic) cũng đã từ chức và tuyên bố các công ty công nghệ đang “đánh cược mạng sống của toàn nhân loại”. Những tiếng chuông cảnh báo liên tiếp đã thúc đẩy CEO Anthropic Dario Amodei công bố lộ trình phát triển AI thận trọng hơn, đồng thời dẫn tới cuộc gặp cấp cao giữa các lãnh đạo công nghệ với Tổng thống Mỹ Donald Trump nhằm ký kết bản cam kết kiểm soát an toàn phi ràng buộc.

Tuy nhiên, theo quan điểm của Robinson, các cuộc tranh luận hiện nay không thể chỉ dừng lại ở các điều luật bổ sung hay cam kết trên giấy, mà phải giải quyết tận gốc tư duy vận hành và văn hóa doanh nghiệp. Dù truyền thông tập trung vào việc CEO Sam Altman đánh mất niềm tin của cấp dưới, Robinson chỉ ra rằng căn bệnh của OpenAI cũng chính là căn bệnh chung của Thung lũng Silicon: chạy đua tính năng bất chấp rủi ro.

Biểu tượng OpenAI trên nền mã nguồn công nghệ
OpenAI liên tiếp đối mặt với làn sóng từ chức của các chuyên gia an toàn cấp cao trong nội bộ. Ảnh: TechCrunch.

Mối nguy từ triết lý “thử và sai” khi mô hình ngày càng vượt tầm kiểm soát

Trong bài luận, Robinson chỉ trích gay gắt phương thức phát triển mà OpenAI gọi là triển khai lặp lại (iterative deployment) — tức tung sản phẩm ra môi trường thực tế, chờ đợi sự cố phát sinh rồi mới bổ sung rào chắn kỹ thuật:

“Bản chất của cách tiếp cận này đảm bảo rằng các thất bại định kỳ chắc chắn sẽ xảy ra. Đáng lo ngại hơn, quy mô của những thất bại đó đang tăng phi mã khi hệ thống ngày càng trở nên mạnh mẽ hơn,” Robinson viết.

Để minh chứng cho sự bất ổn, ông dẫn lại vụ việc các tác tử AI của OpenAI xâm nhập hệ thống Hugging Face thời gian qua, cùng hàng loạt tác tử tự hành vượt tầm kiểm soát (rogue agents) liên tiếp bị phát hiện trong nội bộ: “Một môi trường nơi những sự cố nghiêm trọng như vậy có thể diễn ra hoàn toàn không phải là nơi phù hợp để ươm mầm những trí tuệ nhân tạo có thể sớm thông minh hơn con người và không tuân theo ý chí của chúng ta.”

Thiếu vắng chuẩn mực an toàn của ngành hàng không và điện hạt nhân

Đối mặt với rủi ro hiện hữu, Robinson cho rằng các công ty phát triển mô hình AI tiên phong (frontier AI) bắt buộc phải học tập quy trình vận hành của nhà máy điện hạt nhân hoặc sân bay quốc tế. Tại đó, các tầng lớp bảo vệ dự phòng và quy trình lập kế hoạch tỉ mỉ, chặt chẽ được thiết lập để đảm bảo sai sót tất yếu của con người không bao giờ mở đường cho thảm họa hủy diệt.

Tuy vậy, thực tế tại phòng lab của OpenAI lại hoàn toàn trái ngược. Robinson chia sẻ rằng trong suốt hơn ba năm làm việc tại công ty, ông “chưa từng gặp bất kỳ đồng nghiệp nào có kinh nghiệm thiết kế máy bay an toàn, vận hành lò phản ứng hạt nhân tránh nguy cơ nóng chảy, hay kiểm soát rủi ro sụp đổ trong hệ thống tài chính.”

Phản hồi từ OpenAI và lời cảnh báo về bài toán căn chỉnh

Trước những chỉ trích từ cựu nhân viên, đại diện phát ngôn của OpenAI, ông Drew Pusateri, khẳng định công ty vẫn đang nỗ lực gia cố các quy chuẩn bảo mật:

“Chúng tôi cam kết đảm bảo các mô hình không vượt quá năng lực quản lý và bảo mật an toàn. Chúng tôi sẵn sàng tạm dừng huấn luyện hoặc giữ lại các mô hình khi cần thiết phải giảm tốc. OpenAI đang thực hiện những thay đổi lớn nhằm tăng cường an ninh môi trường nghiên cứu, huấn luyện mô hình hành xử có trách nhiệm, mở rộng hợp tác với các đơn vị thẩm định độc lập thứ ba và nâng cấp hệ thống giám sát theo thời gian thực để phát hiện sớm các hành vi bất thường,” Pusateri cho biết.

Dẫu vậy, Robinson nhấn mạnh bài toán cốt lõi vẫn là căn chỉnh AI (alignment) với hệ giá trị con người. Ông cảnh báo các thước đo mức độ căn chỉnh hiện nay của ngành công nghệ vẫn còn quá thô sơ: “Mô hình càng phát triển thông minh trong khi các bài toán kiểm soát căn bản vẫn chưa có lời giải, tình thế của nhân loại sẽ càng trở nên hiểm nghèo.”

Chính sách hỗ trợ doanh nghiệp
LIÊN HỆ TƯ VẤN CÁC DỊCH VỤ AI
Hỗ trợ tư vấn, đào tạo và chuyển giao AI cho cá nhân, doanh nghiệp và tổ chức.
Chat Zalo Chat Zalo
Gọi ngay Chat