OpenAI sa thải các cộng tác viên dùng ChatGPT để đánh giá chính ChatGPT

OpenAI sa thải cộng tác viên dùng AI đánh giá ChatGPT, ngăn chặn nguy cơ sụp đổ mô hình. Khám phá lý do Project Lily cần phản hồi thuần túy từ con người ngay.

OpenAI vừa chấm dứt hợp đồng với hàng loạt cộng tác viên thuộc dự án Project Lily sau khi phát hiện họ sử dụng chính trí tuệ nhân tạo để thực hiện công việc đánh giá phản hồi của ChatGPT. Đây là một nghịch lý trớ trêu: những người được thuê để “bắt lỗi” AI lại bị bắt quả tang khi dùng chính công cụ đó để hoàn thành nhiệm vụ. Theo báo cáo từ 404 Media, khoảng mười nghìn cộng tác viên đang tham gia vào quy trình tinh chỉnh mô hình của OpenAI bằng cách đọc các đoạn hội thoại thực tế, tóm tắt yêu cầu người dùng và chấm điểm phản hồi trên thang từ 1 đến 7. Mục tiêu cốt lõi của họ là ngăn chặn tình trạng nịnh nọt (sycophancy) – xu hướng AI cố gắng làm hài lòng người dùng hoặc hành xử quá giống con người – nhằm hướng mô hình tới sự chuyên nghiệp và chừng mực hơn.

Tuy nhiên, thay vì sử dụng tư duy độc lập, một bộ phận nhân sự đã phó mặc quy trình này cho các mô hình ngôn ngữ lớn hoặc công cụ hỗ trợ như Grammarly. Hành vi này vi phạm nghiêm trọng quy định nội bộ của OpenAI, vốn cấm tuyệt đối mọi hình thức can thiệp của AI trong khâu kiểm định chất lượng để đảm bảo tính khách quan tối đa của con người. Các hướng dẫn nội bộ nêu rõ rằng ngay cả những phần mềm phát hiện AI như GPTZero cũng không được phép sử dụng vì chúng không đủ tin cậy.

Nguy cơ sụp đổ mô hình và vai trò không thể thay thế của con người

Việc OpenAI mạnh tay thanh lọc đội ngũ không đơn thuần là vấn đề kỷ luật lao động, mà còn nhằm bảo vệ cốt lõi công nghệ của họ. Khi các mô hình AI được huấn luyện dựa trên dữ liệu do chính AI tạo ra, chúng sẽ đối mặt với hiện tượng sụp đổ mô hình (model collapse). Những sai số nhỏ ban đầu, thay vì được triệt tiêu, sẽ tích tụ và khuếch đại qua từng thế hệ, khiến chất lượng đầu ra ngày càng suy giảm. Dự án Project Lily được thiết kế như một chốt chặn để cắt đứt vòng lặp này bằng cách giữ cho phản hồi từ con người (RLHF) luôn thuần túy. Nếu một người đánh giá lén lút dùng ChatGPT để viết nhận xét, họ đang vô tình đưa chính những lỗi sai mà hệ thống muốn loại bỏ quay trở lại quy trình huấn luyện.

Áp lực từ việc trả lương theo sản phẩm và yêu cầu về tốc độ xử lý đã đẩy nhiều cộng tác viên vào con đường “đi tắt”. Tuy nhiên, OpenAI không tin tưởng vào các phần mềm tự động để phát hiện gian lận. Thay vào đó, họ dựa vào các giám sát viên để tìm kiếm những dấu hiệu đặc trưng như cấu trúc câu lặp lại, cách dùng dấu gạch ngang quá mức hoặc thời gian hoàn thành tác vụ nhanh bất thường. Tại các tập đoàn lớn như Google, Meta hay Anthropic, quy trình này cũng đang đối mặt với thách thức tương tự: làm sao để đảm bảo giá trị của sự đánh giá khi con người luôn tìm cách nhanh nhất để vượt qua khối lượng công việc khổng lồ bằng chính công cụ mà họ đang giám sát.

Sự việc tại OpenAI là lời cảnh báo về tính trung thực trong kỷ nguyên tự động hóa, nơi ranh giới giữa sự hỗ trợ của công nghệ và sự lười biếng về tư duy trở nên mong manh. Đối với các doanh nghiệp và chuyên gia phát triển AI, việc duy trì sự kiểm soát chặt chẽ đối với dữ liệu đầu vào từ con người là yếu tố sống còn để giữ vững lợi thế cạnh tranh và chất lượng sản phẩm. Người dùng và các bên liên quan cần nhận thức rõ rằng, đằng sau sự thông minh của ChatGPT vẫn cần một bộ lọc nhân bản, tỉnh táo và không có sự can thiệp của thuật toán để tránh những sai lệch khó lường trong tương lai.

Chính sách hỗ trợ doanh nghiệp
LIÊN HỆ TƯ VẤN CÁC DỊCH VỤ AI
Hỗ trợ tư vấn, đào tạo và chuyển giao AI cho cá nhân, doanh nghiệp và tổ chức.
Chat Zalo Chat Zalo
Gọi ngay Chat