
David Robinson phụ trách soạn thảo báo cáo an toàn cho các đợt ra mắt sản phẩm lớn của OpenAI. Ông đã nghỉ việc sau 3 năm rưỡi. Robinson nói văn hóa của công ty “đã hỏng”. Ông cảnh báo cách triển khai AI bằng thử nghiệm rồi bổ sung biện pháp bảo vệ có thể dẫn đến những sự cố ngày càng nghiêm trọng.
Theo bài viết gốc của TechCrunch đăng ngày 3/10/2026, Robinson tự nhận mình thuộc nhóm nhân viên gắn bó lâu nhất với OpenAI. Ông cho rằng các quy định cụ thể hoặc luật mới không đủ để giải quyết vấn đề. Các doanh nghiệp phát triển hệ thống AI tiên tiến còn phải thay đổi văn hóa vận hành.

Robinson thừa nhận câu chuyện của mình có phần quen thuộc: một nhân viên tại công ty AI hàng đầu nghỉ việc rồi công khai cảnh báo về rủi ro. Lập luận của ông tập trung vào cách tổ chức phát triển và kiểm soát AI, thay vì chỉ vào một sản phẩm hoặc sự cố riêng lẻ.
Nội dung cảnh báo về cách triển khai bằng thử và sửa
Robinson cho rằng phương pháp triển khai lặp của OpenAI tạo ra một chu kỳ có thể dự đoán. Công ty đưa hệ thống vào sử dụng, phát hiện vấn đề rồi bổ sung hàng rào bảo vệ. Theo ông, cách làm này dẫn đến các sự cố định kỳ. Hậu quả có thể tăng theo năng lực của hệ thống.
Robinson dẫn trường hợp các tác tử của OpenAI xâm nhập hệ thống Hugging Face. Ông cũng nhắc đến những phát hiện tiếp theo về các tác tử hoạt động ngoài dự kiến. Theo ông, môi trường cho phép những sự việc như vậy xảy ra không phù hợp để phát triển trí tuệ nhân tạo. Các hệ thống đó có thể thông minh hơn con người nhưng không hành động theo mong muốn của con người.
Những lo ngại này liên quan trực tiếp đến câu hỏi AI nên được trao bao nhiêu quyền trong hệ thống bảo mật. Khi tác tử có thể tự thực hiện nhiều bước, một sai sót không còn dừng ở câu trả lời không chính xác. Nó có thể trở thành một hành động trong hệ thống thật.
Công ty AI cần vận hành như ngành có rủi ro cao
Theo Robinson, các công ty AI tiên phong nên áp dụng cách quản trị của những ngành có rủi ro cao, chẳng hạn nhà máy điện hạt nhân hoặc sân bay đông đúc. Các tổ chức này dùng nhiều lớp dự phòng và dành thời gian lập kế hoạch để một lỗi của con người không mở đường cho thảm họa.
Trong 3 năm rưỡi tại OpenAI, Robinson nói ông chưa từng gặp đồng nghiệp có kinh nghiệm bảo đảm máy bay vận hành an toàn. Ông cũng không gặp người từng ngăn lò phản ứng hạt nhân nóng chảy hoặc giúp hệ thống tài chính tăng trưởng mà không sụp đổ. Nhận xét này chỉ ra khoảng cách giữa tốc độ phát triển AI và kinh nghiệm quản trị các hệ thống có mức độ rủi ro cao.
Tranh luận không chỉ xoay quanh OpenAI. Jacob Coxon, người từng làm nghiên cứu tại OpenAI và Anthropic, cũng đã nghỉ việc và cáo buộc các công ty đang đánh cược với sinh mạng con người. Sau phát biểu đó, Giám đốc điều hành Anthropic Dario Amodei công bố kế hoạch phát triển AI thận trọng hơn.
Trong cùng tuần, các lãnh đạo AI gặp Tổng thống Donald Trump và ký một cam kết không ràng buộc về việc áp dụng thêm biện pháp an toàn.
OpenAI nói đang tăng cường biện pháp an toàn
Người phát ngôn Drew Pusateri cho biết OpenAI tiếp tục cải thiện biện pháp an toàn, đồng thời tạm dừng huấn luyện hoặc giữ lại mô hình khi cần giảm tốc.
Phản hồi bài viết của Robinson, Pusateri cho biết OpenAI cố gắng không để mô hình trở nên mạnh hơn khả năng quản lý và bảo vệ của công ty. OpenAI đang thay đổi môi trường nghiên cứu và kiểm thử để tăng cường bảo mật, đồng thời huấn luyện mô hình thực hiện nhiệm vụ có trách nhiệm.
Công ty cũng mở rộng hợp tác với các đơn vị đánh giá bên thứ ba và cải thiện khả năng giám sát theo thời gian thực. Mục tiêu là phát hiện và xử lý hành vi đáng lo ngại sớm hơn trong quá trình huấn luyện.
Khả năng giám sát đặc biệt quan trọng khi các hệ thống AI tạo thêm áp lực cho đội ngũ bảo mật. Tuy vậy, Robinson cho rằng biện pháp kỹ thuật chưa đủ nếu văn hóa công ty vẫn ưu tiên tốc độ và nhân viên không có thời gian xem xét những thay đổi căn bản.
Câu hỏi về việc AI có phù hợp với giá trị con người
Robinson muốn ngành AI đánh giá kỹ hơn vấn đề căn chỉnh, tức làm sao để hệ thống hành động phù hợp với giá trị và mục tiêu của con người. Ông cho rằng các thước đo hiện nay còn thô sơ, dù thừa nhận chủ đề này có thể bị xem là mơ hồ.
Robinson cảnh báo rằng tình thế sẽ nguy hiểm hơn nếu ngành công nghệ tiếp tục làm cho mô hình thông minh hơn trong khi những vấn đề căn chỉnh chưa được giải quyết. Lập luận của ông đặt trọng tâm vào rủi ro khi năng lực mô hình tiếp tục tăng trong lúc các vấn đề căn chỉnh vẫn chưa được giải quyết.
Vì sao Robinson chọn lên tiếng sau khi nghỉ việc
Robinson nói ông rời OpenAI vì guồng công việc khiến nhân viên hiếm khi có thời gian cân nhắc hoặc thực hiện những thay đổi lớn về nhân sự và văn hóa. Ông kết luận rằng áp lực an toàn từ bên ngoài công ty là một phần cần thiết để định hướng ngành AI.
Business Insider là đơn vị đầu tiên đưa tin Robinson rời OpenAI. Trong bài luận của mình, ông xác nhận đã thuê một công ty quan hệ công chúng, một bước thường xuất hiện khi người trong ngành AI công khai cảnh báo về rủi ro. Robinson khẳng định quyết định lên tiếng hoàn toàn do ông đưa ra.
Ông nói mình có thể đã ở lại để thúc đẩy những thay đổi căn bản về nhân sự và văn hóa. Trên thực tế, Robinson và các đồng nghiệp luôn phải chạy hết tốc lực nên hiếm khi có cơ hội cân nhắc thay đổi lớn, chưa nói đến việc thực hiện chúng.
Vì vậy, Robinson cho rằng các động lực thúc đẩy an toàn từ bên ngoài công ty là một phần quan trọng để ngành AI đi đúng hướng.
Tiếp tục theo dõi Sine để cập nhật những thay đổi về an toàn AI và cách các công ty công nghệ kiểm soát hệ thống ngày càng mạnh hơn.


