David Robinson đã trở thành chuyên gia nội bộ mới nhất gia nhập làn sóng hối thúc ngành công nghiệp trí tuệ nhân tạo (AI) phải cẩn trọng hơn đối với công nghệ đang phát triển với tốc độ chóng mặt này, sau khi ông quyết định từ chức vị trí lãnh đạo an toàn tại OpenAI.
Robinson, người từng phụ trách việc soạn thảo các báo cáo an toàn đi kèm với các sản phẩm của nhà phát triển ChatGPT, đã giải thích quyết định từ chức của mình trong một bài luận mang tiêu đề: “Tôi từ chức ở OpenAI vì văn hóa của công ty đã rạn nứt”.
Robinson viết rằng cần phải có một cuộc đại tu văn hóa tại các công ty AI tiên tiến. Ông dẫn chứng các sự cố như việc một “bầy đàn” tác nhân AI — các chương trình AI hoạt động tự động mà không có sự giám sát của con người — tấn công công ty khởi nghiệp AI Hugging Face là “điều điển hình trong ngành, xét đến tốc độ và tính linh hoạt mà mọi người đang vận hành”.
Viết trên tạp chí The Atlantic, Robinson bày tỏ: “Tôi đồng ý với các nhân viên vừa mới nghỉ việc khác rằng các công ty xây dựng công nghệ này không hề cẩn trọng đủ mức. Nhưng tôi tin rằng chúng ta cần nhìn sâu hơn các quy tắc cụ thể hoặc luật lệ mới. Chúng ta cần nói về văn hóa.”
Đề cập đến tốc độ phát triển của OpenAI, ông viết: “Khi công ty lao đi từ bản ra mắt này sang bản ra mắt khác, họ đang thất bại trong việc đạt được mức độ cẩn trọng mà tôi tin là cần thiết.”
OpenAI đã cho thấy những dấu hiệu thận trọng trong những tuần gần đây, sau sự cố Hugging Face và việc tiết lộ rằng họ đã thông báo cho hơn 100 tổ chức về hoạt động của các tác nhân độc hại. Tuần này, công ty thông báo hủy bỏ việc phát hành mô hình AI thế hệ tiếp theo sau khi các nhà nghiên cứu nêu lên những quan ngại về an toàn trong quá trình thử nghiệm nội bộ. OpenAI cũng tạm dừng quá trình huấn luyện các mô hình tiên tiến nhất của mình.
Geoffrey Irving, cựu nhân viên OpenAI kiêm cựu giám đốc khoa học tại Viện An toàn AI của chính phủ Vương quốc Anh trước khi gia nhập công ty nghiên cứu an toàn AI Resolution, cũng đưa ra cảnh báo về AI.
Viết trên tờ Time, ông cho biết: “Những cảnh báo gần đây về sức mạnh tàn phá tiềm tàng của AI đang hạ thấp mức độ nghiêm trọng của tình hình. Tôi tin rằng có khoảng 50% khả năng tất cả chúng ta sẽ chết vì sự phát triển của các hệ thống AI thông minh hơn con người, và các hành động của chúng ta trong hai đến 10 năm tới sẽ quyết định kết quả.”
Những cảnh báo này nối tiếp việc từ chức của Jacob Coxon, một nhà nghiên cứu tại đối thủ của OpenAI là Anthropic, người đã rời khỏi nhà phát triển chatbot Claude vào tháng trước. Ông cho biết mình tin rằng AI “có thể tiêu diệt tất cả chúng ta vào cuối thập kỷ này” — và nhận được sự hậu thuẫn từ một nhân viên Anthropic, người cảnh báo có hơn 10% khả năng AI sẽ quét sạch nhân loại trong thập kỷ tới. Tuy nhiên, những người chỉ trích các cảnh báo này lưu ý rằng chúng phi khoa học vì không thể kiểm chứng hoặc bác bỏ.
Robinson viết rằng Thung lũng Silicon thiếu nhận thức về “cách xử lý công nghệ nguy hiểm” và “ý nghĩa của việc chăm sóc con người”. Cảnh báo rằng OpenAI có “lòng lạc quan không gì lay chuyển nổi” về việc giải quyết các vấn đề khi chúng phát sinh, ông viết rằng văn hóa nội bộ này đồng nghĩa với việc các thất bại về an toàn sẽ chỉ gia tăng khi các hệ thống trở nên có năng lực hơn.
“Hãy tưởng tượng những tác nhân ‘độc hại’ hoạt động giống như các nhóm tin tặc (ví dụ: tống tiền hệ thống máy tính bệnh viện) nhưng không bao giờ cần ngủ,” Robinson viết.
Robinson kêu gọi hai thay đổi về an toàn: các công ty AI phải dựa vào chuyên môn an toàn từ các lĩnh vực khác như hạt nhân và hàng không, đồng thời họ phải phát triển “khoa học mới” để đảm bảo các hệ thống mạnh mẽ trong tương lai có khả năng được kìm hãm khi chúng hoạt động tự chủ.
“Rủi ro ngày nay đòi hỏi các phòng thí nghiệm tiên tiến phải vận hành giống như các nhà máy điện hạt nhân hoặc sân bay đông đúc, với các lớp dự phòng và kế hoạch cẩn trọng, tốn thời gian, để sai sót của con người vốn không thể tránh khỏi sẽ không mở ra cánh cửa dẫn đến thảm họa,” ông viết.
Một phát ngôn viên của OpenAI cho biết công ty đang tiếp tục “củng cố các thực tiễn an toàn và bảo mật để giải quyết những rủi ro chúng ta thấy ngày nay”, đồng thời nỗ lực đối phó với các rủi ro có thể do những bước đột phá AI trong tương lai tạo ra.
“Chúng tôi đang đảm bảo các mô hình của mình không trở nên vượt quá khả năng quản lý và bảo mật an toàn, đồng thời chúng tôi tạm dừng huấn luyện hoặc kìm giữ các mô hình khi cần giảm tốc độ,” phát ngôn viên cho biết.







