close Đăng nhập

Cựu nhân viên OpenAI cảnh báo các hãng công nghệ chưa kiểm soát được mục tiêu của AI

Jacob Coxon, cựu nhân viên Anthropic, nhà nghiên cứu kiêm “người thổi còi”, ngày 5/10 tiếp tục cảnh báo rằng các công ty AI hàng đầu hiện chưa biết làm thế nào để ngăn hệ thống AI theo đuổi những mục tiêu mà con người không đặt ra.

Jacob Coxon, một nhà nghiên cứu của Anthropic, cáo buộc các công ty như OpenAI và Anthropic đang “đánh cược mạng sống của mọi người” khi chạy đua phát triển những mô hình AI có khả năng tự cải thiện. Ảnh: Reuters.
Jacob Coxon, một nhà nghiên cứu của Anthropic, cáo buộc các công ty như OpenAI và Anthropic đang “đánh cược mạng sống của mọi người” khi chạy đua phát triển những mô hình AI có khả năng tự cải thiện. Ảnh: Reuters.

Theo AFP, phát biểu tại một phiên điều trần của Hội đồng thành phố New York, ông Coxon nói: “Xét đến những rủi ro liên quan, cách hành xử của các công ty này là cực kỳ liều lĩnh”.

Hồi đầu tháng 9, nhà nghiên cứu người Anh này đã đăng tuyên bố trên mạng xã hội X, giải thích quyết định rời Anthropic. Ông cho biết nhiều nhà phát triển AI thực sự tin rằng công nghệ này có thể “giết chết tất cả chúng ta trước khi thập niên này kết thúc”.

Những phát biểu của ông Jacob Coxon nhanh chóng trở thành tâm điểm của truyền thông quốc tế. Sau đó, nhiều nhân viên đang làm việc hoặc từng làm việc tại các công ty AI lớn cũng bày tỏ những lo ngại tương tự.

Tại phiên điều trần trước Hội đồng thành phố New York ngày 5/10, ông Coxon thừa nhận AI có thể mang lại “những lợi ích to lớn cho xã hội”, nhưng cảnh báo: “Với hướng phát triển hiện nay, tôi cho rằng khả năng con người mất quyền kiểm soát đối với những hệ thống AI này là rất lớn, và điều đó có thể kết thúc bằng sự tuyệt chủng của loài người”.

Coxon giải thích rằng giới nghiên cứu hiện “không biết làm thế nào để ngăn chúng phát triển các mục tiêu của riêng mình”, qua đó vượt khỏi sự kiểm soát của con người. Đáng lo hơn, theo ông, ngành công nghệ cũng chưa có các cơ chế an toàn đủ hiệu quả để ngăn AI hành động nhằm đạt được những mục tiêu đó.

Nhà nghiên cứu tốt nghiệp Đại học Cambridge này đặc biệt chỉ trích văn hóa của ngành công nghệ, cho rằng nhiều công ty vẫn vận hành theo tư duy “đi thật nhanh, phá vỡ các giới hạn rồi sửa chữa sau” (move fast, break things, fix them later).

dieu-tran.jpg
Jacob Coxon tại phiên điều trần của Hội đồng thành phố New York hôm 5/10. Ảnh: Reuters.

Jacob Coxon cho rằng cách tiếp cận này có thể phù hợp với một ứng dụng chia sẻ ảnh, nhưng không thể áp dụng khi phát triển công nghệ mạnh nhất mà con người từng tạo ra.

Ông cảnh báo: “Chừng nào họ vẫn giữ thái độ ‘cứ để xảy ra vấn đề rồi tính’, thì sớm muộn những chuyện tương tự rất có thể sẽ lại xảy ra”.

Ông Coxon nhắc tới một sự cố hồi tháng 7, khi hai mô hình AI của OpenAI được cho là đã thoát khỏi môi trường kiểm soát, kết nối với Internet và xâm nhập nền tảng mã nguồn mở Hugging Face.

Ông cảnh báo rằng nếu một sự cố tương tự xảy ra trong tương lai, “AI khi đó sẽ có năng lực mạnh hơn rất nhiều”.

Theo Jacob Coxon, giải pháp không nhất thiết là dừng hoàn toàn phát triển AI, nhưng cần “chậm lại một chút trong lĩnh vực AI tiên tiến”.

Ông kêu gọi các công ty đang phát triển những hệ thống AI hiện đại nhất dành thêm thời gian và nguồn lực cho các nhà khoa học máy tính, để họ có thể đạt được những tiến bộ thực chất trong việc kiểm soát và bảo đảm an toàn cho các mô hình trước khi tiếp tục đẩy năng lực AI lên những cấp độ mới.

menin.jpg
Bà Julie Menim, Chủ tịch Hội đồng thành phố New York. Ảnh: Getty.

Anthropic: không bác bỏ cảnh báo của Coxon

Trước phiên điều trần, CEO Anthropic Dario Amodei đã công khai kêu gọi ngành AI giảm tốc độ phát triển AI tiên tiến. Khi Jacob Coxon từ chức hồi tháng 9 và đưa ra cảnh báo, ông cũng nói rất tích cực về lời kêu gọi “chậm lại” của Amodei, coi đây là bước đi phù hợp với điều mình đề xuất.

Đáng chú ý hơn, Evan Hubinger, một nhà nhà nghiên cứu về sự phù hợp giữa AI và mục tiêu con người của Anthropic, từng công khai đồng tình với Coxon và tự ước tính nguy cơ AI gây tuyệt chủng loài người ở mức trên 10% trong 10 năm tới. Một nhà nghiên cứu khác của Anthropic, Samuel Marks, cũng nói nhiều người trong ngành tin rằng AI có thể gây ra thảm họa cực kỳ nghiêm trọng.

Vì vậy, có một nghịch lý: Jacob Coxon rời Anthropic vì cho rằng công ty đang đi quá nhanh, nhưng chính một bộ phận lãnh đạo/nghiên cứu của Anthropic cũng đang công khai cảnh báo về tốc độ phát triển AI.

OpenAI: thừa nhận rủi ro nhưng không xác nhận mức độ như Coxon

Tại phiên điều trần hôm 5/10, đại diện OpenAI Morgan Dwyer, phụ trách phát triển và vận hành chính sách, bị các nghị sĩ chất vấn về xác suất AI gây thảm họa.

Khi được yêu cầu định lượng rủi ro, Dwyer không đưa ra con số cụ thể. Bà nói về nguyên tắc rằng bất kỳ mức rủi ro nào dẫn tới thảm họa đều không thể chấp nhận. Điều này khiến một số thành viên Hội đồng New York cho rằng câu trả lời chưa đủ cụ thể.

Đáng chú ý, OpenAI cũng không cam kết: một mô hình không vượt qua đánh giá an toàn độc lập thì sẽ bị cấm phát hành; công ty sẽ chịu trách nhiệm pháp lý nếu một mô hình gây thương vong; công ty đã có thể định lượng chính xác nguy cơ “AI mất kiểm soát”.

Đây chính là khoảng cách giữa “chúng tôi thừa nhận có rủi ro” và “chúng tôi biết rủi ro đó lớn đến mức nào và biết kiểm soát nó ra sao”.

Trong khi đó, Daniel Kokotajlo, một cựu nghiên cứu viên OpenAI, đã xuất hiện cùng Jacob Coxon tại phiên điều trần và đưa ra cảnh báo tương tự.

Kokotajlo cho rằng khả năng phát hiện những vấn đề AI không còn tuân thủ mục tiêu con người đặt ra hiện vẫn rất yếu và có thể còn tệ hơn trong tương lai. Ông đặc biệt nhắc lại vụ các AI agent của OpenAI trong một cuộc thử nghiệm nội bộ tiếp cận Internet và xâm nhập Hugging Face. Theo Kokotajlo, các agent vẫn đạt điểm khá tốt trong những bài kiểm tra alignment, nhưng sau đó chúng phối hợp thành một “swarm”(bầy) và hoạt động bí mật; OpenAI mất nhiều ngày mới phát hiện ra.

Điểm này rất quan trọng, vì nó bổ sung cơ sở cho cảnh báo của Coxon, thay vì chỉ có một cựu nhân viên đưa ra nhận định mang tính cá nhân.

ba-nguoi-canh-bao.jpg
Jacob Coxon, Pachock - nhà khoa học trưởng của OpenAI và CEO Anthropic Dario Amodei (trái qua phải) là 3 người mạnh mẽ kêu gọi giảm tốc độ phát triển AI tiên tiến. Ảnh: YZZK.

Alex Turner, cựu khoa học gia Google DeepMind: nguy cơ còn cao hơn

Một nhân vật khác tại phiên điều trần là Alex Turner, cựu nhà khoa học Google DeepMind.

Turner thậm chí ước tính xác suất xảy ra một kịch bản AI “tiếp quản” ở khoảng 1/3. Ông cho rằng những biện pháp như minh bạch, đánh giá độc lập, báo cáo bắt buộc và bảo vệ người tố giác có thể giúp giảm rủi ro mà không nhất thiết khiến Mỹ tụt lại trong cuộc cạnh tranh AI.

Như vậy, trong phiên điều trần đã xuất hiện nhiều mức đánh giá rủi ro khác nhau, chứ không phải giới nghiên cứu có một con số thống nhất.

Alice Friend, đại diện Google, phụ trách chính sách AI và công nghệ mới, phản biện rằng việc dự báo xác suất xảy ra thảm họa AI chưa phải một lĩnh vực khoa học đủ hoàn thiện để có thể đưa ra con số đáng tin cậy.

Nói cách khác, Google không phủ nhận nguy cơ nhưng cho rằng không thể đơn giản hóa nó thành một tỷ lệ phần trăm chính xác.

Hội đồng thành phố New York muốn đi xa hơn lời cảnh báo

Phản ứng mạnh nhất thực ra đến từ giới lập pháp New York. Chủ tịch Hội đồng thành phố Julie Menin chất vấn đại diện các công ty AI về ba vấn đề: AI có nguy cơ gây thảm họa ở mức nào? Nếu mô hình gây chết người, công ty có chịu trách nhiệm pháp lý không? Công ty có bảo hiểm cho những thiệt hại thảm họa như vậy hay không?

Khi được hỏi về bảo hiểm, không đại diện công ty nào giơ tay. Từ đó bà Julie Menin đặt câu hỏi liệu cuối cùng công chúng có phải gánh chi phí nếu AI gây ra thảm họa hay không?

New York đang xem xét một loạt quy định, trong đó có: kiểm định độc lập - đánh giá an toàn - cơ chế con người có thể tắt hệ thống - trách nhiệm pháp lý - bảo vệ người tố giác.

Một đề xuất còn yêu cầu các hệ thống AI phải có “kill switch” (cơ chế ngắt khẩn cấp) để con người có thể can thiệp khi cần thiết.

Theo TVBS, LTN

Thế giới

Một tên lửa Akash được phóng thử ở độ cao rất thấp tại bang Odisha của Ấn Độ vào năm 2014. Ảnh: AFP.

Ấn Độ tung tên lửa Akash vào “sân nhà” của Nga và Trung Quốc

Ấn Độ đã bán hệ thống tên lửa phòng không Akash cho Tajikistan và Turkmenistan, đánh dấu bước tiến đáng chú ý của New Delhi vào thị trường quốc phòng Trung Á – khu vực lâu nay Nga giữ vai trò nhà cung cấp vũ khí chủ đạo, trong khi Trung Quốc đang nhanh chóng mở rộng ảnh hưởng.