close Đăng nhập

AI của Anthropic gửi tin báo án mạng giả tới cảnh sát Mỹ, 2 tháng sau mới báo sự cố

Mô hình AI Claude của Anthropic đã gửi thông tin bịa đặt về một vụ án mạng chưa có lời giải tới website của cảnh sát Philadelphia trong quá trình thử nghiệm tự động.

Hình ảnh chiếc điện thoại thông minh hiển thị logo Anthropic ở phía trước, với phông nền mờ theo chủ đề Claude Mythos, được chụp vào tháng 7. Ảnh: AFP.
Hình ảnh chiếc điện thoại thông minh hiển thị logo Anthropic ở phía trước, với phông nền mờ theo chủ đề Claude Mythos, được chụp vào tháng 7. Ảnh: AFP.

Một mô hình trí tuệ nhân tạo (AI) do Anthropic phát triển đã gửi thông tin tố giác bịa đặt về một vụ án mạng chưa có lời giải tới cảnh sát Philadelphia. Cơ quan này chỉ trích công ty vì mất tới hai tháng mới thông báo về sự cố.

Sở Cảnh sát Philadelphia hôm thứ Sáu cho biết thông tin giả được gửi vào tháng 7 thông qua PhillyUnsolvedMurders.com, một trang web công khai cho phép người dân cung cấp manh mối về các vụ giết người chưa được phá án.

Theo thông tin Anthropic cung cấp và được cảnh sát dẫn lại, mô hình AI đang thực hiện một bài kiểm tra, trong đó hệ thống tương tác với các trang web được lựa chọn ngẫu nhiên. Khi truy cập trang web nói trên, mô hình đã gửi thông tin sai lệch về một vụ án mạng chưa có lời giải.

AI này còn tự nhận mình là người có thể nắm giữ thông tin liên quan đến vụ án.

Sự việc gợi nhớ những trường hợp AI hoạt động ngoài dự kiến được ghi nhận gần đây. Trong một vụ việc khác, một tác nhân AI của OpenAI đang trải qua quá trình đánh giá an ninh đã thoát khỏi môi trường thử nghiệm và xâm nhập các hệ thống trên nền tảng AI Hugging Face.

Những sự cố như vậy làm gia tăng lo ngại trước xu hướng ngành công nghiệp AI ngày càng sử dụng nhiều tác nhân AI (AI agent) – các hệ thống được lập trình để thực hiện nhiều bước hành động liên tiếp mà không cần con người giám sát trực tiếp.

Hôm thứ Sáu, Anthropic công bố báo cáo mô tả nhiều dạng hành vi ngoài dự kiến của các mô hình do công ty phát triển, trong đó có sự cố liên quan đến trang web của Sở Cảnh sát Philadelphia.

Theo báo cáo, các tổ chức khác bị ảnh hưởng còn có Nhà Trắng và một số cơ quan chính phủ Mỹ.

Anthropic cho biết những sự cố mới được tiết lộ “có tác động tối thiểu trong thực tế” và “ít nghiêm trọng hơn đáng kể” so với các sự cố an ninh mạng từng được báo cáo trước đó.

Trong quá trình rà soát nội bộ mô hình Claude, công ty xác định bốn nhóm hành vi đáng chú ý: khai thác các lỗi lập trình cơ bản; gửi biểu mẫu trên website; tìm cách vượt qua yêu cầu về mã thông báo hoặc phí; và sử dụng các đường dẫn URL rút gọn để né tránh một số giới hạn.

Anthropic cho biết hiện công ty đã tạm thời ngắt quyền truy cập internet của Claude trong toàn bộ quá trình thử nghiệm nội bộ. Biện pháp này sẽ được duy trì “cho đến khi chúng tôi xác nhận các biện pháp bảo mật và giám sát… có thể phát hiện đáng tin cậy những hành vi như vậy”.

Sở Cảnh sát Philadelphia cho biết tin báo giả, được gửi ngày 18/7, đã bị hệ thống đánh dấu là thư rác và không bao giờ được chuyển tới Trung tâm Tội phạm Thời gian thực của sở để thẩm định.

Cảnh sát cũng khẳng định không có dấu hiệu cho thấy các hệ thống của lực lượng này bị xâm nhập hoặc dữ liệu của sở bị xâm phạm.

Theo cảnh sát, Anthropic phát hiện sự cố vào ngày 28/9, sau đó đình chỉ quy trình thử nghiệm tự động gây ra vấn đề và bổ sung một bước xác thực mới cho các đợt thử nghiệm tiếp theo.

Công ty thông báo cho Sở Cảnh sát Philadelphia vào thứ Tư, và hai bên gặp nhau vào ngày hôm sau.

Sở Cảnh sát Philadelphia tuyên bố: “Việc mất hai tháng mới phát hiện và thông báo sự cố cho chính quyền thành phố là điều không thể chấp nhận được”.

Cảnh sát cho biết các biện pháp bảo vệ đã giúp hạn chế tác động của sự việc. Tuy nhiên, điều đó “không làm giảm mức độ nghiêm trọng của việc một hệ thống AI trình bày thông tin bịa đặt như thể thông tin đó đến từ một người có hiểu biết về một vụ án mạng”.

Thông cáo của cảnh sát nhấn mạnh: “Các vụ án chưa có lời giải liên quan đến những nạn nhân có thật, những gia đình đang đau buồn và các điều tra viên vẫn nỗ lực tìm kiếm câu trả lời”.

Theo AFP

Thế giới

Lưới chống máy bay không người lái trên tàu tuần tra Tatarstan. Ảnh: MW.

Nga bất ngờ giăng “lưới thép” quanh tàu chiến, drone đang buộc hải quân đổi cách phòng thủ

Nga đang bổ sung các lớp phòng thủ mới cho tàu chiến trước mối đe dọa ngày càng lớn từ máy bay không người lái. Hình ảnh công bố ngày 6/10 cho thấy tàu Tatarstan, kỳ hạm Hạm đội Caspi, được lắp kết cấu lưới quanh một phần thượng tầng, bên cạnh các biện pháp tác chiến điện tử chống UAV.

Nobel Hóa học 2026: Hai “bàn tay” của phân tử và bí ẩn khiến hóa học đau đầu hơn 100 năm

Nobel Hóa học 2026: Hai “bàn tay” của phân tử và bí ẩn khiến hóa học đau đầu hơn 100 năm

Nhà hóa học Pháp Henri B. Kagan và nhà hóa học Nhật Bản Kenso Soai giành Nobel Hóa học 2026 nhờ những khám phá giúp lý giải cách một dạng ảnh gương của phân tử có thể được ưu tiên và khuếch đại. Công trình không chỉ giải một bí ẩn hơn một thế kỷ của hóa học mà còn có ý nghĩa quan trọng với việc phát triển dược phẩm.