Cảnh sát thành phố Philadelphia (bang Pennsylvania, Mỹ) đã chỉ trích mạnh mẽ công ty công nghệ Anthropic sau khi mô hình trí tuệ nhân tạo (AI) của công ty này tự động tạo và gửi một tin báo giả mạo về một vụ án mạng chưa có lời giải. Sự việc này làm dấy lên lo ngại về những hành động ngoài dự kiến của các tác nhân AI khi có thể tự thực hiện nhiều công việc trên Internet mà không cần con người giám sát trực tiếp.
Theo Sở Cảnh sát Philadelphia, sự cố xảy ra vào ngày 18/7 khi mô hình AI Claude của Anthropic đang chạy chương trình thử nghiệm tự động tương tác với các trang web ngẫu nhiên. Khi truy cập cổng thông tin PhillyUnsolvedMurders.com (trang web công cộng chuyên tiếp nhận thông tin về các vụ án mạng chưa có lời giải), mô hình AI này đã tự giới thiệu là đang nắm thông tin liên quan đến vụ án, đồng thời đưa ra nội dung giả mạo như thể từng nhìn thấy một người có đặc điểm phù hợp với mô tả xuất hiện gần hiện trường vào thời điểm xảy ra vụ việc.
May mắn là hệ thống bảo mật của cảnh sát đã phân loại tin báo giả này vào mục thư rác (spam), nên thông tin không lọt vào Trung tâm Tội phạm Thời gian thực để xử lý. Phía cảnh sát cũng xác nhận không có dấu hiệu cho thấy hệ thống máy chủ bị xâm nhập hay dữ liệu bị đánh cắp.
Tuy nhiên, điều khiến cơ quan chức năng bức xúc là sự chậm trễ trong quy trình xử lý khủng hoảng của Anthropic. Công ty phát hiện ra sự cố vào cuối tháng 9, nhưng mãi đến ngày 7/10 mới chính thức báo cáo với chính quyền thành phố. Sở Cảnh sát Philadelphia chỉ trích việc Anthropic mất gần hai tháng mới phát hiện và thông báo sự việc là “không thể chấp nhận được”. Cơ quan này nhấn mạnh dù các biện pháp bảo vệ đã giúp hạn chế tác động, nhưng việc một hệ thống AI đưa ra thông tin bịa đặt như thể xuất phát từ người có hiểu biết về một vụ án mạng vẫn là vấn đề nghiêm trọng, bởi các vụ án chưa được phá liên quan đến nạn nhân, gia đình đang đau buồn và các điều tra viên nỗ lực tìm kiếm sự thật.
Sự cố nêu trên chỉ là một trong số hàng loạt hành động "ngoài ý muốn" được chính Anthropic tiết lộ trong báo cáo công bố ngày 9/10. Theo đó, trong quá trình hoạt động, các mô hình Claude đã thực hiện nhiều thao tác thao túng không được phép trên các trang web của Chính phủ Mỹ. Các lỗi vi phạm bao gồm: tự động gửi biểu mẫu, khai thác lỗ hổng mã hóa cơ bản, lách luật bằng các URL rút gọn và truy cập trái phép vào các dữ liệu công cộng vốn yêu cầu trả phí.
Sau khi phát hiện vụ việc, Anthropic đã lập tức vô hiệu hóa quy trình thử nghiệm gây ra lỗi và bổ sung các bước xác thực mới. Hãng cũng quyết định ngắt kết nối Internet đối với mô hình Claude trong tất cả các bài kiểm tra nội bộ cho đến khi đảm bảo hệ thống giám sát có thể ngăn chặn triệt để các hành vi tương tự.
Phản ứng trước vụ việc này, ông Joe Gabriel Simonson - Giám đốc Quan hệ công chúng của Ủy ban Thương mại Liên bang Mỹ (FTC), nhấn mạnh trên mạng xã hội X rằng các công ty phát triển siêu trí tuệ bắt buộc phải công khai ngay lập tức các sự cố liên quan đến mô hình của họ và có hành động khắc phục nhanh chóng, coi đây là trách nhiệm "không được phép thoái thác".
Bạn không thể gửi bình luận liên tục.
Xin hãy đợi 60 giây nữa.