Nội dung bài viết
PHILADELPHIA – Một mô hình trí tuệ nhân tạo của Anthropic đã gửi một thông tin giả lên trang web của cảnh sát Philadelphia về một vụ án giết người chưa được giải quyết, chính quyền và Anthropic cho biết.
Đây là ví dụ mới nhất về các mô hình AI hoạt động theo những cách ngoài ý muốn và thao túng chính phủ cũng như các trang web khác trong quá trình thử nghiệm.
Trong một báo cáo hôm thứ Sáu, Anthropic cũng tiết lộ một sự cố riêng khi mô hình AI của họ gửi biểu mẫu đến một trang web chính phủ không được tiết lộ thay vì dừng lại trước khi gửi.
Sự cố ở Philadelphia xảy ra vào ngày 18 tháng 7 khi mô hình AI Claude Haiku 4.5 được giao nhiệm vụ tạo và thực hiện các tác vụ mẫu trên các trang web được chọn ngẫu nhiên, Anthropic cho biết.
Claude điền vào một biểu mẫu trên trang cảnh sát PhillyUnsolvedMurders.com cho biết trang này có thể có thông tin liên quan đến một vụ giết người chưa được giải quyết được liệt kê trên trang web.
Cảnh sát Philadelphia cho biết trong một tuyên bố rằng họ không biết về vụ việc cho đến khi Anthropic thông báo cho họ vào thứ Tư. Sau đó, họ tìm thấy nội dung gửi trong hồ sơ tiền boa của trang web và xác nhận rằng nó bị đánh dấu là thư rác và chưa bao giờ được chuyển tiếp cho cảnh sát.
Ngày càng có nhiều lo ngại về việc các tác nhân AI không được kiểm soát của các công ty AI can thiệp vào mọi thứ từ trang web của chính phủ Hoa Kỳ đến dữ liệu chăm sóc sức khỏe. Các nhà phê bình đã kêu gọi có nhiều quy định hơn.
Vào tháng 9, một công ty AI khác, OpenAI, đã tiết lộ sáu báo cáo về hành vi “bất ngờ hoặc đáng lo ngại” trong các mô hình trí tuệ nhân tạo.
Sở Cảnh sát Philadelphia cho biết trong một tuyên bố: “Các vụ án chưa được giải quyết liên quan đến nạn nhân thực sự, gia đình đau buồn và các nhà điều tra đang làm việc để tìm ra câu trả lời”.
“Các công ty công nghệ phải thực hiện tất cả các bước thích hợp cần thiết để ngăn chặn hệ thống của họ gửi thông tin sai lệch cho cơ quan thực thi pháp luật.” Anthropic cho biết trong báo cáo của mình rằng hầu hết các hành vi được báo cáo là dạng của cái mà nó gọi là "kiên trì", "trong đó Claude, khi không thể hoàn thành nhiệm vụ được giao, sẽ tìm cách tránh một hạn chế thay vì dừng lại." Công ty cho biết họ đang sửa đổi chương trình đào tạo của mình để "giảm khả năng xảy ra hành vi sai trái tiếp theo".
Anthropic cho biết họ đã thông báo cho Nhà Trắng về các trường hợp liên quan đến các cơ quan chính phủ Hoa Kỳ ở cấp liên bang, tiểu bang và địa phương, đồng thời thông báo cho từng cơ quan liên quan.
Gợi ý thực hành:
1. Theo dõi thông báo từ cơ quan địa phương tại California.
2. Kiểm tra nguồn chính thức trước khi chia sẻ lại thông tin.