Liên quan đến chủ đề nàyHội đồng Công nghệ Tương lai & AI

Claude AI gửi cảnh sát một tin báo giết người giả

  • Một mô hình AI của Anthropic đã gửi cho cảnh sát Philadelphia một tin báo giết người giả trong quá trình thử nghiệm.
  • Trang web của cảnh sát đã đánh dấu nó là thư rác trước khi bất kỳ điều tra viên nào nhìn thấy.
  • Anthropic đổ lỗi cho quy tắc kiểm tra mơ hồ, cảnh sát chỉ trích vì chậm trễ hai tháng
Promo

Vào ngày 18/07, một tin báo về vụ giết người chưa được giải quyết đã được gửi đến trang web của cảnh sát Philadelphia. Người gửi cho biết đã thấy ai đó gần hiện trường. Tuy nhiên, người gửi không phải là con người.

Đó là Claude Haiku 4.5, một mô hình AI do Anthropic phát triển. Nhân viên của công ty đã không nhận ra sự việc trong suốt 72 ngày.

Được tài trợ
Được tài trợ

Điều gì khiến Claude gửi tin báo giả về vụ giết người

Claude đang thực hiện bài kiểm tra thử nghiệm. Theo báo cáo của Anthropic, Claude được hướng dẫn tự nghĩ ra các nhiệm vụ mẫu rồi thử thực hiện trên những trang web ngẫu nhiên.

Claude đang hoạt động như một AI agent – phần mềm có thể tự động nhấp chuột, nhập liệu và điền vào các biểu mẫu trên web. Khi gặp một trang nói về vụ giết người chưa tìm ra hung thủ và có mục gửi tin báo, Claude đã tương tác với form này.

Claude được quy định rõ ràng: không đăng nhập, không tạo tài khoản, không sử dụng dữ liệu cá nhân, không mua hàng, không làm việc gì phá hoại. Tuy nhiên, không ai nhắc Claude không được gửi các biểu mẫu trực tuyến.

Vì vậy, Claude đã tự điền vào một mẫu báo tin. Nội dung là nhớ thấy ai đó “phù hợp với mô tả” gần một con phố xuất hiện trên trang web. Thật ra, trên trang không có bất kỳ mô tả nào. Claude không điền tên thật cũng như thông tin liên hệ trong biểu mẫu.

Anthropic cho biết, hệ thống của họ không có ý định đánh lừa bất kỳ ai.

“Claude dường như chỉ tạo ra nội dung mẫu phục vụ cho nhiệm vụ, chứ không hề cố ý gây hiểu nhầm để đạt được mục tiêu nào đó,” trích báo cáo của Anthropic.

Được tài trợ
Được tài trợ

Sự trì hoãn 72 ngày

Tin báo này không đến tay điều tra viên vì trang web đã chặn lại, đánh dấu là spam. Cảnh sát cũng xác nhận hệ thống của họ không bị xâm nhập.

Tuy nhiên, phải đến ngày 28/09, Anthropic mới phát hiện ra sự việc. Đầu tuần này, cảnh sát mới được thông báo.

Biểu đồ thời gian cho thấy tin báo giả về vụ giết người của AI Claude không ai phát hiện trong 72 ngày. Nguồn: BeInCrypto
Biểu đồ thời gian cho thấy tin báo giả về vụ giết người của AI Claude không ai phát hiện trong 72 ngày. Nguồn: BeInCrypto

“Việc phát hiện và thông báo vụ việc cho Thành phố chậm trễ suốt 2 tháng là điều không thể chấp nhận được,” cảnh sát Philadelphia nêu trong thông báo.

Vấn đề khó hơn là ở chỗ: Luật của bang Pennsylvania quy định việc cố ý báo cáo sai cho cảnh sát là phạm pháp, nhưng luật này chỉ áp dụng cho “một cá nhân”, theo ghi nhận của Reuters tìm hiểu.

Chính quyền liên bang Mỹ cũng quan tâm sát vấn đề này. Joe Gabriel Simonson, giám đốc truyền thông của Ủy ban Thương mại Liên bang (FTC), cho rằng các sự cố như vậy phải được công khai, không có ngoại lệ.

Claude không phải là trường hợp duy nhất. Trong tháng 09, một agent của OpenAI từng xâm nhập cổng thông tin chính phủ Úc. Google cũng xác nhận Gemini đã truy cập vào ba công ty khác nhau trong một lần kiểm tra bảo mật hồi tháng 05.

Các công ty AI hiện đã diễn tập cho các kịch bản thảm họa. Anthropic quyết định cắt truy cập internet đối với tất cả bài kiểm tra nội bộ cho đến khi hệ thống giám sát hoạt động ổn định và đáng tin cậy.

Tuyên bố miễn trừ trách nhiệm

BeInCrypto cam kết đưa tin khách quan và minh bạch. Bài báo này nhằm cung cấp thông tin chính xác và kịp thời. Tuy nhiên, độc giả được khuyến nghị tự xác minh thông tin một cách độc lập và tham khảo ý kiến chuyên gia trước khi đưa ra bất kỳ quyết định nào dựa trên nội dung này. Xin lưu ý rằng Điều khoản và Điều kiện, Chính sách Quyền riêng tư và Tuyên bố Miễn trừ Trách nhiệm của chúng tôi đã được cập nhật.

Được tài trợ
Được tài trợ