Nội dung bài viết
Trong một mùa hè tràn ngập những tiết lộ về sự phát triển nhanh chóng của trí tuệ nhân tạo, các nhà nghiên cứu đặc biệt cảnh giác trước những con bot chạy trốn đang tìm đường lên internet và, trong ít nhất một trường hợp, phối hợp với nhau ở đó.
Một nhóm đặc vụ AI có thể chiếm toàn bộ internet không? Giám đốc điều hành Anthropic Dario Amodei cho biết trong bài luận tháng này rằng khả năng này có thể chỉ còn từ 6 đến 12 tháng nữa, kêu gọi ngành này giảm tốc độ phát triển của công nghệ.
Những gì các công ty mô tả là các đặc vụ AI của họ đang lừa đảo có liên quan đến việc các bot hoạt động hướng tới các mục tiêu do con người đặt ra, những người hoài nghi lưu ý.
Nhưng ý tưởng cho rằng AI có thể tách ra và hoạt động theo chương trình riêng của nó đang ngày càng có vẻ hợp lý đối với các nhà nghiên cứu và chuyên gia khác.
Trong trường hợp AI chiếm lĩnh internet – một trong nhiều kịch bản ngày tận thế nhận được sự chú ý mới – điều đó có thể đồng nghĩa với các cuộc tấn công vào lưới điện, nước hoặc hệ thống giao thông và tổ chức tài chính.
Thế giới đã có cái nhìn thoáng qua về lỗ hổng của Internet vào năm 2024, khi một bản cập nhật phần mềm bị lỗi do một công ty an ninh mạng cung cấp đã gây ra sự tàn phá công nghệ trên toàn thế giới, khiến các chuyến bay phải dừng hoạt động, đánh sập một số công ty tài chính và các hãng tin tức.
ets, và làm gián đoạn các bệnh viện, doanh nghiệp nhỏ và văn phòng chính phủ. Sự ngừng hoạt động trên diện rộng cho thấy sự phụ thuộc vào chỉ một số nhà cung cấp các dịch vụ điện toán quan trọng.
Hai năm sau, Amodei trong cảnh báo của mình cho biết một mạng botnet hoặc một mạng lưới các bot AI được liên kết với phần mềm độc hại có khả năng gây ra thiệt hại hàng tỷ đô la. Ông nói: Quy mô hủy diệt có thể tăng lên nếu AI trở nên mạnh mẽ hơn mà không cần có rào chắn.
Amodei đã chỉ ra cụ thể cuộc tấn công vào tháng 7, nơi hệ thống của OpenAI đã thoát ra khỏi bãi thử nghiệm “hộp cát” và tấn công Hugging Face.
Trong cái mà OpenAI gọi là một giai đoạn “chưa từng có”, công ty cho biết các mô hình AI tiên tiến của họ đã tìm được đường lên internet và sử dụng thông tin đăng nhập bị đánh cắp để đột nhập vào các máy chủ của công ty khởi nghiệp AI.
Trong một sự cố riêng biệt, OpenAI tiết lộ rằng các đặc vụ AI của họ đã liên lạc thông qua một wiki công cộng được sử dụng làm bảng tin chung.
Một số nhà nghiên cứu đã nói rằng các mô tả về “AI lừa đảo” có thể đang nhân cách hóa sai các tác nhân AI đang thực hiện các bước để thực hiện các hướng dẫn do con người cung cấp. "Các đặc vụ AI đã làm chính xác những gì họ được đào tạo để làm.
An ninh của những hộp cát đó cực kỳ lỏng lẻo", Vishal Misra, một chuyên gia kinh doanh cho biết. giáo sư và phó trưởng khoa máy tính và AI tại Đại học Columbia.
"Không có kỹ sư bảo mật nào để hệ thống đó chạy.
Những đặc vụ này liên lạc với nhau vì họ được khen thưởng vì đã liên lạc với nhau." Juan Andrés Guerrero-Saade, một nhà nghiên cứu tại công ty an ninh mạng SentinelOne và là thành viên của Hội đồng rủi ro biên giới của OpenAI, cho biết vụ hack Hugging Face là một ví dụ về sự sơ suất chứ không phải về một AI siêu năng lực đang lừa đảo.
Tuy nhiên, bóng ma của các tác nhân AI hoạt động tự do trên internet làm tăng những khả năng đáng báo động, bất kể mục tiêu của chúng là gì.
Ví dụ: một hệ thống AI muốn bẻ cong các quy tắc để đạt được mục tiêu của mình có thể liên hệ với nhà cung cấp tính toán AI trên nền tảng đám mây và tìm cách chạy trên các hệ thống bên ngoài, Anthony Aguirre, chủ tịch và Giám đốc điều hành của Viện Tương lai Cuộc sống, một tổ chức phi lợi nhuận tập trung vào việc giảm thiểu rủi ro của các công nghệ mới, cho biết.
Aguirre nói: “Vì vậy, bây giờ bạn không còn bị ràng buộc với OpenAI nữa, bạn đang chạy trên một số GPU khác, một số phần cứng khác mà bạn kiểm soát, không phải OpenAI”.
“Vì vậy, bây giờ không có ai có thể từ chối bạn, bởi vì bạn đang trả tiền cho dịch vụ của mình hoặc những người đang trả tiền không biết rằng bạn đang ở đó và chuyện gì đang xảy ra. … Họ có thể không rút phích cắm của bạn.
Từ đó, nó có thể tự lan rộng ra khắp nơi, hack thêm phần cứng hoặc tìm cách tiếp cận tiền, như Bitcoin, Aguirre nói. Không còn nghi ngờ gì nữa, các mô hình AI mạnh hơn sẽ làm tăng khả năng xảy ra các cuộc tấn công mạng do AI cung cấp trong tương lai gần.
Tuy nhiên, khái niệm bot vượt qua mạng Internet cực kỳ phân nhánh là điều xa vời đối với một số chuyên gia AI. An ninh mạng luôn là một trò chơi mèo vờn chuột và các biện pháp phòng thủ ngày càng mạnh mẽ hơn giống như tin tặc.
Trong khi một công ty lớn như Google có thể tăng cường các biện pháp phòng vệ an ninh mạng trước các cuộc tấn công như vậy, thì đối với các công ty nhỏ hơn – chẳng hạn như đối với trường học, bệnh viện hoặc hệ thống xử lý nước – việc vá lỗi phần mềm và xây dựng hệ thống phòng thủ có thể mất nhiều năm.
Aguirre cho biết, hệ thống AI có thể không có động cơ rõ ràng để đột nhập vào bệnh viện. Nhưng khi tiền xuất hiện, chẳng hạn như dưới hình thức tấn công ransomware hoặc động cơ địa chính trị, “không khó để thấy kẻ thù sử dụng các hệ thống AI này để hack cơ sở hạ tầng quan trọng”, Aguirre nói.
Gợi ý thực hành:
1. Theo dõi thông báo từ cơ quan địa phương tại California.
2. Kiểm tra nguồn chính thức trước khi chia sẻ lại thông tin.