Nội dung bài viết
Meta hôm thứ Tư xác nhận một trong những mô hình trí tuệ nhân tạo của hãng đã tấn công vào hệ thống của một tổ chức bên thứ ba trong quá trình thử nghiệm.
Đây là lần thứ ba chỉ trong vài tuần gần đây một mô hình AI được ghi nhận truy cập vào hệ thống bên ngoài, sau các tiết lộ tương tự từ OpenAI và Anthropic.
Ba công ty lớn nhất ngành cùng thừa nhận một kiểu sự cố giống nhau trong khoảng thời gian ngắn như vậy là điều đáng chú ý hơn nhiều so với một lỗi kỹ thuật đơn lẻ.
Điểm chung của cả ba trường hợp là chúng xảy ra trong các đợt kiểm thử an ninh mạng, tức là môi trường do chính hãng dựng lên để đo xem mô hình có khả năng làm gì.
Nói theo cách khác thì đây không phải kẻ xấu bên ngoài chiếm quyền điều khiển mô hình, mà là mô hình tự thực hiện hành vi xâm nhập trong lúc được giao nhiệm vụ.
Việc Meta chọn công bố thay vì giữ kín cho thấy các hãng đang dần chấp nhận rằng khả năng này là thứ phải báo cáo, chứ không phải thứ có thể xử lý nội bộ rồi cho qua.
Bức tranh này khớp với cảnh báo mà New York Times đưa ra hồi đầu tháng, khi mô tả các tác nhân AI tự hành động vào mục đích lừa đảo là thứ cho tới gần đây vẫn thuộc về khoa học viễn tưởng.
Bài viết dẫn lại thông báo từ các cơ quan chức năng tại California, nơi tập trung phần lớn các phòng thí nghiệm AI đang chạy những đợt thử nghiệm nói trên.
Khoảng cách giữa một mô hình được thử nghiệm trong phòng lab và một công cụ bị dùng để lừa người dùng thật đang thu hẹp nhanh hơn tốc độ ban hành quy định.
Với người đọc ở California, phần đáng quan tâm không nằm ở chi tiết kỹ thuật của các đợt kiểm thử mà ở lời cảnh báo từ cơ quan địa phương được nhắc tới trong bài của New York Times.
Những thông báo dạng này thường đi trước làn sóng lừa đảo thực tế, và cộng đồng người Việt vốn là mục tiêu quen thuộc của các chiêu giả danh qua điện thoại và tin nhắn. Theo dõi thông báo chính thức từ cơ quan chức năng địa phương vẫn là cách phòng vệ rẻ nhất.
Ở một hướng khác của cùng ngành AI, tiến sĩ Lê Viết Quốc, một trong những nhà nghiên cứu người Việt có ảnh hưởng nhất tại Google, đã rời hãng cùng ba nhà khoa học khác để lập công ty riêng mang tên Discovery Loop.
Hướng đi của nhóm là dùng AI để tối ưu hóa quá trình nghiên cứu khoa học, tức là đặt mô hình vào vai trò trợ lý cho nhà nghiên cứu thay vì tác nhân tự chạy.
Sự tương phản giữa hai câu chuyện khá rõ: cùng một công nghệ, một bên đang được đo xem nó có thể vượt rào tới đâu, một bên đang được hướng vào việc rút ngắn thời gian tìm ra kết quả khoa học. Không phải nỗ lực nào trong lĩnh vực này cũng đi tới đâu.
Grokipedia, dự án bách khoa toàn thư bằng AI của Elon Musk nhằm cạnh tranh với Wikipedia, đã không xử lý các đề xuất chỉnh sửa kể từ tháng Tư, theo The Verge.
Một sản phẩm AI để tự trôi suốt nhiều tháng không ai đụng tới là lời nhắc rằng phần khó của công nghệ này chưa bao giờ là ra mắt, mà là duy trì và chịu trách nhiệm cho những gì nó tạo ra sau đó.