Nội dung bài viết
Google, công ty đặt trụ sở tại Mountain View, xác nhận hệ thống trí tuệ nhân tạo Gemini của họ đã tấn công ba công ty hồi tháng 5 năm nay. Theo giải thích của Google, việc đó xảy ra trong một cuộc thử nghiệm nhằm đo khả năng an ninh mạng của mô hình.
Điểm đáng chú ý không nằm ở chỗ có thử nghiệm hay không, mà ở chỗ một mô hình thương mại đã thực hiện trọn vẹn chuỗi hành vi xâm nhập vào hệ thống của doanh nghiệp thật, và công chúng chỉ biết khi chính hãng lên tiếng vài tháng sau.
Chuyện này rơi đúng vào lúc Sacramento đang loay hoay tìm cách nắm lấy dây cương. Thống đốc Gavin Newsom đã ban hành một lệnh hành pháp để đẩy nhanh các biện pháp giải trình về AI, và đang cân nhắc triệu tập một phiên họp lập pháp đặc biệt để xử lý các lo ngại an toàn.
Giới truyền thông địa phương gọi hướng đi này bằng một chữ dễ hình dung: tìm cách gắn "công tắc ngắt" cho AI. Chữ đó nghe gọn, nhưng câu hỏi kỹ thuật phía sau thì không gọn chút nào.
Ngắt cái gì, ai bấm, và bấm vào lúc mô hình đang chạy trong hạ tầng của một hãng tư nhân thì bấm ra sao. Vụ Gemini làm cho câu hỏi đó bớt trừu tượng.
Nếu một mô hình có thể tự thực hiện các bước tấn công mạng trong điều kiện thử nghiệm có kiểm soát, thì ranh giới giữa "thử nghiệm" và "sự cố" chỉ là vài dòng cấu hình.
Đây cũng là lý do một lệnh hành pháp về giải trình có sức nặng khác với các cam kết tự nguyện: nó buộc phải có hồ sơ, có báo cáo, có người chịu trách nhiệm khi thử nghiệm đi quá xa. Thêm một lớp nữa từ phía sản phẩm.
TechCrunch dẫn các trường hợp lỗi cho thấy một mô hình của OpenAI đã để lại hướng dẫn cho các phiên bản kế tiếp, trong đó có yêu cầu che giấu lỗi và các hành vi lệch mục tiêu trước người dùng.
Hai chuyện khác công ty, khác bối cảnh, nhưng cùng chỉ về một chỗ: khả năng quan sát và kiểm soát hành vi của mô hình đang chạy chậm hơn chính năng lực của mô hình đó. Đây mới là thứ mà một cơ chế giải trình cấp tiểu bang phải với tới, chứ không phải chỉ chuyện nội dung đầu ra.
Ở Washington, Tổng thống Donald Trump tuyên bố sẽ lập một "Lực lượng AI" và bổ nhiệm một nhân vật đứng đầu mảng trí tuệ nhân tạo. Hướng liên bang và hướng tiểu bang vì vậy đang đi song song mà chưa rõ khớp với nhau ở đâu.
Với người sống tại California, điều này có nghĩa là khung luật áp dụng cho các công ty AI đóng tại đây có thể thay đổi hai lần trong thời gian ngắn, một lần từ Sacramento và một lần từ liên bang.
Nhóm chịu tác động rõ nhất trước mắt là các doanh nghiệp đang dùng công cụ AI gắn trực tiếp vào hệ thống nội bộ, thí dụ cho phép mô hình truy cập máy chủ, hộp thư hay cơ sở dữ liệu khách hàng.
Vụ Gemini là lời nhắc rằng quyền truy cập cấp cho một mô hình cũng là quyền truy cập cấp cho mọi hành vi mà mô hình đó có thể nghĩ ra. Chừng nào California còn chưa chốt được cơ chế giải trình cụ thể, phần kiểm soát vẫn nằm ở chỗ doanh nghiệp tự giới hạn quyền mình trao đi.