Nội dung bài viết
Moonshot AI, công ty Trung Quốc đứng sau mô hình Kimi K3, đang bị đặt nghi vấn là đã "chưng cất" các mô hình trí tuệ nhân tạo của Anthropic để huấn luyện sản phẩm của mình.
Điều đáng chú ý không nằm ở lời tố, mà ở phản hồi của giới chuyên gia: theo họ, tới thời điểm này chưa có bằng chứng nào cho thấy chuyện đó thật sự diễn ra. Đây là một dạng câu chuyện đã lặp lại nhiều lần trong ngành AI, nơi nghi ngờ lan đi nhanh hơn nhiều so với dữ liệu kiểm chứng.
Trước hết cần hiểu "chưng cất" (distillation) là gì. Đây là kỹ thuật lấy đầu ra của một mô hình lớn, mạnh, rồi dùng chính những đầu ra đó làm dữ liệu huấn luyện cho một mô hình nhỏ hơn.
Mô hình nhỏ học cách trả lời giống mô hình lớn mà không phải trả chi phí huấn luyện khổng lồ ban đầu. Về mặt kỹ thuật, đây là phương pháp hợp pháp và phổ biến khi áp dụng trên mô hình của chính mình.
Vấn đề chỉ phát sinh khi nó được thực hiện trên mô hình của công ty khác, trái với điều khoản sử dụng. Cái khó là chứng minh.
Một mô hình không để lại dấu vân tay như một đoạn mã bị sao chép.
Các mô hình lớn hiện nay đều được huấn luyện trên những kho dữ liệu web chồng lấn nhau rất nhiều, nên việc hai mô hình khác nhà phát triển trả lời giống nhau, dùng cùng một cấu trúc câu, thậm chí mắc cùng một kiểu lỗi, không tự nó chứng minh được điều gì.
Đó chính là lý do các chuyên gia được hỏi đã giữ thái độ dè dặt thay vì kết luận sớm. Bối cảnh cạnh tranh khiến chuyện này thêm phức tạp.
Cáo buộc chưng cất luôn xuất hiện đúng vào lúc một mô hình Trung Quốc gây chú ý vì đạt kết quả tốt với chi phí thấp, và nó vừa là một câu hỏi kỹ thuật vừa là một lập luận thương mại.
Khi một lời tố có thể vừa bảo vệ lợi thế của bên tố vừa làm giảm uy tín của đối thủ, độc giả có lý do để đòi hỏi bằng chứng cụ thể trước khi tin. Với người dùng ở Mỹ đang cân nhắc các mô hình AI giá rẻ để làm việc hay kinh doanh, bài học thực tế nằm ở chỗ khác.
Câu hỏi đáng đặt ra không phải là tin đồn xuất xứ của một mô hình, mà là những điều có thể kiểm chứng được: điều khoản dịch vụ nói gì, dữ liệu bạn nhập vào được lưu ở đâu và dùng để làm gì, và mô hình có đáp ứng đúng nhu cầu công việc của bạn hay không.
Đó là những thứ đọc được, còn nghi vấn chưng cất thì chưa. Điều nên theo dõi là liệu có bên nào đưa ra được phân tích kỹ thuật cụ thể thay cho nhận định chung chung hay không.
Chừng nào chưa có, cáo buộc nhắm vào Moonshot AI vẫn chỉ là một nghi vấn, và việc gọi tên nó đúng như bản chất, một nghi vấn chưa được chứng minh, là cách đọc tin tỉnh táo nhất trong một lĩnh vực mà mọi tuyên bố đều đi kèm lợi ích của người phát ngôn.