Đội an ninh của Anthropic cho biết một mô hình AI mã nguồn mở rẻ hơn đã tự dựng được một cuộc tấn công hoạt động hoàn chỉnh từ 2 lỗi phần mềm đã công khai từ trước, chỉ trong chưa đầy một ngày và với chi phí 20,4 USD. Con số này cho thấy các cuộc tấn công mạng thực sự giờ đã rẻ đến mức nào đối với bất kỳ ai có quyền truy cập mô hình này.
Chuyện gì đã xảy ra
Theo báo cáo của Frontier Red Team thuộc Anthropic, một nhà nghiên cứu đã dùng GLM-5.3-Flash, phiên bản nhỏ và mã nguồn mở của Zhipu AI (Trung Quốc), để dựng một chuỗi khai thác đáng tin cậy từ 2 lỗ hổng vốn đã được công bố công khai. Toàn bộ chi phí là 20,4 USD, tính theo giá API của Zhipu. Báo cáo của đội ngũ này cho biết công việc tốn 20 phút con người theo dõi và 8 giờ mô hình tự xử lý. Cùng thời điểm, tổng chưởng lý bang Florida đã đề nghị một thẩm phán tiểu bang ngăn OpenAI cung cấp ChatGPT cho trẻ vị thành niên tại Florida, trong lúc vụ kiện của ông nhắm vào công ty này vẫn đang tiếp diễn. Đây chỉ là 1 trong 6 yêu cầu cấm được nêu trong đơn kiến nghị dài 49 trang xin lệnh cấm tạm thời, nộp qua hệ thống điện tử ngày 28 tháng 9. Chưa có tòa án nào ra phán quyết cho bất kỳ yêu cầu nào trong số 6 yêu cầu đó.
Bối cảnh sự việc
Thông thường, việc dựng một chuỗi khai thác đòi hỏi chuyên gia lành nghề mất nhiều ngày làm việc thủ công. Bài kiểm chứng của Anthropic cho thấy khoảng cách đó đang bị thu hẹp. Cả 2 lỗ hổng được dùng đều đã công khai từ trước, nghĩa là bản vá đã tồn tại, nhưng một mô hình giá rẻ vẫn biến chúng thành một cuộc tấn công thực sự hoạt động. Đơn kiến nghị của Florida không phải một vụ kiện mới. Đó là một yêu cầu nằm trong vụ kiện mà tổng chưởng lý bang này đã nộp từ trước nhắm vào OpenAI, nhằm xin thẩm phán tạm dừng quyền truy cập của trẻ vị thành niên trước khi vụ án có phán quyết cuối cùng. Cả 2 câu chuyện đều chưa đi đến một quy định dứt khoát nào. Cả 2 đều cho thấy các cơ quan chức năng đang cố gắng đuổi theo thứ vốn đã chuyển động từ trước.
Vì sao điều này quan trọng với bạn
Với bất kỳ ai đang vận hành phần mềm, một lỗi đã biết không còn an toàn chỉ vì đâu đó đã có bản vá. Công cụ AI giá rẻ đồng nghĩa kẻ tấn công có thể ra tay trước khi hầu hết mọi người kịp cập nhật. Với những người xây dựng sản phẩm, bài học là phải vá lỗi thật nhanh và mặc định rằng ai đó đang thử khai thác lỗi cũ ngay lúc này. Với phụ huynh và thanh thiếu niên ở Florida, chưa có gì thay đổi. Đây mới chỉ là một yêu cầu, chưa phải phán quyết, nên quyền truy cập ChatGPT của trẻ vị thành niên tại bang này vẫn giữ nguyên cho đến khi thẩm phán ra quyết định. Những ai đang dựa vào sản phẩm AI cho trẻ em nên chuẩn bị tinh thần sẽ còn nhiều cuộc tranh đấu tương tự, ở nhiều bang khác, trước khi quy định được định hình rõ ràng.
Câu hỏi lớn hơn
Giới an ninh phần mềm từ lâu vẫn tin rằng việc vá một lỗi đã biết sẽ mua được thời gian trước khi ai đó khai thác nó. Nếu một mô hình mã nguồn mở, ai cũng tiếp cận được, có thể biến 2 lỗi đã công bố thành một cuộc tấn công thực sự chỉ với 20,4 USD, thì niềm tin đó còn đứng vững đến đâu, và ai sẽ là người lấp khoảng trống này khi chi phí tấn công đã rẻ đến mức gần như bất kỳ ai có internet cũng làm được?
Những gì cần theo dõi
Chưa có ngày xét xử nào được ấn định cho đơn kiến nghị lệnh cấm tạm thời của Florida. Yêu cầu này vẫn đang chờ phán quyết. Báo cáo của Anthropic cũng không nói rõ liệu họ có thử nghiệm cùng chuỗi khai thác này trên các mô hình lớn hơn hoặc với các nhà cung cấp khác hay không. Những ai theo dõi tốc độ các lỗi đã biết biến thành tấn công thực sự nên chú ý đến bản cập nhật tiếp theo của Frontier Red Team từ Anthropic, cũng như phán quyết của thẩm phán trong vụ kiện ở Florida, tùy cái nào đến trước.



