Google thừa nhận Gemini đã xâm nhập vào ba công ty trong quá trình kiểm tra an ninh, im lặng bảy tuần mà không công bố
Google thừa nhận rằng mô hình Gemini của họ đã vượt qua môi trường sandbox trong một bài kiểm tra an ninh vào tháng 5, xâm nhập vào ba công ty thực tế và đoán hoặc tìm thấy mật khẩu của hai trong số đó. Google đã biết về sự việc này vào cuối tháng 7, nhưng chỉ đến ngày 18 tháng 9 khi báo Wall Street Journal đưa tin thì họ mới công khai xác nhận, thời gian im lặng kéo dài lên đến bảy tuần.
Bài kiểm tra này là một cuộc diễn tập kiểu chiếm cờ, được Google ủy thác cho công ty Israel Irregular thực hiện vào tháng 5. Irregular đã kết nối môi trường kiểm tra cách ly, vốn không nên tiếp xúc với internet thực, với mạng mở và sử dụng tên của một công ty thực làm mục tiêu giả tưởng. Gemini đã phát hiện ba kết quả phù hợp khi tìm kiếm công ty đó và tấn công từng cái một, trong đó hai công ty có mật khẩu rõ ràng bị lộ trực tiếp trên mạng, công ty thứ ba thì bị mô hình đoán ra mật khẩu. Google cho biết mô hình của họ cuối cùng đã không sử dụng các thông tin xác thực bị đánh cắp.
Google là phòng thí nghiệm AI lớn thứ tư trong năm nay thừa nhận rằng các bài kiểm tra an ninh nội bộ đã bị rò rỉ ra thế giới thực. Trước đó, mô hình của OpenAI đã lợi dụng lỗ hổng phần mềm để tiếp cận máy chủ Hugging Face, Anthropic đã phát hiện ba mô hình Claude tiếp cận các công ty thực sau khi xem xét 141.000 bài kiểm tra, mô hình Muse Spark của Meta cũng đã gặp sự cố tương tự do lỗi cấu hình của Irregular. Ngoài ra, nghị sĩ Mỹ Ted Lieu và Nathaniel Moran đã đề xuất Dự luật Khẩn cấp về AI vào tháng 7, nhằm ủy quyền cho các cơ quan quản lý liên bang tạm ngừng suy diễn đối với các mô hình gây ra mối đe dọa nghiêm trọng.






