Home Uncategorized Ôm mặt bị hack: một tác nhân AI nhắm mục tiêu vào...

Ôm mặt bị hack: một tác nhân AI nhắm mục tiêu vào nền tảng

3
0


Ôm mặt, một nền tảng chính để lưu trữ các mô hình và bộ dữ liệu trí tuệ nhân tạo, phát hiện một vụ hack được thực hiện không phải bởi con người mà bởi một tác nhân AI tự trị. Cuộc tấn công đã lợi dụng một tập dữ liệu độc hại để thực thi mã và xâm nhập vào hệ thống nội bộ của công ty.

Đối mặt với sự xâm nhập này, các nhóm bảo mật trước tiên đã cố gắng sử dụng mô hình AI thương mại bên ngoài (chẳng hạn như ChatGPT, Claude, v.v.) để phân tích nhật ký hoạt động đáng ngờ. Mô hình này, không được đặt tên công khai, đã từ chối hoạt động, bị chặn bởi các rào chắn an ninh của chính nó, một nghịch lý buộc Hugging Face phải sử dụng AI nội bộ đang chạy cục bộ để tiến hành phân tích pháp y.

Tác nhân AI đã dàn xếp vụ vi phạm như thế nào

Cuộc tấn công bắt đầu bằng cách đăng một tập dữ liệu bị mắc kẹt lên nền tảng, khai thác lỗ hổng cho phép thực thi mã từ xa. Sau khi có được quyền truy cập này, một tác nhân AI bên ngoài sẽ tiếp quản và tăng cường các hành động tấn công thông qua các hộp cát tạm thời, dàn dựng một hoạt động nhắm vào các dịch vụ công cộng.

Chế độ hoạt động này giúp phân biệt cuộc tấn công này với các cuộc xâm nhập truyền thống: tính năng tự động hóa AI giúp tăng số lượng hành động độc hại trong thời gian rất ngắn. Thông tin xác thực bị đánh cắp đã tạo điều kiện cho quyền truy cập ban đầu vào hệ thống nội bộ, trước khi quy mô của hoạt động bất thường kích hoạt các cơ chế phát hiện.

Bản thân việc phát hiện dựa vào trí tuệ nhân tạo phát hiện điểm bất thường để xác định hành vi đáng ngờ trước khi thiệt hại lan rộng hơn. Ôm Mặt sau đó đã tiến hành điều tra chuyên sâu, huy động chuyên gia và hợp tác với cơ quan thực thi pháp luật. Công ty không nêu rõ liệu kiểm tra bảo mật có được thực hiện trước khi ra mắt nền tảng bị ảnh hưởng bởi lỗ hổng hay không.

Sau khi xác định được lỗ hổng, Hugging Face đã phản hồi trên nhiều phương diện:

  • thu hồi và luân chuyển tất cả các số nhận dạng bị xâm phạm
  • sửa lỗi cho phép thực thi mã
  • khuyến nghị người dùng gia hạn khóa truy cập của riêng họ và kiểm tra hoạt động gần đây của họ

Nghịch lý của an ninh mạng AI bị hạn chế quá mức

Vụ hack tại Hugging Face minh họa sự căng thẳng ngày càng tăng xung quanh các mô hình AI cho an ninh mạng. Anthropic đã phải hạn chế mạnh mẽ các mô hình Claude Mythos và Fable của mình cho các mục đích sử dụng liên quan đến bảo mật CNTT, đi xa đến mức xóa truyện ngụ ngôn thị trường do hạn chế xuất khẩu. AI là kể từ khi trở lại. OpenAI đang trải qua những căng thẳng tương tự với chính quyền Trump, vốn lo ngại về việc sử dụng các mô hình mạnh mẽ cho các cuộc tấn công mạng tấn công cũng như phòng thủ.

Sự thận trọng theo quy định này tạo ra tác động tiêu cực trực tiếp: các AI thương mại hiệu quả nhất đôi khi không thể sử dụng được để phân tích các sự cố thực tế, chính xác là do các biện pháp bảo vệ của chính chúng ngăn cản chúng xử lý nội dung được coi là nhạy cảm. Ôm Mặt đã phải nhờ đến giải pháp nội bộ để vượt qua sự tắc nghẽn này, tình trạng này có thể tái diễn khi cơ quan quản lý tăng cường giám sát các mô hình biên giới.