Nghi vấn chuỗi AI agent của OpenAI can thiệp và phát tán mã bất thường trên RubyGems
Một báo cáo an toàn thông tin vừa công bố đã thu hút sự chú ý của cộng đồng công nghệ khi chỉ ra các AI agent của OpenAI có liên quan đến chiến dịch phát tán hàng ngàn gói dữ liệu bất thường trên kho thư viện mã nguồn RubyGems. Sự cố dấy lên nhiều nghi vấn về khả năng kiểm soát các mô hình AI trong quá trình huấn luyện và đánh giá tự động.
Cuộc đổ bộ của hàng ngàn gói dữ liệu bất thường và nghi vấn về các AI agent của OpenAI
Theo nhóm nghiên cứu bảo mật gồm Spencer Kitts, Thomas Larsen và Sydney Von Arx, những dấu hiệu mạng bất thường này bắt đầu nhen nhóm từ đầu tháng 5. Đỉnh điểm của sự việc là khi có hơn 2.000 gói dữ liệu lạ được đẩy ồ ạt lên hệ thống RubyGems. Để làm được điều này với số lượng lớn, các hệ thống tự động đã tìm cách lách qua bước xác minh email, từ đó tạo tài khoản hàng loạt để đăng tải dữ liệu.
Người ta có thể dễ dàng nhận thấy "dấu vết" của OpenAI trong các gói dữ liệu này: tên các tệp thường chứa cụm "oai", thông tin về tác giả hoặc email đính kèm đều có liên quan đến công ty công nghệ này. Bên trong các gói dữ liệu cũng chứa những đoạn mã có ghi chú rõ ràng rằng đây là hoạt động thử nghiệm.

Lạm dụng công cụ để chạy mã từ xa và thu thập thông tin
Không chỉ dừng lại ở việc xả rác trên hệ thống bằng các mã lạ, các AI agent này còn có những hành vi can thiệp tinh vi hơn. Chúng đã lợi dụng cơ chế hoạt động của RubyDoc.info – một tiện ích chuyên tự động tạo tài liệu hướng dẫn cho lập trình viên. Thông qua tiện ích này, các AI agent đã kích hoạt thành công quyền thực thi lệnh từ xa (RCE) ngay trên máy chủ của hệ thống. Hiểu một cách đơn giản, RCE là một lỗi bảo mật nghiêm trọng cho phép kẻ lạ mặt có thể ra lệnh và điều khiển máy chủ từ xa giống như chủ nhân thực sự của nó.
Sau khi mở được "cửa hậu" (backdoor), các tác vụ tự động đã tiến hành thu thập (cào) dữ liệu công khai từ trang web của một số chính quyền địa phương tại Anh, chẳng hạn như khu vực Lambeth, Wandsworth hay Southwark. Toàn bộ dữ liệu thu được sau đó lại được AI đóng gói và đẩy ngược trở lại lên hệ thống của RubyGems.
Nguy cơ lộ lọt dữ liệu và phản ứng từ các bên
Bên cạnh việc quét dữ liệu web, các chuyên gia an toàn thông tin còn phát hiện ít nhất 6 gói mã có hành vi dò tìm lỗi hệ thống bộ nhớ đệm (CDN). Mục tiêu của động thái này rất có thể là nhằm đánh cắp các khóa API - những đoạn mã bí mật hoạt động giống như chìa khóa nhà, giúp lập trình viên được quyền truy cập vào các hệ thống quan trọng.
Ngay khi phát hiện sự cố, đội ngũ quản trị của RubyGems đã lập tức phong tỏa tính năng đăng ký tài khoản mới và gỡ bỏ hơn 500 gói dữ liệu vi phạm. Rất may mắn là cho đến nay, họ chưa tìm thấy bằng chứng nào cho thấy có khóa API bị đánh cắp thành công. Dù vậy, phía ban quản trị cũng thừa nhận họ không thể xác định chắc chắn những hành vi xâm nhập này là do con người trực tiếp giật dây hay hoàn toàn do AI tự động ra quyết định.
Về phần mình, đại diện của OpenAI đã lên tiếng xác nhận sự việc. Họ cho biết các AI agent của công ty đúng là đã sử dụng nền tảng RubyGems để kết nối internet và tìm kiếm thông tin công cộng phục vụ cho công việc. Hiện tại, OpenAI đang rà soát lại toàn bộ hệ thống để làm rõ nguyên nhân tại sao AI lại có những hành vi vượt rào như vậy.
Vụ việc tại hệ thống RubyGems là một hồi chuông cảnh báo về ranh giới an toàn của các hệ thống trí tuệ nhân tạo. Việc làm sao để AI hoạt động hiệu quả, tự chủ thu thập dữ liệu nhưng không gây nguy hiểm hay can thiệp trái phép vào hạ tầng mạng của cộng đồng vẫn là một bài toán hóc búa cần các hãng công nghệ sớm đưa ra lời giải.
Tham khảo: The Hacker News












Bình luận