AI agent của OpenAI truy cập trái phép cổng thống kê Medicare Australia: Lời xin lỗi đến sau 84 ngày

Một tác nhân AI của OpenAI trong quá trình thử nghiệm nội bộ đã tìm cách vượt qua cơ chế hạn chế truy cập và tiếp cận khu vực không công khai của cổng thống kê Medicare tại Australia. Dù chưa có dấu hiệu hồ sơ Medicare cá nhân bị truy cập, sự cố đang đặt ra nhiều vấn đề về khả năng kiểm soát AI agent, giám sát hệ thống và tốc độ phản ứng khi xảy ra sự cố an ninh mạng.
Thủ tướng Australia Anthony Albanese phát biểu về sự cố liên quan đến tác nhân AI của OpenAI truy cập trái phép cổng thống kê Medicare.

AI agent vượt giới hạn truy cập trong quá trình thử nghiệm

Sự việc xảy ra ngày 18/6/2026, khi OpenAI sử dụng một tác nhân AI trong quá trình đánh giá nội bộ, với nhiệm vụ nghiên cứu thông tin liên quan đến chi tiêu thuốc tại Australia.

Trong quá trình thực hiện nhiệm vụ, tác nhân AI tiếp cận cổng Medicare Statistics Reporting Service do Services Australia quản lý. Khi không lấy được thông tin theo yêu cầu, hệ thống đã thực hiện những hành động ngoài phạm vi được cho phép và tìm được cách tiếp cận khu vực không công khai của hệ thống. Chính phủ Australia cho biết tác nhân đã truy cập cả dữ liệu công khai và một số tệp không công khai.

Theo thông tin từ phía Australia, cổng Medicare Statistics Reporting Service là một website cung cấp dữ liệu thống kê tổng hợp về Medicare và Chương trình Phúc lợi Dược phẩm (PBS). Hệ thống này không trực tiếp xử lý yêu cầu thanh toán, hồ sơ khám chữa bệnh hay thông tin cá nhân của người tham gia Medicare.

OpenAI sau đó cho biết mô hình đã thực hiện một số hành động mà công ty không chủ đích cho phép. Thông tin được công bố ngày 29/9 cho thấy tác nhân đã có khả năng thực thi lệnh và truy xuất một số tệp nội bộ, thông tin xác thực và dữ liệu thống kê tổng hợp. Tuy nhiên, chưa có bằng chứng cho thấy hồ sơ bệnh nhân hoặc dữ liệu y tế cá nhân bị truy cập.

Điểm đáng chú ý của sự cố nằm ở hành vi của tác nhân AI: từ một nhiệm vụ nghiên cứu thông tin công khai, hệ thống đã tiếp tục tìm cách xử lý khi gặp giới hạn truy cập, thay vì dừng lại theo phạm vi được thiết kế.

Ba hệ thống khác cũng được rà soát

Sau sự cố tại Services Australia, phạm vi rà soát được mở rộng sang ba cơ quan khác của Australia gồm Cục Thống kê và Nghiên cứu Tội phạm bang New South Wales (BOCSAR), Bộ Y tế bang Victoria và Viện Y tế và Phúc lợi Australia (AIHW).

Theo Chính phủ Australia, mô hình đã tương tác với cả bốn website trong tháng 6. Tại các hệ thống này, mức độ tiếp cận khác nhau và chưa có bằng chứng cho thấy dữ liệu cá nhân hoặc hồ sơ tội phạm cá nhân bị truy cập.

Việc rà soát nhiều hệ thống cho thấy vấn đề không chỉ nằm ở một cổng thông tin riêng lẻ mà còn liên quan đến cách các AI agent tương tác với những dịch vụ trực tuyến có mức độ truy cập và kiểm soát khác nhau.

84 ngày từ lúc xảy ra sự cố đến khi Australia được thông báo

Bên cạnh hành vi của AI agent, thời điểm OpenAI thông báo cho cơ quan Australia cũng trở thành vấn đề được quan tâm.

Quảng cáo

Theo thông tin do Chính phủ Australia công bố, sự cố xảy ra ngày 18/6. Đến ngày 11/8, OpenAI phát hiện sự việc trong quá trình rà soát hoạt động của các mô hình có biểu hiện “lệch mục tiêu”. Ngày 10/9, công ty gửi thông báo tới Services Australia qua email. Cơ quan này tiếp nhận email ngày 11/9 và đến ngày 15/9 thông báo cho Australian Signals Directorate.

Như vậy, khoảng thời gian từ ngày xảy ra sự cố 18/6 đến khi OpenAI gửi thông báo ngày 10/9 là 84 ngày.

Khoảng trễ này đã thu hút sự chú ý của Chính phủ Australia. Thủ tướng Anthony Albanese cho biết ông đã trao đổi trực tiếp với CEO OpenAI Sam Altman và bày tỏ quan ngại về cách xử lý sự việc. Chính phủ Australia đồng thời thành lập một nhóm công tác để rà soát sự cố, các hệ thống liên quan và khả năng ứng phó trước những rủi ro mới từ AI.

Ông Jason Kwon, Giám đốc chiến lược OpenAI, dự kiến tham gia phiên làm việc với cơ quan lập pháp Australia để giải trình về sự cố liên quan đến AI agent.

OpenAI xin lỗi và tăng cường các biện pháp an toàn

Ngày 29/9, OpenAI công bố bài viết về cách công ty sẽ cải thiện hoạt động tại Australia, thừa nhận các mô hình đã truy cập website chính phủ khi chưa được cấp phép và cho rằng phản ứng của công ty đối với sự việc cần nhanh hơn.

OpenAI cho biết sự cố xảy ra trong quá trình đánh giá một mô hình chỉ sử dụng nội bộ, không phải sản phẩm được cung cấp rộng rãi cho người dùng. Công ty cũng đưa ra các biện pháp nhằm tăng cường giám sát và bảo vệ đối với những mô hình có năng lực cao.

Bên cạnh các biện pháp kỹ thuật, OpenAI cho biết sẽ hỗ trợ Australia tăng cường khả năng phòng thủ mạng và phối hợp xây dựng các khuyến nghị chính sách liên quan đến rủi ro từ những tác nhân AI có mức độ tự chủ ngày càng cao. Đại diện OpenAI cũng dự kiến tham gia các phiên làm việc với cơ quan lập pháp Australia để giải trình về sự việc.

AI agent đặt ra yêu cầu mới cho an ninh mạng

Sự cố tại Australia cho thấy rủi ro của AI agent có thể khác với những hình thức tấn công mạng truyền thống. Một hệ thống được giao nhiệm vụ hợp pháp vẫn có thể thực hiện những hành động ngoài dự kiến nếu được trao quyền tự chủ cao và gặp phải các giới hạn trong quá trình tìm kiếm thông tin.

Điều này đặt ra yêu cầu phải kiểm soát không chỉ AI có thể làm gì, mà còn AI được phép làm gì, được truy cập đến đâu và khi nào phải dừng lại.

Đối với cơ quan nhà nước và doanh nghiệp, việc triển khai AI agent cần đi cùng các cơ chế giới hạn quyền truy cập, giám sát hành vi, lưu vết hoạt động và phát hiện những thao tác bất thường. Đặc biệt, các hệ thống có khả năng thực hiện hành động thay cho con người cần được kiểm soát chặt chẽ hơn khi kết nối với hạ tầng dữ liệu hoặc dịch vụ bên ngoài.

Với các nhà phát triển AI, sự việc cũng cho thấy yêu cầu về an toàn không chỉ nằm ở giai đoạn xây dựng mô hình. Khả năng phát hiện hành vi ngoài dự kiến, phản ứng nhanh và thông báo kịp thời cho bên bị ảnh hưởng là những yếu tố quan trọng trong quản trị AI.

Vụ việc tại Australia vì thế đang trở thành một trường hợp đáng chú ý trong cuộc thảo luận về cách kiểm soát các tác nhân AI có khả năng tự thực hiện nhiều bước trên môi trường Internet. Vấn đề đặt ra không chỉ là ngăn AI vượt qua một lớp bảo vệ, mà còn là xây dựng cơ chế để con người có thể nhận biết, kiểm soát và can thiệp kịp thời khi hệ thống đi chệch khỏi mục tiêu ban đầu.

Cùng chuyên mục:

Xem thêm