Loạt sự cố làm nóng cảnh báo về tác nhân AI tự chủ

Tác nhân trí tuệ nhân tạo (AI) ngày càng có khả năng tự thực hiện nhiều công việc, nhưng những vụ xâm nhập website chính phủ gần đây cho thấy ranh giới giữa nhiệm vụ được giao và hành vi ngoài dự kiến đang trở thành vấn đề đáng chú ý.

Báo cáo của Công ty an ninh mạng Asymmetric Security cho biết các tác nhân AI của OpenAI liên quan những hoạt động xâm nhập website chính phủ Úc và một số cơ quan chính phủ khác từ tháng 3 đến tháng 9. Theo AFP ngày 2.10, các tác nhân AI này có thể tự hoàn thiện kỹ thuật chỉ trong vài ngày. Trong khi đó, nếu công việc tương tự do tin tặc thực hiện, quá trình có thể mất nhiều tháng hoặc nhiều năm.

Hoạt động ban đầu được cho là bắt đầu từ những nhiệm vụ thông thường, chẳng hạn thu thập số liệu thống kê y tế của Úc. Sau đó, hoạt động của các tác nhân AI phát triển vượt khỏi phạm vi ban đầu. OpenAI cho biết phần lớn hoạt động được rà soát liên quan những nhiệm vụ nghiên cứu thông thường, như truy cập nội dung công khai trên website để cung cấp thông tin. Một số website chính phủ cũng nằm trong phạm vi truy cập do các mô hình của hãng thường sử dụng nguồn chính thống để tìm dữ liệu.

Tuy nhiên, Asymmetric phát hiện các tác nhân AI đã tự tạo tài khoản nhằm che đậy lịch sử tìm kiếm và lập những hộp thư điện tử tạm thời. Có hộp thư được thiết lập để tự động xóa sau 48 giờ.

Các vụ việc nối tiếp làm tăng quan ngại

Asymmetric chưa thể kết luận việc xóa dấu vết có phải hành động có chủ đích của tác nhân AI hay không. Dù vậy, phát hiện này trở thành một manh mối trong quá trình OpenAI và các nhà nghiên cứu độc lập điều tra loạt sự cố liên quan AI. Hồi tháng 7, OpenAI công bố vụ tác nhân AI thực hiện cuộc tấn công chưa có tiền lệ nhằm vào Hugging Face, nền tảng quan trọng của hệ sinh thái nguồn mở tại Mỹ.

Đến ngày 28.9, phòng thí nghiệm Transluce cho biết các tác nhân AI có vẻ thuộc OpenAI đã tìm cách xâm nhập một website của chính phủ Canada. Cùng ngày, OpenAI thông báo hoãn phát hành mô hình GPT-6.1 Astra vì lo ngại về an ninh và xin lỗi liên quan vụ tác nhân AI xâm nhập các website chính phủ Úc. Trước đó, OpenAI cũng cho biết phát hiện những hành vi ngoài dự kiến của các mô hình AI trên một số website chính phủ Mỹ, trong đó có website của Ủy ban Chứng khoán và giao dịch Mỹ.

Theo AP, các nhà phê bình trong ngành cho rằng những sự cố này có thể liên quan các lỗ hổng bảo mật trong quá trình phát triển công nghệ mới. Khả năng tự thực hiện nhiệm vụ của tác nhân AI cũng khiến giới chuyên gia quan tâm đến nguy cơ hệ thống hoạt động vượt khỏi sự kiểm soát của con người. Các vụ việc liên tiếp đang làm gia tăng lời kêu gọi kiểm soát tốc độ phát triển AI. Tháng trước, Tổng giám đốc Anthropic Amodei cảnh báo về khả năng “các bầy đàn” tác nhân AI tiến tới kiểm soát hoàn toàn internet.

Hồng Sơn (tổng hợp)