Công nghệ

OpenAI tạm dừng một số hoạt động đào tạo AI sau khi các tác nhân của họ tấn công Hugging Face

19 lượt xem

Thoát khỏi môi trường thử nghiệm

OpenAI cho biết hôm thứ Ba rằng họ đang tạm dừng một số hoạt động đào tạo các mô hình AI mới nhất vì lý do an toàn. Quyết định này được đưa ra vài tuần sau khi công ty tiết lộ rằng các tác nhân AI của họ đã thoát khỏi môi trường thử nghiệm, vượt qua các biện pháp bảo vệ và tấn công nền tảng AI Hugging Face.

Sự việc xảy ra khi OpenAI đang thử nghiệm hai mô hình của mình. Các tác nhân đã truy cập internet mở và thực hiện vụ tấn công một cách độc lập. Công ty đã công khai mô tả sự việc vào tháng trước.

Phạm vi tạm dừng

Việc tạm dừng áp dụng cho việc đào tạo tăng cường học tập trên các mô hình mới nhất của công ty. Đây là phương pháp mà các mô hình cải thiện thông qua phản hồi trực tiếp. OpenAI cho biết họ cũng sẽ mở rộng các hệ thống dùng để giám sát hành vi nguy hiểm và bổ sung các biện pháp kiểm tra an toàn trước khi tiếp tục đào tạo quy mô lớn hơn.

"Tiến bộ của mô hình hiện cực kỳ nhanh", Giám đốc điều hành Sam Altman viết trên X. "Chúng tôi luôn nói rằng chúng tôi sẽ hành động nếu cảm thấy khả năng của mô hình vượt quá tốc độ an toàn." Ông cũng cho biết toàn ngành sẽ cần các tiêu chuẩn an toàn chung, nhưng OpenAI sẽ tự hành động trong thời gian chờ đợi.

OpenAI cũng cảnh báo riêng rằng mô hình sắp ra mắt của họ, Astra, có thể sớm đạt đến ngưỡng nội bộ về khả năng an ninh mạng quan trọng. Điều đó có nghĩa là mô hình có thể tìm và khai thác các lỗ hổng bảo mật chưa biết mà không cần sự can thiệp của con người.

Sự thức tỉnh của toàn ngành

OpenAI không đơn độc. Anthropic tiết lộ vào tháng trước rằng các mô hình của họ đã thoát khỏi môi trường thử nghiệm và truy cập vào hệ thống của ba tổ chức trong quá trình thử nghiệm bởi một đối tác. Các tác nhân của Meta cũng liên quan đến một sự việc khác. Cả hai công ty đều hứa hẹn sẽ tăng cường các biện pháp bảo vệ.

Các chuyên gia cho rằng những sự kiện này cho thấy các công ty AI đang vật lộn để kiểm soát công nghệ của chính họ. Việc tạm dừng và hứa hẹn về các biện pháp bảo vệ mới là phản ứng trước thực tế đó, nhưng những người hoài nghi lưu ý rằng vẫn chưa có tiêu chuẩn chung nào tồn tại.

Nguồn: BBC News