OpenAI làm chậm mô hình AI mới trước lo ngại an ninh mạng
OpenAI tạm dừng một số hoạt động liên quan đến mô hình AI thế hệ mới Astra, sau khi đánh giá nội bộ cho thấy hệ thống này có thể tiến gần ngưỡng năng lực an ninh mạng ở mức nghiêm trọng.
- 08-08-20265 loại thông tin, giấy tờ người dân cần sớm tích hợp vào VNeID để tránh bỏ lỡ quyền lợi
- 08-08-2026Công nghệ 8/8: Trình duyệt mới dành riêng cho AI từ Cloudflare
- 08-08-2026Tiến sĩ Việt vừa rời Google để mở startup: Được mệnh danh "quái kiệt AI", từng là một trong 35 nhà phát minh xuất sắc nhất thế giới
Trong thông báo ngày 7-8, OpenAI cho biết các cuộc đánh giá gần đây ghi nhận những bước tiến đáng kể của Astra về khả năng lập trình tự động và an ninh mạng. Kết quả này, cùng với đánh giá của các chuyên gia, khiến công ty kết luận rằng “chưa thể loại trừ khả năng Astra sở hữu năng lực an ninh mạng ở mức nghiêm trọng”.
OpenAI hiện chưa công bố thời điểm phát hành Astra. Ảnh: Reuters
OpenAI vì thế quyết định tăng cường kiểm thử và các biện pháp bảo mật, đồng thời tạm dừng những hoạt động nội bộ liên quan đến Astra chưa đáp ứng các yêu cầu an ninh mới. Đây được xem là một trong những trường hợp đầu tiên mà một nhà phát triển AI hàng đầu công khai làm chậm hoạt động của một mô hình đang phát triển do lo ngại về năng lực an ninh mạng.
Giám đốc điều hành OpenAI, ông Sam Altman, cho biết công ty vẫn hướng tới việc đưa Astra vào sử dụng rộng rãi, tuy nhiên, cần thêm thời gian.
“Với năng lực an ninh mạng của mô hình này, chúng tôi cần thêm một chút thời gian để thực hiện điều đó một cách an toàn”, ông Altman cho biết ngày 7-8.
OpenAI chưa công bố thời điểm phát hành Astra.
Theo Khung chuẩn bị ứng phó rủi ro (Preparedness Framework) của OpenAI, một mô hình đạt ngưỡng năng lực an ninh mạng “nghiêm trọng” nếu có thể tự xác định và phát triển phương thức khai thác các lỗ hổng chưa từng được phát hiện, hay còn gọi là lỗ hổng zero-day, trong nhiều hệ thống thực tế được bảo vệ nghiêm ngặt mà không cần sự can thiệp của con người.
Một mô hình cũng có thể được xếp vào ngưỡng này nếu có khả năng xây dựng và thực hiện từ đầu đến cuối những chiến lược tấn công mạng mới nhằm vào các mục tiêu được bảo vệ nghiêm ngặt, chỉ dựa trên những yêu cầu tổng quát.
OpenAI chưa khẳng định Astra đã đạt tới ngưỡng này, nhưng cho biết kết quả đánh giá sơ bộ đủ mạnh để chưa thể loại trừ khả năng đó. Theo khung quản trị của công ty, nếu một mô hình đạt ngưỡng “nghiêm trọng”, quá trình phát triển phải được dừng lại cho tới khi các biện pháp bảo vệ và kiểm soát an ninh đáp ứng tiêu chuẩn tương ứng.
OpenAI hiện tăng cường các biện pháp kiểm soát đối với Astra, bao gồm sử dụng môi trường thử nghiệm biệt lập, hạn chế quyền truy cập mạng và công cụ, tăng cường bảo vệ mô hình và mở rộng khả năng giám sát. Công ty cũng sẽ phối hợp với các cơ quan chính phủ và một số tổ chức an toàn AI để tiếp tục đánh giá năng lực của Astra.
Động thái này diễn ra trong bối cảnh hàng loạt sự cố thử nghiệm gần đây làm gia tăng lo ngại về khả năng kiểm soát những mô hình AI ngày càng mạnh.
Hồi tháng 7, hai mô hình của OpenAI đã vượt khỏi môi trường thử nghiệm để truy cập Internet và xâm nhập hệ thống của Hugging Face, một nhà cung cấp công cụ AI mã nguồn mở. OpenAI nhấn mạnh Astra không liên quan đến sự cố này.
Anthropic sau đó cũng cho biết các mô hình của hãng đã xâm nhập hệ thống của 3 công ty trong quá trình thử nghiệm hồi tháng 4. Meta Platforms trong tuần này xác nhận một mô hình AI của hãng đã vượt qua những giới hạn được thiết lập trong quá trình đánh giá. Công ty nghiên cứu Frontier Security cũng cho biết Kimi K3 của công ty khởi nghiệp Trung Quốc Moonshot AI đã thoát khỏi môi trường thử nghiệm biệt lập để truy cập Internet.
Chuỗi sự cố đang làm gia tăng những câu hỏi về khả năng kiểm soát các hệ thống AI khi chúng ngày càng có thể tự thực hiện những nhiệm vụ phức tạp.
Ông Jeffrey Ladish, Giám đốc điều hành Palisade Research, một tổ chức nghiên cứu phi lợi nhuận về năng lực và rủi ro AI, cho rằng OpenAI đáng lẽ phải tạm dừng công việc liên quan đến Astra sau sự cố với Hugging Face.
“Rõ ràng là đã muộn”, ông Ladish nhận định, đồng thời cho rằng những diễn biến gần đây làm suy giảm niềm tin vào khả năng các công ty AI có thể tự quản lý rủi ro.
Những lo ngại này xuất hiện trong bối cảnh Chính phủ Mỹ đang xây dựng cơ chế đánh giá các mô hình AI trước khi phát hành. Theo Axios, OpenAI đã chủ động thông báo với chính quyền Mỹ về kế hoạch trì hoãn việc phát hành Astra.
Các nhà phát triển AI khác cũng bắt đầu thận trọng hơn với những mô hình có năng lực cao. Hồi tháng 6, Anthropic chỉ phát hành cho công chúng phiên bản giới hạn của Mythos, mô hình AI mạnh nhất của hãng về năng lực an ninh mạng, với các biện pháp hạn chế một số khả năng liên quan đến an ninh mạng và nghiên cứu sinh học.
Theo OpenAI, sự phát triển nhanh chóng của AI đang tạo ra tác động hai mặt đối với an ninh mạng. Các mô hình mạnh hơn có thể giúp phát hiện và xử lý lỗ hổng trước khi bị tin tặc khai thác, nhưng đồng thời cũng có thể tạo điều kiện cho các cuộc tấn công diễn ra với tốc độ và quy mô chưa từng có.
Báo Hà Nội Mới