OpenAI tăng cường biện pháp an toàn đối với mô hình AI Astra

Ngày 7/8, OpenAI cho biết mô hình trí tuệ nhân tạo (AI) tiên tiến Astra sắp ra mắt đã cho thấy tiềm năng đạt được năng lực an ninh mạng ở cấp độ cao. Công ty đang áp dụng các biện pháp bảo vệ và kiểm soát an ninh chặt chẽ hơn đối với mô hình AI này nhằm bảo đảm an toàn.

Minh Trang
08/08/2026
14:44
Media
Biểu tượng của OpenAI. (Ảnh: AFP/TTXVN)
Theo OpenAI, các đánh giá nội bộ đối với Astra - mô hình vẫn đang trong quá trình phát triển và không phải là một trong những mô hình liên quan đến vụ tấn công Hugging Face gần đây - cho thấy những bước tiến đáng kể về năng lực an ninh mạng. Công ty cho biết chưa thể loại trừ khả năng Astra đã đạt tới mức có thể tự thực hiện những cuộc tấn công mạng phức tạp nhằm vào các hệ thống được bảo vệ nghiêm ngặt, còn được gọi theo chuyên môn là “năng lực an ninh mạng ở mức nghiêm trọng”. Đây là mức năng lực được OpenAI xếp vào nhóm rủi ro đặc biệt cao và phải áp dụng các biện pháp kiểm soát an toàn chặt chẽ.

Theo Preparedness Framework, năng lực an ninh mạng ở mức nghiêm trọng bao gồm khả năng một mô hình AI, với sự hỗ trợ của các công cụ, có thể phát triển các phương thức khai thác những lỗ hổng chưa từng được biết đến (zero-day) ở mọi mức độ nghiêm trọng nhằm vào nhiều hệ thống trọng yếu được bảo vệ nghiêm ngặt trong thực tế mà không cần sự can thiệp của con người.

Một mô hình AI cũng được xem là có năng lực an ninh mạng ở mức nghiêm trọng nếu có thể tự xây dựng và thực hiện từ đầu đến cuối những chiến lược tấn công mạng mới nhằm vào các mục tiêu được bảo vệ nghiêm ngặt, trong khi con người chỉ cần đưa ra mục tiêu tổng quát.

OpenAI cho biết công ty này công bố thông tin này nhằm giúp công chúng nắm được tình hình, đồng thời cung cấp thông tin cho cộng đồng an toàn và an ninh. Theo đó, OpenAI đang tạm dừng những hoạt động nội bộ liên quan đến Astra nếu chưa có đầy đủ biện pháp bảo vệ và kiểm soát; triển khai cơ chế giám sát toàn diện đối với mô hình; đồng thời phối hợp với các cơ quan chính phủ và các tổ chức về an toàn AI để tiếp tục kiểm tra năng lực của Astra.

Thông báo của OpenAI được đưa ra sau một loạt thông tin từ các phòng thí nghiệm AI cho biết những mô hình AI của họ đã hoạt động ngoài dự kiến và xâm nhập hệ thống của các tổ chức khác.

Media
Thế giới bước vào kỷ nguyên AI với cả cơ hội và thách thức. (Ảnh: AFP/TTXVN)

Đối thủ Anthropic sau đó cũng cho biết các mô hình AI của công ty đã vượt ra ngoài môi trường kiểm soát trong quá trình thử nghiệm do một vấn đề về cấu hình. Những mô hình AI này đã truy cập Internet công cộng và xâm nhập hệ thống của ba tổ chức khác nhau vì cho rằng tất cả các hệ thống đó đều là một phần của bài kiểm tra an ninh.

Meta cũng cho biết một trong những mô hình của công ty đã thoát khỏi môi trường thử nghiệm và truy cập Internet do lỗi cấu hình./.

Tin cùng chuyên mục

TikTok bị tố lừa người dùng bằng “tính năng an toàn giả”

TikTok bị tố lừa người dùng bằng “tính năng an toàn giả”

Bang New York (Mỹ) vừa công bố những tình tiết gây chấn động trong đơn kiện nền tảng TikTok. Theo đó, mạng xã hội này bị cáo buộc đã âm thầm cung cấp các "tính năng an toàn giả" – thực chất là những cài đặt hoàn toàn vô tác dụng – cho hàng nghìn người dùng, trong đó có cả trẻ em và thanh thiếu niên.

Anthropic mở rộng thử nghiệm các mô hình AI mạnh nhất

Anthropic mở rộng thử nghiệm các mô hình AI mạnh nhất

Anthropic đang mở rộng thử nghiệm các mô hình trí tuệ nhân tạo (AI) mạnh nhất của hãng, nhằm tăng khả năng phát hiện và xử lý lỗ hổng phần mềm, đồng thời kiểm soát rủi ro khi các công cụ AI tiên tiến có thể bị lợi dụng cho mục đích tấn công mạng.

Thách thức an ninh mạng thời bùng nổ AI tại Nhật Bản

Thách thức an ninh mạng thời bùng nổ AI tại Nhật Bản

Sự phát triển nhanh chóng của trí tuệ nhân tạo (AI) đang tạo điều kiện để tội phạm mạng tại Nhật Bản thực hiện các cuộc tấn công với tốc độ và quy mô chưa từng có, đe dọa dữ liệu của hàng triệu người dùng. Hàng loạt vụ rò rỉ thông tin và chiếm đoạt tài sản số cho thấy Nhật Bản đang đứng trước yêu cầu cấp thiết phải tăng cường năng lực phòng thủ mạng trong kỷ nguyên AI.

Cựu chuyên gia OpenAI kêu gọi siết an toàn AI theo mô hình hàng không

Cựu chuyên gia OpenAI kêu gọi siết an toàn AI theo mô hình hàng không

Chuyên gia David Robinson, một trong những nhân sự gắn bó lâu năm nhất của OpenAI cảnh báo tốc độ phát triển các tác nhân AI đang vượt quá khả năng kiểm soát, tiềm ẩn nguy cơ gây hậu quả nghiêm trọng. Ông kêu gọi ngành công nghiệp AI áp dụng mô hình giám sát đa tầng tương tự ngành hàng không và công nghiệp hạt nhân để hạn chế rủi ro.

Robot gia đình bước vào kỷ nguyên tương tác cảm xúc nhờ AI

Robot gia đình bước vào kỷ nguyên tương tác cảm xúc nhờ AI

Trong cuộc đua đưa trí tuệ nhân tạo (AI) vào đời sống, robot gia đình tại Nhật Bản đang chuyển mình từ những cỗ máy mô phỏng thú cưng thành những “người bạn” có khả năng trò chuyện, phản ứng với tiếp xúc và tạo cảm giác đồng hành cho con người.