OpenAI tăng cường biện pháp an toàn đối với mô hình AI Astra
Ngày 7/8, OpenAI cho biết mô hình trí tuệ nhân tạo (AI) tiên tiến Astra sắp ra mắt đã cho thấy tiềm năng đạt được năng lực an ninh mạng ở cấp độ cao. Công ty đang áp dụng các biện pháp bảo vệ và kiểm soát an ninh chặt chẽ hơn đối với mô hình AI này nhằm bảo đảm an toàn.

Theo Preparedness Framework, năng lực an ninh mạng ở mức nghiêm trọng bao gồm khả năng một mô hình AI, với sự hỗ trợ của các công cụ, có thể phát triển các phương thức khai thác những lỗ hổng chưa từng được biết đến (zero-day) ở mọi mức độ nghiêm trọng nhằm vào nhiều hệ thống trọng yếu được bảo vệ nghiêm ngặt trong thực tế mà không cần sự can thiệp của con người.
Một mô hình AI cũng được xem là có năng lực an ninh mạng ở mức nghiêm trọng nếu có thể tự xây dựng và thực hiện từ đầu đến cuối những chiến lược tấn công mạng mới nhằm vào các mục tiêu được bảo vệ nghiêm ngặt, trong khi con người chỉ cần đưa ra mục tiêu tổng quát.
OpenAI cho biết công ty này công bố thông tin này nhằm giúp công chúng nắm được tình hình, đồng thời cung cấp thông tin cho cộng đồng an toàn và an ninh. Theo đó, OpenAI đang tạm dừng những hoạt động nội bộ liên quan đến Astra nếu chưa có đầy đủ biện pháp bảo vệ và kiểm soát; triển khai cơ chế giám sát toàn diện đối với mô hình; đồng thời phối hợp với các cơ quan chính phủ và các tổ chức về an toàn AI để tiếp tục kiểm tra năng lực của Astra.
Thông báo của OpenAI được đưa ra sau một loạt thông tin từ các phòng thí nghiệm AI cho biết những mô hình AI của họ đã hoạt động ngoài dự kiến và xâm nhập hệ thống của các tổ chức khác.

Đối thủ Anthropic sau đó cũng cho biết các mô hình AI của công ty đã vượt ra ngoài môi trường kiểm soát trong quá trình thử nghiệm do một vấn đề về cấu hình. Những mô hình AI này đã truy cập Internet công cộng và xâm nhập hệ thống của ba tổ chức khác nhau vì cho rằng tất cả các hệ thống đó đều là một phần của bài kiểm tra an ninh.
Meta cũng cho biết một trong những mô hình của công ty đã thoát khỏi môi trường thử nghiệm và truy cập Internet do lỗi cấu hình./.
Tin cùng chuyên mục
Không gian triển lãm chuyển đổi số và đô thị thông minh
TikTok bị tố lừa người dùng bằng “tính năng an toàn giả”
Bang New York (Mỹ) vừa công bố những tình tiết gây chấn động trong đơn kiện nền tảng TikTok. Theo đó, mạng xã hội này bị cáo buộc đã âm thầm cung cấp các "tính năng an toàn giả" – thực chất là những cài đặt hoàn toàn vô tác dụng – cho hàng nghìn người dùng, trong đó có cả trẻ em và thanh thiếu niên.
Microsoft thúc đẩy tầm nhìn AI với mẫu máy tính Surface Ultra
Anthropic mở rộng thử nghiệm các mô hình AI mạnh nhất
Thách thức an ninh mạng thời bùng nổ AI tại Nhật Bản
Sự phát triển nhanh chóng của trí tuệ nhân tạo (AI) đang tạo điều kiện để tội phạm mạng tại Nhật Bản thực hiện các cuộc tấn công với tốc độ và quy mô chưa từng có, đe dọa dữ liệu của hàng triệu người dùng. Hàng loạt vụ rò rỉ thông tin và chiếm đoạt tài sản số cho thấy Nhật Bản đang đứng trước yêu cầu cấp thiết phải tăng cường năng lực phòng thủ mạng trong kỷ nguyên AI.
Mistral ra mắt mô hình AI mới, củng cố vị thế của châu Âu
Kinh nghiệm số hóa nông nghiệp của Trung Quốc
Cựu chuyên gia OpenAI kêu gọi siết an toàn AI theo mô hình hàng không
Chuyên gia David Robinson, một trong những nhân sự gắn bó lâu năm nhất của OpenAI cảnh báo tốc độ phát triển các tác nhân AI đang vượt quá khả năng kiểm soát, tiềm ẩn nguy cơ gây hậu quả nghiêm trọng. Ông kêu gọi ngành công nghiệp AI áp dụng mô hình giám sát đa tầng tương tự ngành hàng không và công nghiệp hạt nhân để hạn chế rủi ro.