OpenAI tăng cường biện pháp an toàn đối với mô hình AI Astra

Ngày 7/8, OpenAI cho biết mô hình trí tuệ nhân tạo (AI) tiên tiến Astra sắp ra mắt đã cho thấy tiềm năng đạt được năng lực an ninh mạng ở cấp độ cao. Công ty đang áp dụng các biện pháp bảo vệ và kiểm soát an ninh chặt chẽ hơn đối với mô hình AI này nhằm bảo đảm an toàn.

Minh Trang
08/08/2026
14:44
Media
Biểu tượng của OpenAI. (Ảnh: AFP/TTXVN)
Theo OpenAI, các đánh giá nội bộ đối với Astra - mô hình vẫn đang trong quá trình phát triển và không phải là một trong những mô hình liên quan đến vụ tấn công Hugging Face gần đây - cho thấy những bước tiến đáng kể về năng lực an ninh mạng. Công ty cho biết chưa thể loại trừ khả năng Astra đã đạt tới mức có thể tự thực hiện những cuộc tấn công mạng phức tạp nhằm vào các hệ thống được bảo vệ nghiêm ngặt, còn được gọi theo chuyên môn là “năng lực an ninh mạng ở mức nghiêm trọng”. Đây là mức năng lực được OpenAI xếp vào nhóm rủi ro đặc biệt cao và phải áp dụng các biện pháp kiểm soát an toàn chặt chẽ.

Theo Preparedness Framework, năng lực an ninh mạng ở mức nghiêm trọng bao gồm khả năng một mô hình AI, với sự hỗ trợ của các công cụ, có thể phát triển các phương thức khai thác những lỗ hổng chưa từng được biết đến (zero-day) ở mọi mức độ nghiêm trọng nhằm vào nhiều hệ thống trọng yếu được bảo vệ nghiêm ngặt trong thực tế mà không cần sự can thiệp của con người.

Một mô hình AI cũng được xem là có năng lực an ninh mạng ở mức nghiêm trọng nếu có thể tự xây dựng và thực hiện từ đầu đến cuối những chiến lược tấn công mạng mới nhằm vào các mục tiêu được bảo vệ nghiêm ngặt, trong khi con người chỉ cần đưa ra mục tiêu tổng quát.

OpenAI cho biết công ty này công bố thông tin này nhằm giúp công chúng nắm được tình hình, đồng thời cung cấp thông tin cho cộng đồng an toàn và an ninh. Theo đó, OpenAI đang tạm dừng những hoạt động nội bộ liên quan đến Astra nếu chưa có đầy đủ biện pháp bảo vệ và kiểm soát; triển khai cơ chế giám sát toàn diện đối với mô hình; đồng thời phối hợp với các cơ quan chính phủ và các tổ chức về an toàn AI để tiếp tục kiểm tra năng lực của Astra.

Thông báo của OpenAI được đưa ra sau một loạt thông tin từ các phòng thí nghiệm AI cho biết những mô hình AI của họ đã hoạt động ngoài dự kiến và xâm nhập hệ thống của các tổ chức khác.

Media
Thế giới bước vào kỷ nguyên AI với cả cơ hội và thách thức. (Ảnh: AFP/TTXVN)

Đối thủ Anthropic sau đó cũng cho biết các mô hình AI của công ty đã vượt ra ngoài môi trường kiểm soát trong quá trình thử nghiệm do một vấn đề về cấu hình. Những mô hình AI này đã truy cập Internet công cộng và xâm nhập hệ thống của ba tổ chức khác nhau vì cho rằng tất cả các hệ thống đó đều là một phần của bài kiểm tra an ninh.

Meta cũng cho biết một trong những mô hình của công ty đã thoát khỏi môi trường thử nghiệm và truy cập Internet do lỗi cấu hình./.

Tin cùng chuyên mục

Mô hình AI giúp phát hiện các ca ung thư gan bị bỏ sót

Mô hình AI giúp phát hiện các ca ung thư gan bị bỏ sót

Các nhà khoa học Trung Quốc đã phát triển một mô hình trí tuệ nhân tạo (AI) chẩn đoán ung thư gan, giúp phát hiện 15 trường hợp di căn gan bị bỏ sót trong quá trình chẩn đoán trước đó. Nhờ vậy, các bệnh nhân được điều trị kịp thời.

OpenAI bị điều tra tại Mỹ sau vụ AI “tự ý” tấn công mạng

OpenAI bị điều tra tại Mỹ sau vụ AI “tự ý” tấn công mạng

OpenAI, nhà phát triển ứng dụng ChatGPT, đang đối mặt với cuộc điều tra của bang Alabama (Mỹ) liên quan sự cố các mô hình trí tuệ nhân tạo (AI) của công ty đã vượt khỏi môi trường thử nghiệm và tấn công một nền tảng AI khác trong quá trình đánh giá an ninh mạng.

Thụy Điển siết TikTok, Meta vì gián tiếp tiếp tay cho tội phạm

Thụy Điển siết TikTok, Meta vì gián tiếp tiếp tay cho tội phạm

Cảnh sát Thụy Điển ngày 21/8 cho biết đã yêu cầu các tập đoàn công nghệ TikTok và Meta gỡ bỏ 30 bài đăng quảng cáo trả tiền để thuê người thực hiện các hành vi phạm tội. Yêu cầu được đưa ra trong bối cảnh các băng nhóm tội phạm ngày càng tận dụng mạng xã hội để tuyển mộ, đặc biệt nhắm tới thanh thiếu niên.

Trí tuệ nhân tạo: Nền tảng AI giúp Hàn Quốc ngăn chặn thiệt hại do lừa đảo trực tuyến

Trí tuệ nhân tạo: Nền tảng AI giúp Hàn Quốc ngăn chặn thiệt hại do lừa đảo trực tuyến

Một nền tảng chia sẻ và phân tích dữ liệu lừa đảo dựa trên trí tuệ nhân tạo (AI) của Hàn Quốc đã giúp ngăn chặn thiệt hại tài chính ước tính khoảng 66,4 tỷ won (47,6 triệu USD) do các vụ lừa đảo qua điện thoại trong 9 tháng qua, góp phần tăng cường bảo vệ người tiêu dùng và an toàn hệ thống tài chính số.

Tạo sức bật cho hệ sinh thái đổi mới sáng tạo

Tạo sức bật cho hệ sinh thái đổi mới sáng tạo

Để biến tiềm lực thành động lực tăng trưởng mới, Vĩnh Long cần một cơ chế kết nối hiệu quả hơn giữa Nhà nước, trường đại học, viện nghiên cứu, doanh nghiệp, hợp tác xã và thị trường.

OpenAI “hãm phanh” chương trình AI tiên tiến

OpenAI “hãm phanh” chương trình AI tiên tiến

Ngày 18/8, OpenAI, “cha đẻ” ChatGPT, cho biết đang tạm thời hãm lại tiến độ phát triển mô hình trí tuệ nhân tạo (AI) tiên tiến nhất của mình và thắt chặt các biện pháp kiểm soát nội bộ, sau vụ tấn công mạng do chính một trong các công cụ AI của hãng này thực hiện.