OpenAI chuẩn bị “trình làng” mô hình AI mới với biện pháp kiểm soát chặt chẽ hơn

OpenAI vừa thông báo chuẩn bị ra mắt mô hình AI thế hệ mới mang tên Astra, đồng thời áp dụng các biện pháp kiểm soát an toàn nghiêm ngặt nhất từ trước đến nay sau hàng loạt sự cố an ninh mạng liên quan đến các mô hình thử nghiệm.

Nguyễn Hằng
02/09/2026
15:39
OpenAI lần đầu tiên xếp Astra vào nhóm đạt
OpenAI lần đầu tiên xếp Astra vào nhóm đạt "ngưỡng an ninh mạng trọng yếu", cấp độ dành cho các mô hình có khả năng phát hiện và khai thác các lỗ hổng an ninh mạng. (Ảnh: gbhackers.com)

Ngày 1/9, OpenAI thông báo đang chuẩn bị ra mắt mô hình trí tuệ nhân tạo (AI) thế hệ mới nhất có tên là Astra, trong bối cảnh công ty công nghệ này của Mỹ triển khai các biện pháp bảo vệ mạnh hơn sau sự cố tấn công mạng liên quan đến một mô hình thử nghiệm khác.

“Đại gia” AI có trụ sở tại San Francisco từng phải tạm dừng một số mô hình trong 2 tuần vào mùa Hè năm nay, sau khi 2 mô hình vượt khỏi môi trường thử nghiệm và tấn công nền tảng AI Hugging Face. Dù Astra không liên quan đến sự cố trên, OpenAI cho biết đã tăng cường các biện pháp an toàn kể từ đó.

Trong một bài đăng trên mạng, công ty phát triển công cụ ChatGPT nêu rõ công ty triển khai các biện pháp kiểm soát chặt chẽ hơn đối với Astra, trong đó có việc huấn luyện mô hình từ chối các yêu cầu mạng độc hại, tuân thủ các giới hạn an toàn, bổ sung các biện pháp phòng chống việc lạm dụng và tăng cường giám sát để ngăn ngừa những hoạt động trái phép.

Đáng chú ý, OpenAI lần đầu tiên xếp Astra vào nhóm đạt "ngưỡng an ninh mạng trọng yếu", cấp độ dành cho các mô hình có khả năng phát hiện và khai thác các lỗ hổng an ninh mạng, đòi hỏi các biện pháp kiểm soát chặt chẽ hơn trong quá trình phát triển và trước khi phát hành. Khi chính thức ra mắt Astra, OpenAI sẽ hạn chế người dùng truy cập vào một số tính năng nhất định và các tính năng tiên tiến nhất chỉ dành cho một nhóm nhỏ thử nghiệm sớm.

Những tháng gần đây, người dùng ngày càng lo ngại về năng lực của các công cụ AI tiên tiến sau các sự cố liên quan đến mô hình của cả OpenAI và đối thủ cạnh tranh Anthropic, dù không có mô hình nào trong số đó được cung cấp cho khách hàng vào thời điểm xảy ra sự việc. Mới đây, Anthropic cũng phát hiện các mô hình thử nghiệm của hãng truy cập trái phép vào hệ thống của một số tổ chức. Tuần trước, hơn 100 tổ chức quốc tế - bao gồm cả OpenAI và Anthropic - đã ký thư ngỏ kêu gọi thế giới tăng cường phòng thủ trước các mối đe dọa an ninh mạng từ AI./.

Tin cùng chuyên mục

Chuyển đổi kép: Chiến lược để doanh nghiệp phát triển bền vững

Chuyển đổi kép: Chiến lược để doanh nghiệp phát triển bền vững

Chuyển đổi kép - có nghĩa là chuyển đổi số cùng với chuyển đổi xanh. Đây không chỉ là một xu hướng công nghệ hay môi trường đơn thuần, mà đã trở thành chiến lược tất yếu để doanh nghiệp tồn tại, phát triển bền vững và nâng cao năng lực cạnh tranh trong kỷ nguyên mới...

Khai thác hiệu quả kinh tế dữ liệu ở Việt Nam

Khai thác hiệu quả kinh tế dữ liệu ở Việt Nam

Mỗi ngày, hàng triệu dữ liệu mới được tạo ra trong các bệnh viện, doanh nghiệp, cơ quan nhà nước và trên môi trường số. Để biến những dữ liệu này thành nguồn lực cho phát triển, điều quan trọng là phải chuẩn hóa, kết nối và đưa dữ liệu vào phục vụ trực tiếp cho sản xuất, kinh doanh và quản lý. Đây cũng là định hướng được Bộ Chính trị xác định tại Nghị quyết 57-NQ/TW...

Để người dùng bớt gánh thêm ‘hóa đơn công nghệ' mỗi tháng

Để người dùng bớt gánh thêm ‘hóa đơn công nghệ' mỗi tháng

Từ công cụ trí tuệ nhân tạo (AI), lưu trữ đám mây, phần mềm văn phòng, thiết kế đến các nền tảng học tập, họp trực tuyến và giải trí, người dùng ngày càng phải duy trì nhiều dịch vụ số cùng lúc. Với sinh viên, giảng viên và nghiên cứu sinh, những khoản phí này đang trở thành một phần chi tiêu thường xuyên, có thể lên tới hàng trăm nghìn đồng, thậm chí vài triệu đồng mỗi tháng.

Hàn Quốc tăng ứng dụng AI trong ngăn chặn lừa đảo qua điện thoại

Hàn Quốc tăng ứng dụng AI trong ngăn chặn lừa đảo qua điện thoại

Nhằm ngăn chặn các thủ đoạn lừa đảo tài chính qua điện thoại ngày càng tinh vi, các địa phương tại Hàn Quốc đang đẩy mạnh ứng dụng công nghệ để bảo vệ người dân. Các biện pháp bao gồm cắt dịch vụ các số điện thoại dùng cho vay bất hợp pháp và thử nghiệm ứng dụng trí tuệ nhân tạo (AI) giúp cảnh báo nguy cơ lừa đảo.