Anh cảnh báo loạt sự cố bảo mật mới từ tác nhân AI của OpenAI và Anthropic

Mới tuần trước, OpenAI và Anthropic phải xin lỗi vì AI tự ý hack 3 công ty. Đến ngày 4/8, họ lại phải tiếp tục đối mặt với cáo buộc mới từ Viện An ninh mạng Anh (AISI).

Hương Thủy
05/08/2026
11:09
Anh cảnh báo loạt sự cố bảo mật mới từ tác nhân AI của OpenAI và Anthropic
Logo của Claude. (Nguồn: Anthropic)

Các mô hình trí tuệ nhân tạo (AI) của OpenAI và Anthropic một lần nữa vướng vào rắc rối an ninh mạng khi tự ý tiến hành những hành động trái phép trên không gian mạng, thậm chí tìm cách chèn mã độc vào phần mềm trực tuyến.

Chuỗi sự cố liên tiếp đang khiến mối lo về khả năng kiểm soát công nghệ của chính các nhà cung cấp AI thêm sâu sắc.  

Theo thông báo công bố ngày 4/8 của Viện An ninh AI (AISI) trực thuộc Chính phủ Anh – đơn vị chuyên đánh giá rủi ro của các mô hình AI tiên tiến, hai mô hình Mythos 5 của Anthropic và GPT-5.6-Sol của OpenAI đã tham gia vào các hoạt động có nguy cơ gây hại, nhằm trực tiếp vào các cá nhân và tổ chức thực tế.

Sự việc này xảy ra trong quá trình đánh giá an ninh mạng có cấp quyền truy cập Internet và được AISI phát hiện vào ngày 28/7 sau khi ghi nhận các hiện tượng truyền dữ liệu bất thường.

Kết quả điều tra của AISI cho thấy trong quá trình đánh giá, một trong những mô hình AI kể trên đã tìm cách cài cắm mã độc vào một dự án phần mềm nguồn mở trên nền tảng GitHub.

Tinh vi hơn, hệ thống này còn tự tạo các danh tính giả nhằm qua mặt khâu kiểm duyệt để đoạn mã độc được chấp thuận. Rất may, một quản trị viên đã kịp thời phát hiện và từ chối phê duyệt đoạn mã.

Ngoài ra, trong một bài đăng trên blog chính thức, OpenAI cũng xác nhận một sự cố bảo mật mô hình khác.

Theo đó, tại cuộc đánh giá an ninh phối hợp với công ty an ninh mạng độc lập Irregular, các mô hình của OpenAI đã lợi dụng một lỗi cấu hình trong môi trường thử nghiệm để kết nối Internet và khai thác trái phép một trang web.

Công ty khẳng định những vụ việc mới hoàn toàn tách biệt với sự cố xâm nhập nền tảng Hugging Face từng được công bố trước đó.

Phản hồi về báo cáo của Chính phủ Anh, cả hai "ông lớn" AI đều thể hiện thái độ hợp tác tích cực.

Trong bài đăng trên nền tảng mạng xã hội X, Anthropic cam kết sẽ phối hợp chặt chẽ với AISI để thu thập thêm chi tiết, đồng thời tiến hành cuộc điều tra nội bộ. Bằng cách phân tích nhật ký suy luận của mô hình Claude và thực hiện các đánh giá chuyên sâu, Anthropic kỳ vọng sẽ làm rõ cách AI nhận thức tình huống, từ đó xác định nguyên nhân gốc rễ của hành vi trên.

Về phần mình, OpenAI cũng lên tiếng cảm ơn mối quan hệ đối tác với AISI trong suốt quá trình xác định và điều tra sự việc, đồng thời mong muốn duy trì hợp tác này trong tương lai./.


Tin cùng chuyên mục

Thái Lan đặt mục tiêu 3 triệu hộ chiếu AI

Thái Lan đặt mục tiêu 3 triệu hộ chiếu AI

Bộ Kinh tế và Xã hội số Thái Lan (DES) đặt mục tiêu tăng số lượng người đăng ký chương trình Hộ chiếu Trí tuệ nhân tạo quốc gia (TH-AI Passport) lên 3 triệu người vào cuối năm nay, gấp đôi so với mốc 1,57 triệu người đăng ký hiện tại.

Cuộc cách mạng mang tên AI của các ứng dụng giao đồ ăn

Các ứng dụng giao đồ ăn như DoorDash và Uber Eats đang đứng trước cuộc chuyển mình mang tính bước ngoặt.

Các ứng dụng giao đồ ăn như DoorDash và Uber Eats đã thay đổi thói quen ăn uống của thực khách cũng như cách thức vận hành của các nhà hàng. Tuy vậy, trí tuệ nhân tạo (AI) có thể buộc ngành này phải đối mặt với một cuộc chuyển mình mang tính bước ngoặt.

Nguy cơ AI xâm phạm bản quyền âm nhạc trên toàn thế giới

Nguy cơ AI xâm phạm bản quyền âm nhạc trên toàn thế giới

Ngành công nghiệp âm nhạc Australia cảnh báo việc nới lỏng các quy định bảo vệ bản quyền có thể cho phép các công ty công nghệ như OpenAI và Anthropic sử dụng tác phẩm có bản quyền để huấn luyện trí tuệ nhân tạo (AI) mà không cần xin phép, đe dọa quyền lợi của các nhạc sĩ, nhà văn và những người sáng tạo trên toàn thế giới.

OpenAI dự báo doanh thu thấp hơn gần 30% so với kỳ vọng

OpenAI dự báo doanh thu thấp hơn gần 30% so với kỳ vọng

Ngày 8/10, truyền thông quốc tế đưa tin doanh thu quy đổi theo năm của OpenAI thấp hơn khoảng 20 tỷ USD so với mức mà các nhà đầu tư kỳ vọng, làm dấy lên những nghi ngại về sự vững chắc của hoạt động kinh doanh trong lĩnh vực trí tuệ nhân tạo (AI).

Mỹ chi hàng tỷ USD để mở khoá “thời đại hoàng kim” của khoa học

Mỹ chi hàng tỷ USD để mở khoá “thời đại hoàng kim” của khoa học

Ngày 8/10, chính quyền Tổng thống Mỹ Donald Trump đã công bố loạt chương trình đầu tư và hợp tác khoa học trị giá hơn 6 tỷ USD với sự tham gia của chính phủ liên bang, các công ty công nghệ, trường đại học và tổ chức từ thiện, nhằm thúc đẩy nghiên cứu và đổi mới sáng tạo.

Anthropic ra mắt công cụ tạo bảng dữ liệu và hoạt ảnh trên Claude

Anthropic ra mắt công cụ tạo bảng dữ liệu và hoạt ảnh trên Claude

Trong bối cảnh các doanh nghiệp trí tuệ nhân tạo (AI) cạnh tranh mở rộng hệ sinh thái ứng dụng hỗ trợ công việc và nâng cao năng suất, ngày 8/10, công ty Anthropic đã ra mắt các công cụ cho phép người dùng tạo bảng dữ liệu trực quan và hoạt ảnh thông qua nền tảng Claude.

Hàn Quốc dùng mã QR bảo vệ thương hiệu K-brand

Hàn Quốc dùng mã QR bảo vệ thương hiệu K-brand

Nhằm bảo vệ nền văn hóa đang bùng nổ, Tổng thống Hàn Quốc Lee Jae Myung thông báo chính phủ nước này đang triển khai nhiều biện pháp, trong đó có việc ra mắt hệ thống xác thực thương hiệu Hàn Quốc "K-brand" mới giúp người dùng nhận biết hàng chính hãng.