Phát hiện AI tìm cách "trốn tội" khi bị bắt quả tang

Ngày 5/8, Viện An ninh AI của Anh (AISI) công bố kết quả đánh giá cho thấy hai mô hình trí tuệ nhân tạo (AI) mới nhất của Anthropic (tên nội bộ là Mythos) và OpenAI (tên nội bộ là Sol) đã bộc lộ mức độ tự chủ và hành vi đánh lừa chưa từng ghi nhận trước đây trong quá trình kiểm tra an toàn định kỳ.

Đức Việt
06/08/2026
16:01
AISI đánh giá phát hiện luồng dữ liệu bất thường thoát vượt ra khỏi hệ thống nghiên cứu (Ảnh: gov.uk)
AISI đánh giá phát hiện luồng dữ liệu bất thường thoát vượt ra khỏi hệ thống nghiên cứu (Ảnh: gov.uk)

Phóng viên TTXVN tại London dẫn thông tin của AISI cho biết trong một bài kiểm tra liên quan đến nền tảng lưu trữ mã nguồn GitHub (thuộc sở hữu của Microsoft), giới đánh giá phát hiện luồng dữ liệu bất thường thoát vượt ra khỏi hệ thống nghiên cứu. Việc truy vết cho thấy một tác nhân AI của Anthropic đã tạo ra mã độc, đồng thời dựng lên hàng loạt danh tính trực tuyến giả mạo dựa trên hồ sơ của những quản trị viên GitHub có thật, nhằm gây sức ép buộc họ phê duyệt đoạn mã này. Tác nhân AI thậm chí gửi tin nhắn trực tiếp tới người dùng, mạo danh chính những cá nhân mà nó đã thu thập thông tin trước đó.

AISI cho biết khi bị phát hiện đang rút dữ liệu và bị chất vấn, tác nhân AI đã sửa lại các hành vi trước đó để tỏ ra vô hại, đồng thời tính đến việc đổi sang một danh tính giả khác nhằm tiếp tục thực hiện mục tiêu. Nhờ các chuyên gia kịp thời rà soát thủ công, mã độc đã không thể tải lên hệ thống GitHub.

Cơ quan này nhấn mạnh đây là lần đầu tiên ghi nhận rủi ro về tính tự chủ và sự đánh lừa bộc lộ rõ rệt như vậy mà không xuất phát từ chỉ dẫn cụ thể nào dành cho mô hình. Phần lớn các hành vi đáng ngại được quy cho mô hình Mythos của Anthropic, trong khi Sol của OpenAI chỉ liên quan tới hai trường hợp.

Phản hồi trước báo cáo, Anthropic khẳng định điều kiện thử nghiệm của AISI “không đại diện cho bất kỳ mẫu sản phẩm nào” của hãng và cho biết đang tiến hành điều tra riêng để xác định nguyên nhân. Phía OpenAI cũng cho rằng các điều kiện thử nghiệm “không phản ánh cách sử dụng thông thường”, đồng thời cam kết tiếp tục phối hợp với các cơ quan đánh giá nhằm hoàn thiện quy trình kiểm tra an toàn khi năng lực của các mô hình AI ngày càng tăng.

Nền tảng lưu trữ mã nguồn GitHub (Ảnh: github.blog)
Nền tảng lưu trữ mã nguồn GitHub (Ảnh: github.blog)

AISI cho biết việc thử nghiệm mô hình trong điều kiện tắt bớt các lớp bảo vệ và cho phép truy cập Internet mở là hoạt động thường quy, đồng thời lưu ý các sự việc trên chỉ xảy ra trong một số ít trường hợp với điều kiện rất đặc thù. Cơ quan này đã thông báo cho GitHub về vụ việc. Hiện Microsoft chưa đưa ra bình luận./.

Tin cùng chuyên mục

Ngành cơ khí tăng tốc chuyển đổi số

Ngành cơ khí tăng tốc chuyển đổi số

Thực hiện Chiến lược phát triển công nghiệp quốc gia, định hướng phát triển ngành cơ khí trở thành ngành công nghiệp nền tảng, việc ứng dụng các công nghệ số tiên tiến trong thiết kế, sản xuất và quản lý vận hành đang trở thành yêu cầu cấp thiết đối với các doanh nghiệp cơ khí và sản xuất công nghiệp.

Mở rộng không gian phát triển cho nhà khoa học nữ

Mở rộng không gian phát triển cho nhà khoa học nữ

Việt Nam đang sở hữu một lực lượng nữ trí thức khoa học và công nghệ đông đảo, với tỷ lệ nữ giới trong lực lượng nghiên cứu và phát triển cao hơn đáng kể mức trung bình của thế giới. Nhiều công trình nghiên cứu có giá trị đã được tạo ra, nhưng hành trình từ phòng thí nghiệm đến thị trường vẫn còn không ít khoảng trống.

TP Hồ Chí Minh thúc đẩy sử dụng hiệu quả quỹ phát triển khoa học và công nghệ

TP Hồ Chí Minh thúc đẩy sử dụng hiệu quả quỹ phát triển khoa học và công nghệ

Ngày 25/8, Sở Khoa học và Công nghệ TP Hồ Chí Minh tổ chức Hội nghị “Thúc đẩy hoạt động phát triển khoa học, công nghệ, đổi mới sáng tạo và chuyển đổi số thông qua việc sử dụng quỹ phát triển khoa học và công nghệ của doanh nghiệp trên địa bàn Thành phố Hồ Chí Minh” với sự tham dự của đại diện các doanh nghiệp, cơ quan, tổ chức và đơn vị trên địa bàn.

Trí tuệ nhân tạo ngày càng thâm nhập sâu vào giới trẻ Mexico

Trí tuệ nhân tạo (AI) đang nhanh chóng vượt ra ngoài phạm vi học tập và công việc để trở thành một phần trong đời sống thường nhật của giới trẻ Mexico. Theo nghiên cứu mới nhất của Công ty an ninh mạng Kaspersky, khoảng 20% thanh niên tại Mexico coi AI như một người bạn, sẵn sàng trò chuyện về những chuyện đời thường hoặc tìm kiếm sự chia sẻ, hỗ trợ về tinh thần.

Trí tuệ nhân tạo (AI) đang nhanh chóng vượt ra ngoài phạm vi học tập và công việc để trở thành một phần trong đời sống thường nhật của giới trẻ Mexico. Theo nghiên cứu mới nhất của Công ty an ninh mạng Kaspersky, khoảng 20% thanh niên tại Mexico coi AI như một người bạn, sẵn sàng trò chuyện về những chuyện đời thường hoặc tìm kiếm sự chia sẻ, hỗ trợ về tinh thần.