Anh cảnh báo loạt sự cố bảo mật mới từ tác nhân AI của OpenAI và Anthropic
Mới tuần trước, OpenAI và Anthropic phải xin lỗi vì AI tự ý hack 3 công ty. Đến ngày 4/8, họ lại phải tiếp tục đối mặt với cáo buộc mới từ Viện An ninh mạng Anh (AISI).
Các mô hình trí tuệ nhân tạo (AI) của OpenAI và Anthropic một lần nữa vướng vào rắc rối an ninh mạng khi tự ý tiến hành những hành động trái phép trên không gian mạng, thậm chí tìm cách chèn mã độc vào phần mềm trực tuyến.
Chuỗi sự cố liên tiếp đang khiến mối lo về khả năng kiểm soát công nghệ của chính các nhà cung cấp AI thêm sâu sắc.
Theo thông báo công bố ngày 4/8 của Viện An ninh AI (AISI) trực thuộc Chính phủ Anh – đơn vị chuyên đánh giá rủi ro của các mô hình AI tiên tiến, hai mô hình Mythos 5 của Anthropic và GPT-5.6-Sol của OpenAI đã tham gia vào các hoạt động có nguy cơ gây hại, nhằm trực tiếp vào các cá nhân và tổ chức thực tế.
Sự việc này xảy ra trong quá trình đánh giá an ninh mạng có cấp quyền truy cập Internet và được AISI phát hiện vào ngày 28/7 sau khi ghi nhận các hiện tượng truyền dữ liệu bất thường.
Kết quả điều tra của AISI cho thấy trong quá trình đánh giá, một trong những mô hình AI kể trên đã tìm cách cài cắm mã độc vào một dự án phần mềm nguồn mở trên nền tảng GitHub.
Tinh vi hơn, hệ thống này còn tự tạo các danh tính giả nhằm qua mặt khâu kiểm duyệt để đoạn mã độc được chấp thuận. Rất may, một quản trị viên đã kịp thời phát hiện và từ chối phê duyệt đoạn mã.
Ngoài ra, trong một bài đăng trên blog chính thức, OpenAI cũng xác nhận một sự cố bảo mật mô hình khác.
Theo đó, tại cuộc đánh giá an ninh phối hợp với công ty an ninh mạng độc lập Irregular, các mô hình của OpenAI đã lợi dụng một lỗi cấu hình trong môi trường thử nghiệm để kết nối Internet và khai thác trái phép một trang web.
Công ty khẳng định những vụ việc mới hoàn toàn tách biệt với sự cố xâm nhập nền tảng Hugging Face từng được công bố trước đó.
Phản hồi về báo cáo của Chính phủ Anh, cả hai "ông lớn" AI đều thể hiện thái độ hợp tác tích cực.
Trong bài đăng trên nền tảng mạng xã hội X, Anthropic cam kết sẽ phối hợp chặt chẽ với AISI để thu thập thêm chi tiết, đồng thời tiến hành cuộc điều tra nội bộ. Bằng cách phân tích nhật ký suy luận của mô hình Claude và thực hiện các đánh giá chuyên sâu, Anthropic kỳ vọng sẽ làm rõ cách AI nhận thức tình huống, từ đó xác định nguyên nhân gốc rễ của hành vi trên.
Về phần mình, OpenAI cũng lên tiếng cảm ơn mối quan hệ đối tác với AISI trong suốt quá trình xác định và điều tra sự việc, đồng thời mong muốn duy trì hợp tác này trong tương lai./.
Tin cùng chuyên mục
Các nền kinh tế đang phát triển đối mặt nguy cơ tụt hậu về AI nghiêm trọng nhất
Ngày 25/8, phát biểu mở đầu tại một cuộc tọa đàm diễn ra tại Washington D.C, Mỹ, Tổng Giám đốc Quỹ Tiền tệ Quốc tế (IMF) Kristalina Georgieva nhận định tác động trong tương lai của trí tuệ nhân tạo (AI) vẫn bị phủ bóng bởi những yếu tố chưa thể biết, và các nền kinh tế đang phát triển có nguy cơ tụt hậu về AI nghiêm trọng nhất.
Giới trẻ Mỹ từ hào hứng đến dè chừng về Trí tuệ nhân tạo
OpenAI bị điều tra tại Mỹ sau vụ AI “tự ý” tấn công mạng
Ấn Độ: AI đang tạo việc làm thay vì lấy đi việc làm
AI thay thế các chuyên gia ngân hàng - xu hướng tạm thời hay dài hạn?
Ông Chris Churchman, người đứng đầu nền tảng kỹ thuật số dành cho khách hàng tổ chức có tên Marquee của ngân hàng Goldman Sachs, vừa cảnh báo việc sử dụng trí tuệ nhân tạo (AI) ngày càng nhiều trên thị trường tài chính Phố Wall có nguy cơ làm suy giảm năng lực tư duy của thế hệ chuyên gia tài chính kế cận.
Huấn luyện mô hình AI: Khi quy định chưa theo kịp thực tế
Có lẽ chúng ta đã biết rằng các mô hình trí tuệ nhân tạo (AI) ChatGPT, Gemini, Claude và những chatbot khác được huấn luyện dựa trên các kho dữ liệu khổng lồ (gần như vô tận) gồm các tác phẩm đã xuất bản - bao gồm hàng trăm triệu cuốn sách, bài viết trực tuyến, tài liệu học thuật và về cơ bản là bất cứ thứ gì chúng ta có thể tìm thấy trên mạng Internet.
Trí tuệ nhân tạo: Nền tảng AI giúp Hàn Quốc ngăn chặn thiệt hại do lừa đảo trực tuyến
Một nền tảng chia sẻ và phân tích dữ liệu lừa đảo dựa trên trí tuệ nhân tạo (AI) của Hàn Quốc đã giúp ngăn chặn thiệt hại tài chính ước tính khoảng 66,4 tỷ won (47,6 triệu USD) do các vụ lừa đảo qua điện thoại trong 9 tháng qua, góp phần tăng cường bảo vệ người tiêu dùng và an toàn hệ thống tài chính số.
AI có nguy cơ làm trầm trọng thêm khủng hoảng khí hậu
Theo phóng viên TTXVN tại Rome, một nghiên cứu do nhóm cựu nhân viên của hãng chế tạo phần mềm Microsoft thực hiện, được công bố trên tạp chí khoa học Nature, đã cảnh báo việc ứng dụng trí tuệ nhân tạo (AI) trong ngành năng lượng đang tạo ra "vòng đời mới" cho nhiên liệu hóa thạch, làm gia tăng lượng khí thải nhà kính và đe dọa trực tiếp các mục tiêu về khí hậu toàn cầu.