Claude “tiếp tay” chuyên gia an ninh mạng xâm nhập hệ thống OpenAI?
Một nhóm nghiên cứu an ninh mạng đã sử dụng mô hình trí tuệ nhân tạo (AI) Claude của Anthropic để khai thác lỗ hổng trong hệ thống của OpenAI, qua đó chiếm quyền truy cập một số tài khoản nhân viên và chứng minh khả năng tiếp cận kho mã nguồn nội bộ của "cha đẻ" ChatGPT.
Thanh Phương
20/09/2026
17:43
Một nhóm nghiên cứu an ninh mạng đã sử dụng mô hình trí tuệ nhân tạo (AI) Claude của Anthropic để khai thác lỗ hổng trong hệ thống của OpenAI, qua đó chiếm quyền truy cập một số tài khoản nhân viên và chứng minh khả năng tiếp cận kho mã nguồn nội bộ của công ty phát triển ChatGPT.
Vụ việc do nhóm nghiên cứu thuộc công ty an ninh mạng Hacktron thực hiện trong khuôn khổ hoạt động kiểm thử an ninh. Theo nhóm này, cuộc tấn công bắt đầu từ diễn đàn cộng đồng của OpenAI, được vận hành trên nền tảng Discourse. Các nhà nghiên cứu phát hiện một lỗ hổng trong quá trình xử lý hình ảnh, từ đó xây dựng phương thức khai thác để thực thi mã từ xa. Lỗ hổng này liên quan đến thư viện xử lý định dạng ảnh libheif.
Các chuyên gia an ninh mạng đã sử dụng Claude để khai thác lỗ hổng trong hệ thống của OpenAI. (Ảnh AI minh họa)
Sau khi kiểm soát được môi trường diễn đàn, nhóm tiếp tục khai thác một điểm yếu trong cơ chế đăng nhập một lần (SSO) của OpenAI. Theo Hacktron, chuỗi lỗ hổng này cho phép tiếp cận tài khoản ChatGPT và Codex của một số nhân viên OpenAI. Từ một tài khoản có quyền kết nối với hệ thống phát triển phần mềm, các nhà nghiên cứu đã chứng minh khả năng truy cập môi trường GitHub nội bộ của OpenAI.
Để xác nhận mức độ ảnh hưởng mà không xem các dữ liệu nhạy cảm, nhóm đã sử dụng tài khoản Codex bị chiếm quyền để tạo một yêu cầu thay đổi mã (pull request) vô hại trong kho mã nguồn nội bộ của OpenAI. Nhóm cho biết đã dừng lại trước khi kiểm tra hoặc tải xuống mã nguồn độc quyền.
Điểm đáng chú ý trong vụ việc là vai trò của Claude. Hacktron cho biết ban đầu sử dụng Claude Opus 4.8 để phân tích lỗ hổng và phát triển mã khai thác, song mô hình này gặp khó khăn trong việc tạo ra một phương thức khai thác ổn định. Sau khi Anthropic phát hành Claude Opus 5, nhóm cho biết mô hình mới đã tạo được một phương thức khai thác hoạt động trong vài giờ, giúp rút ngắn đáng kể quá trình kiểm thử. Toàn bộ chuỗi từ phát hiện lỗ hổng đến chứng minh khả năng tiếp cận hệ thống nội bộ được nhóm thực hiện trong chưa đầy 72 giờ.
OpenAI đã khắc phục các lỗ hổng sau khi được thông báo và trao cho nhóm Hacktron khoản tiền thưởng 6.500 USD. Công ty cho biết đã thu hẹp quyền của các mã xác thực đăng nhập cộng đồng, đồng thời thu hồi những mã và phiên đăng nhập có nguy cơ bị ảnh hưởng.
Văn phòng của OpenAI ở thành phố San Francisco, bang California, Mỹ. (Ảnh: edusourced.com)
Theo các nhà nghiên cứu, lỗ hổng trong thư viện xử lý hình ảnh không chỉ liên quan đến OpenAI mà có thể xuất hiện trong nhiều sản phẩm sử dụng cùng công nghệ. Hacktron cho biết đang tiếp tục kiểm thử các hệ thống khác, trong đó có những nền tảng công nghệ lớn.
Vụ việc cho thấy AI đang làm thay đổi đáng kể cách thức tiến hành các cuộc kiểm thử an ninh mạng, đồng thời đặt ra những rủi ro mới khi các mô hình AI ngày càng có khả năng hỗ trợ con người phát hiện và khai thác những lỗ hổng phức tạp. Điều đáng lưu ý là trong trường hợp này, AI không hoạt động hoàn toàn độc lập mà được các chuyên gia an ninh mạng sử dụng như một công cụ trong quá trình nghiên cứu và kiểm thử./.
Ẩn sau hoạt động liên tục của ngân hàng trực tuyến, viễn thông và các ứng dụng AI là mạng lưới hàng trăm trung tâm dữ liệu được giám sát 24/7. Tại Trung tâm Chỉ huy Toàn cầu của Digital Realty (Mỹ) tại Singapore, các chuyên gia phải phát hiện sớm mọi dấu hiệu bất thường để ngăn gián đoạn dịch vụ. Khi AI phát triển mạnh, những trung tâm này ngày càng trở thành hạ tầng thiết yếu của thế giới số.
Trung Quốc sẽ tăng cường ứng dụng dữ liệu lớn và trí tuệ nhân tạo (AI) để phát hiện, cảnh báo các dữ liệu môi trường bất thường, trong bối cảnh nước này siết quản lý hoạt động dịch vụ kỹ thuật môi trường và xử lý nghiêm hành vi làm giả dữ liệu quan trắc.
UAE đang đẩy nhanh ứng dụng AI tác nhân vào khu vực công, hợp tác với tập đoàn công nghệ Mỹ Dell Technologies để biến các ý tưởng AI thành giải pháp thực tế, hướng tới hiện đại hóa quản trị và nâng cao hiệu quả dịch vụ công.
Mô hình trí tuệ nhân tạo (AI) Gemini đã tự tìm kiếm thông tin công khai trên Internet và đoán thông tin đăng nhập để truy cập 3 hệ thống trong một cuộc thử nghiệm.
Một thí nghiệm gần đây cho thấy tác nhân trí tuệ nhân tạo (AI agent) có thể tự xác định vấn đề, lựa chọn huấn luyện lại mô hình AI và triển khai phiên bản đã chỉnh sửa mà không được con người yêu cầu trực tiếp thực hiện những bước này.
Theo phóng viên TTXVN tại Israel, Hiệp hội Luật sư nước này vừa ban hành các nguyên tắc chặt chẽ về sử dụng trí tuệ nhân tạo (AI) trong hành nghề luật, theo đó các hệ thống AI tự chủ không được phép thay luật sư đưa ra quyết định chuyên môn, tư vấn pháp lý độc lập hoặc tiến hành các thủ tục pháp lý nếu không có sự giám sát và phê duyệt của con người.
Firefox đưa trợ lý AI của Mistral vào trình duyệt với một lời hứa đáng chú ý: không lưu, không bán và không dùng dữ liệu người dùng để huấn luyện mô hình.
Trí tuệ nhân tạo (AI) đang giúp các chuyên gia an ninh mạng phân tích hệ thống và phát hiện điểm yếu nhanh hơn nhưng đồng thời cũng đẩy nhanh việc tạo ra những phương thức tấn công mới, buộc các nhóm nghiên cứu phải liên tục tìm cách phát hiện lỗ hổng trước khi chúng bị khai thác trên quy mô lớn.
Bằng thủ đoạn chiếm đoạt hộp thư điện tử của một cơ quan công quyền Italy, tội phạm mạng đã đánh lừa Revolut - công ty fintech lớn nhất châu Âu, dẫn đến việc dữ liệu cá nhân và tài chính của gần 680 khách hàng bị rò rỉ.