AI Trung Quốc áp sát mô hình Mỹ về năng lực phát hiện lỗ hổng bảo mật
Với việc công bố mô hình GLM-5.3 sở hữu năng lực dò tìm lỗ hổng phần mềm tiệm cận Mythos 5 của Mỹ, công ty khởi nghiệp Trung Quốc Z.ai đang thu hút sự chú ý mạnh mẽ và củng cố vị thế vững chắc trong cộng đồng lập trình viên phương Tây.
Công ty khởi nghiệp AI Z.ai của Trung Quốc mới đây cho biết mô hình mã nguồn mở GLM-5.3 của họ đã tiệm cận mô hình Mythos 5 do Anthropic (Mỹ) phát triển ở khả năng phát hiện lỗ hổng phần mềm. Kết quả củng cố vị thế của một công ty AI Trung Quốc đang thu hút sự chú ý trong giới lập trình viên phương Tây.
Cụ thể, Z.ai công bố GLM-5.3 đạt 84,5% trong bài kiểm tra CyberGym (chuyên đánh giá khả năng rà soát mã nguồn, nhận diện lỗi bảo mật và xác nhận lỗi có thực). Kết quả này cao hơn mức 83,8% mà công ty ghi nhận cho Mythos 5. Tuy nhiên, giới quan sát lưu ý các kết quả này chưa được bên thứ ba kiểm chứng độc lập.
Tuy nhiên, GLM-5.3 vẫn tỏ ra tụt hậu so với đối thủ Mỹ ở khả năng chuyển đổi các lỗ hổng đã phát hiện thành các cuộc tấn công thực tế (một phần tiêu chuẩn trong nghiên cứu an ninh phòng thủ). Trên bài kiểm tra ExploitBench về năng lực này, mô hình của Z.ai chỉ đạt 54,4%, thấp hơn nhiều so với mức 78,0% của Mythos 5.
Tương tự, trong một bài kiểm tra giới hạn thời gian về phát triển tấn công, GLM-5.3 hoàn thành 105 tác vụ trong hai giờ và 130 tác vụ trong sáu giờ. Kết quả này thấp hơn mức 181 và 247 nhiệm vụ của đối thủ đến từ Mỹ.
Mythos là phiên bản mô hình Claude Fable 5 được gỡ bỏ một số rào chắn an toàn về an ninh mạng và chỉ được Anthropic cấp quyền sử dụng cho các tổ chức đã qua thẩm định. Cơ chế kiểm soát này phản ánh lo ngại rằng các hệ thống AI có khả năng phát hiện lỗ hổng phần mềm mang tính rủi ro "lưỡng dụng": vừa đủ sức hỗ trợ bên phòng thủ, song cũng có thể hạ thấp rào cản cho phía tin tặc.
Trái ngược với cách tiếp cận đó, Z.ai cho biết sẽ phát hành GLM-5.3 rộng rãi sau khoảng hai tuần nữa sau khi hoàn tất đánh giá an ninh. Các chức năng an ninh mạng nhạy cảm nhất sẽ được giới hạn thông qua chương trình "truy cập đáng tin cậy" dành riêng cho người dùng đã xác minh.
Phía Z.ai cũng khẳng định đã bổ sung nhiều lớp bảo vệ, bao gồm hệ thống sàng lọc yêu cầu rủi ro, giám sát hoạt động và đào tạo mô hình từ chối các tác vụ độc hại.
Tuy nhiên, giới chuyên gia bảo mật cho rằng các biện pháp này khó duy trì hiệu lực một khi mô hình được phát hành để bên thứ ba tải về, chỉnh sửa hoặc kết hợp với công cụ bên ngoài.
Đại diện Z.ai lập luận rằng các công cụ phòng thủ mạng tiên tiến cần được cung cấp cho các nhà phát triển phần mềm nguồn mở và các nhóm bảo mật quy mô nhỏ, thay vì bị kiểm soát độc quyền bởi một vài nhà cung cấp mô hình khép kín.
Để hiện thực hóa mục tiêu này, hãng sẽ khởi động sáng kiến "Lá chắn Mã nguồn mở" (Open Source Shield) nhằm kiểm toán các dự án mã nguồn mở, cung cấp quyền truy cập mô hình cho công tác phòng thủ và tích hợp chức năng kiểm toán mã vào sản phẩm lập trình ZCode của hãng.
Theo công bố của Z.ai, GLM-5.3 dùng chung mô hình nền với GLM-5.2 nhưng được huấn luyện hậu kỳ mở rộng trong các môi trường tác vụ dài và đa dạng hơn. Trước đó, mô hình tiền nhiệm GLM-5.2 cũng đã gây tiếng vang toàn cầu nhờ khả năng lập trình và xử lý tác vụ tiệm cận các mô hình hàng đầu của Mỹ nhưng với chi phí thấp hơn đáng kể./.
Tin cùng chuyên mục
Hà Nội cho phép thử nghiệm xe tự hành, robotaxi tại Hòa Lạc
Mô hình AI giúp phát hiện các ca ung thư gan bị bỏ sót
Các nền kinh tế đang phát triển đối mặt nguy cơ tụt hậu về AI nghiêm trọng nhất
Ngày 25/8, phát biểu mở đầu tại một cuộc tọa đàm diễn ra tại Washington D.C, Mỹ, Tổng Giám đốc Quỹ Tiền tệ Quốc tế (IMF) Kristalina Georgieva nhận định tác động trong tương lai của trí tuệ nhân tạo (AI) vẫn bị phủ bóng bởi những yếu tố chưa thể biết, và các nền kinh tế đang phát triển có nguy cơ tụt hậu về AI nghiêm trọng nhất.
Giới trẻ Mỹ từ hào hứng đến dè chừng về Trí tuệ nhân tạo
OpenAI bị điều tra tại Mỹ sau vụ AI “tự ý” tấn công mạng
Ấn Độ: AI đang tạo việc làm thay vì lấy đi việc làm
AI thay thế các chuyên gia ngân hàng - xu hướng tạm thời hay dài hạn?
Ông Chris Churchman, người đứng đầu nền tảng kỹ thuật số dành cho khách hàng tổ chức có tên Marquee của ngân hàng Goldman Sachs, vừa cảnh báo việc sử dụng trí tuệ nhân tạo (AI) ngày càng nhiều trên thị trường tài chính Phố Wall có nguy cơ làm suy giảm năng lực tư duy của thế hệ chuyên gia tài chính kế cận.
Cơn sốt AI đưa thị trấn nhỏ của Áo lên bản đồ công nghệ
Huấn luyện mô hình AI: Khi quy định chưa theo kịp thực tế
Có lẽ chúng ta đã biết rằng các mô hình trí tuệ nhân tạo (AI) ChatGPT, Gemini, Claude và những chatbot khác được huấn luyện dựa trên các kho dữ liệu khổng lồ (gần như vô tận) gồm các tác phẩm đã xuất bản - bao gồm hàng trăm triệu cuốn sách, bài viết trực tuyến, tài liệu học thuật và về cơ bản là bất cứ thứ gì chúng ta có thể tìm thấy trên mạng Internet.