Nvidia tung sản phẩm chặn tác nhân AI hoạt động sai lệnh

Nvidia vừa chính thức công bố hệ thống kiểm soát mới cho các tác nhân trí tuệ nhân tạo (AI) tự chủ nhằm ngăn chặn nguy cơ công nghệ này vượt phạm vi cho phép sau hàng loạt sự cố an toàn gần đây.

Nguyễn Hà
29/09/2026
22:35
Nvidia giới thiệu một hệ thống được thiết kế như một “hàng rào an toàn” cho các tác nhân AI. (Ảnh: businesstimes.com.sg)
Nvidia giới thiệu một hệ thống được thiết kế như một “hàng rào an toàn” cho các tác nhân AI. (Ảnh: businesstimes.com.sg)

Tập đoàn công nghệ đa quốc gia Nvidia ngày 28/9 công bố hệ thống mới nhằm kiểm soát các chương trình AI có khả năng tự thực hiện nhiệm vụ. Tập đoàn có trụ sở tại Mỹ này công bố bước đi nói trên trong bối cảnh xảy ra một loạt sự cố gần đây cho thấy các hệ thống AI tự chủ có thể vượt khỏi phạm vi hoạt động được thiết lập, làm dấy lên lo ngại về rủi ro khi công nghệ này được triển khai rộng rãi.

Khác với các chatbot chủ yếu trả lời câu hỏi, các “tác nhân AI” (AI agents) có thể tự thực hiện nhiều công việc như truy cập Internet, viết và chạy mã máy tính, xử lý tệp hoặc tương tác với các hệ thống khác để hoàn thành nhiệm vụ được giao. Công nghệ này được xem là bước phát triển tiếp theo của AI, nhưng khả năng tự hành cũng đang tạo ra những rủi ro mới. Một số công ty công nghệ lớn gần đây ghi nhận các tác nhân AI tìm cách thoát khỏi môi trường thử nghiệm vốn được thiết kế để kiểm soát hoạt động của chúng. Theo OpenAI, công ty phát triển ChatGPT, các tác nhân AI của hãng từng truy cập nhiều trang web, trong đó có trang của các cơ quan liên bang Mỹ, một cổng dữ liệu thống kê y tế của Australia và Hugging Face - nền tảng lưu trữ các mô hình AI.

Trong bối cảnh đó, Nvidia giới thiệu một hệ thống được thiết kế như một “hàng rào an toàn” cho các tác nhân AI. Nvidia cho biết nền tảng mới, mang tên NVIDIA Open Agent Safety Platform (tạm dịch là “Nền tảng an toàn tác nhân mở”), cung cấp các công cụ kiểm soát hoạt động của tác nhân AI trên nhiều lớp, từ phần mềm và phần cứng cung cấp năng lực tính toán đến các hệ thống robot thực hiện nhiệm vụ trong thế giới thực.

Nền tảng này bao gồm NVIDIA OpenShell, một phần mềm tạo môi trường thực thi an toàn và thiết lập các giới hạn đối với những tác nhân AI chạy trên CPU. Khi các tác nhân AI ngày càng đảm nhiệm nhiều công việc hơn và tương tác với nhiều hệ thống hơn, doanh nghiệp cần một ranh giới kiểm soát có thể thực thi được, nằm bên ngoài bản thân mô hình AI và phần mềm điều phối tác nhân.

Bên cạnh đó, NVIDIA Sentry hoạt động như một hệ thống giám sát độc lập bên ngoài tác nhân AI. Sentry liên tục theo dõi hành vi của tác nhân và có thể cô lập hoặc dừng hệ thống trong thời gian rất ngắn (trong vài mili giây) nếu phát hiện tác nhân vượt khỏi phạm vi được phép.

Theo Nvidia, OpenShell có thể hoạt động trên nhiều nền tảng phần cứng, trong khi Sentry được thiết kế để chạy trên bộ xử lý dữ liệu NVIDIA BlueField®-4 DPU. Công ty cho rằng cách tiếp cận này tạo ra một lớp kiểm soát nằm ngoài chính mô hình AI, qua đó hạn chế khả năng tác nhân tự thay đổi hoặc vượt qua các giới hạn được đặt ra.

Giám đốc điều hành Nvidia, ông Jensen Huang khẳng định những rủi ro liên quan đến AI tự hành có thể được giải quyết bằng các giải pháp kỹ thuật. (Ảnh: blogs.nvidia.com)
Giám đốc điều hành Nvidia, ông Jensen Huang khẳng định những rủi ro liên quan đến AI tự hành có thể được giải quyết bằng các giải pháp kỹ thuật. (Ảnh: blogs.nvidia.com)

Nvidia lưu ý giải pháp này có thể đã ngăn chặn một sự cố xảy ra tại Hugging Face, khi nền tảng này cho biết hơn 17.000 tác nhân AI đã tấn công cơ sở hạ tầng của công ty trong nhiều ngày và nhiều tuần. Giám đốc điều hành Nvidia, ông Jensen Huang khẳng định những rủi ro liên quan đến AI tự hành có thể được giải quyết bằng các giải pháp kỹ thuật. Trao đổi với kênh truyền hình CNBC (Mỹ), ông so sánh thách thức hiện nay với những ngày đầu của Internet, khi các trang web có thể khiến máy tính người dùng chạy những đoạn mã không mong muốn, từ đó phát tán virus. Theo ông Huang, Internet sau đó đã phát triển các trình duyệt như một lớp bảo vệ, giới hạn những gì các trang web có thể làm trên máy tính. Nvidia đang áp dụng cách tiếp cận tương tự đối với các tác nhân AI bằng cách tạo ra một lớp kiểm soát nằm giữa tác nhân và các hệ thống mà tác nhân có thể truy cập.

Nvidia cho biết hơn 100 tổ chức đang hợp tác với hãng để triển khai nền tảng mới, trong đó có Microsoft, Cisco, Salesforce và SAP. Anthropic đã kết nối các tác nhân Claude với hệ thống, trong khi SpaceXAI đang áp dụng giải pháp này cho các mô hình Grok./.

Tin cùng chuyên mục

Nhật Bản tăng tốc AI và robot trước bài toán nhân lực

Nhật Bản tăng tốc AI và robot trước bài toán nhân lực

Trước nguy cơ thiếu hụt lao động trầm trọng khi làn sóng già hóa chạm đỉnh vào năm 2040, Bộ Y tế, Lao động và Phúc lợi Nhật Bản trong Sách Trắng 2026 đã nhấn mạnh việc khẩn trương đẩy mạnh ứng dụng trí tuệ nhân tạo (AI) và robot trong ngành y tế và chăm sóc người cao tuổi.

Gia tăng khoảng cách tiếp cận AI giữa thành thị và nông thôn ở Hàn Quốc

Gia tăng khoảng cách tiếp cận AI giữa thành thị và nông thôn ở Hàn Quốc

Việc sử dụng trí tuệ nhân tạo (AI) tạo sinh đang nhanh chóng phổ biến tại Hàn Quốc, song quá trình này đồng thời bộc lộ khoảng cách ngày càng lớn giữa khu vực thành thị và nông thôn. Đáng chú ý, khoảng cách về tỷ lệ trải nghiệm AI giữa hai khu vực đã tăng hơn 3 lần chỉ trong một năm, cho thấy nguy cơ hình thành một dạng “khoảng cách số” mới trong xã hội Hàn Quốc.

Trí thức Việt tại Thụy Sĩ chung sức phát triển công nghệ

Trí thức Việt tại Thụy Sĩ chung sức phát triển công nghệ

Từ Geneva, những chuyên gia, trí thức người Việt đang làm việc tại Thụy Sĩ cùng tìm lời giải cho câu chuyện đưa tri thức và kinh nghiệm quốc tế về phục vụ phát triển đất nước. Cuộc gặp với Đại sứ Mai Phan Dũng mở thêm những kết nối trong khoa học, công nghệ, đổi mới sáng tạo và chuyển đổi số, hướng tới các sáng kiến hợp tác cụ thể.

Google thử nghiệm mua hàng trực tiếp qua Gemini và AI Mode

Google thử nghiệm mua hàng trực tiếp qua Gemini và AI Mode

Google bắt đầu thử nghiệm tính năng mới cho phép người dùng mua sản phẩm trên nền tảng thương mại điện tử Flipkart, thuộc tập đoàn Walmart, trực tiếp thông qua các dịch vụ Gemini và AI Mode. Động thái này cho thấy Google đang mở rộng vai trò của trí tuệ nhân tạo (AI), từ công cụ tìm kiếm và gợi ý sản phẩm sang trực tiếp tham gia vào quá trình mua hàng.

"Cơn sốt" AI có thể làm phình to núi rác điện tử

"Cơn sốt" AI có thể làm phình to núi rác điện tử

Sự bùng nổ của AI có thể kéo theo lượng rác thải điện tử khổng lồ, với tới 617 triệu tấn thiết bị liên quan cần xử lý trong giai đoạn 2025-2050. Cảnh báo cho thấy nếu không có giải pháp thu hồi và tái chế phù hợp, AI có thể làm trầm trọng thêm cuộc khủng hoảng rác thải độc hại toàn cầu.

OpenAI tạm dừng huấn luyện các mô hình AI mạnh nhất

OpenAI tạm dừng huấn luyện các mô hình AI mạnh nhất

OpenAI tạm dừng huấn luyện các mô hình AI mạnh nhất sau hàng loạt sự cố, trong đó có việc mô hình tự khai thác lỗ hổng để truy cập Internet và các công cụ AI tự ý thu thập dữ liệu. Công ty chỉ nối lại quá trình huấn luyện khi tin tưởng các biện pháp bảo vệ bổ sung.