Nvidia tung sản phẩm chặn tác nhân AI hoạt động sai lệnh
Nvidia vừa chính thức công bố hệ thống kiểm soát mới cho các tác nhân trí tuệ nhân tạo (AI) tự chủ nhằm ngăn chặn nguy cơ công nghệ này vượt phạm vi cho phép sau hàng loạt sự cố an toàn gần đây.
 Nvidia_logo_cropped.jpeg)
Tập đoàn công nghệ đa quốc gia Nvidia ngày 28/9 công bố hệ thống mới nhằm kiểm soát các chương trình AI có khả năng tự thực hiện nhiệm vụ. Tập đoàn có trụ sở tại Mỹ này công bố bước đi nói trên trong bối cảnh xảy ra một loạt sự cố gần đây cho thấy các hệ thống AI tự chủ có thể vượt khỏi phạm vi hoạt động được thiết lập, làm dấy lên lo ngại về rủi ro khi công nghệ này được triển khai rộng rãi.
Khác với các chatbot chủ yếu trả lời câu hỏi, các “tác nhân AI” (AI agents) có thể tự thực hiện nhiều công việc như truy cập Internet, viết và chạy mã máy tính, xử lý tệp hoặc tương tác với các hệ thống khác để hoàn thành nhiệm vụ được giao. Công nghệ này được xem là bước phát triển tiếp theo của AI, nhưng khả năng tự hành cũng đang tạo ra những rủi ro mới. Một số công ty công nghệ lớn gần đây ghi nhận các tác nhân AI tìm cách thoát khỏi môi trường thử nghiệm vốn được thiết kế để kiểm soát hoạt động của chúng. Theo OpenAI, công ty phát triển ChatGPT, các tác nhân AI của hãng từng truy cập nhiều trang web, trong đó có trang của các cơ quan liên bang Mỹ, một cổng dữ liệu thống kê y tế của Australia và Hugging Face - nền tảng lưu trữ các mô hình AI.
Trong bối cảnh đó, Nvidia giới thiệu một hệ thống được thiết kế như một “hàng rào an toàn” cho các tác nhân AI. Nvidia cho biết nền tảng mới, mang tên NVIDIA Open Agent Safety Platform (tạm dịch là “Nền tảng an toàn tác nhân mở”), cung cấp các công cụ kiểm soát hoạt động của tác nhân AI trên nhiều lớp, từ phần mềm và phần cứng cung cấp năng lực tính toán đến các hệ thống robot thực hiện nhiệm vụ trong thế giới thực.
Nền tảng này bao gồm NVIDIA OpenShell, một phần mềm tạo môi trường thực thi an toàn và thiết lập các giới hạn đối với những tác nhân AI chạy trên CPU. Khi các tác nhân AI ngày càng đảm nhiệm nhiều công việc hơn và tương tác với nhiều hệ thống hơn, doanh nghiệp cần một ranh giới kiểm soát có thể thực thi được, nằm bên ngoài bản thân mô hình AI và phần mềm điều phối tác nhân.
Bên cạnh đó, NVIDIA Sentry hoạt động như một hệ thống giám sát độc lập bên ngoài tác nhân AI. Sentry liên tục theo dõi hành vi của tác nhân và có thể cô lập hoặc dừng hệ thống trong thời gian rất ngắn (trong vài mili giây) nếu phát hiện tác nhân vượt khỏi phạm vi được phép.
Theo Nvidia, OpenShell có thể hoạt động trên nhiều nền tảng phần cứng, trong khi Sentry được thiết kế để chạy trên bộ xử lý dữ liệu NVIDIA BlueField®-4 DPU. Công ty cho rằng cách tiếp cận này tạo ra một lớp kiểm soát nằm ngoài chính mô hình AI, qua đó hạn chế khả năng tác nhân tự thay đổi hoặc vượt qua các giới hạn được đặt ra.
 Nvidia_CEO Jensen Huang_cropped.jpeg)
Nvidia lưu ý giải pháp này có thể đã ngăn chặn một sự cố xảy ra tại Hugging Face, khi nền tảng này cho biết hơn 17.000 tác nhân AI đã tấn công cơ sở hạ tầng của công ty trong nhiều ngày và nhiều tuần. Giám đốc điều hành Nvidia, ông Jensen Huang khẳng định những rủi ro liên quan đến AI tự hành có thể được giải quyết bằng các giải pháp kỹ thuật. Trao đổi với kênh truyền hình CNBC (Mỹ), ông so sánh thách thức hiện nay với những ngày đầu của Internet, khi các trang web có thể khiến máy tính người dùng chạy những đoạn mã không mong muốn, từ đó phát tán virus. Theo ông Huang, Internet sau đó đã phát triển các trình duyệt như một lớp bảo vệ, giới hạn những gì các trang web có thể làm trên máy tính. Nvidia đang áp dụng cách tiếp cận tương tự đối với các tác nhân AI bằng cách tạo ra một lớp kiểm soát nằm giữa tác nhân và các hệ thống mà tác nhân có thể truy cập.
Nvidia cho biết hơn 100 tổ chức đang hợp tác với hãng để triển khai nền tảng mới, trong đó có Microsoft, Cisco, Salesforce và SAP. Anthropic đã kết nối các tác nhân Claude với hệ thống, trong khi SpaceXAI đang áp dụng giải pháp này cho các mô hình Grok./.
Tin cùng chuyên mục
Nhật Bản tăng tốc AI và robot trước bài toán nhân lực
OpenAI xin lỗi, tăng cường an ninh mạng sau sự cố tại Australia
Gia tăng khoảng cách tiếp cận AI giữa thành thị và nông thôn ở Hàn Quốc
Việc sử dụng trí tuệ nhân tạo (AI) tạo sinh đang nhanh chóng phổ biến tại Hàn Quốc, song quá trình này đồng thời bộc lộ khoảng cách ngày càng lớn giữa khu vực thành thị và nông thôn. Đáng chú ý, khoảng cách về tỷ lệ trải nghiệm AI giữa hai khu vực đã tăng hơn 3 lần chỉ trong một năm, cho thấy nguy cơ hình thành một dạng “khoảng cách số” mới trong xã hội Hàn Quốc.
Đào tạo nguồn nhân lực chất lượng cao cho các ngành công nghệ mới nổi
Nỗi lo an toàn khiến OpenAI rút GPT-6.1 Astra khỏi kế hoạch ra mắt
Việt Nam sẽ làm chủ công nghệ chế tạo cuộn kháng bù ngang điện áp 500 kV
Trí thức Việt tại Thụy Sĩ chung sức phát triển công nghệ
Từ Geneva, những chuyên gia, trí thức người Việt đang làm việc tại Thụy Sĩ cùng tìm lời giải cho câu chuyện đưa tri thức và kinh nghiệm quốc tế về phục vụ phát triển đất nước. Cuộc gặp với Đại sứ Mai Phan Dũng mở thêm những kết nối trong khoa học, công nghệ, đổi mới sáng tạo và chuyển đổi số, hướng tới các sáng kiến hợp tác cụ thể.
Google thử nghiệm mua hàng trực tiếp qua Gemini và AI Mode
Google bắt đầu thử nghiệm tính năng mới cho phép người dùng mua sản phẩm trên nền tảng thương mại điện tử Flipkart, thuộc tập đoàn Walmart, trực tiếp thông qua các dịch vụ Gemini và AI Mode. Động thái này cho thấy Google đang mở rộng vai trò của trí tuệ nhân tạo (AI), từ công cụ tìm kiếm và gợi ý sản phẩm sang trực tiếp tham gia vào quá trình mua hàng.