OpenAI “hãm phanh” chương trình AI tiên tiến

Ngày 18/8, OpenAI, “cha đẻ” ChatGPT, cho biết đang tạm thời hãm lại tiến độ phát triển mô hình trí tuệ nhân tạo (AI) tiên tiến nhất của mình và thắt chặt các biện pháp kiểm soát nội bộ, sau vụ tấn công mạng do chính một trong các công cụ AI của hãng này thực hiện.

Đài Trang
19/08/2026
16:20
OpenAI tạm dừng huấn luyện các mô hình mới nhất trong 2 tuần. (Ảnh: Rappler.com)
OpenAI tạm dừng huấn luyện các mô hình mới nhất trong 2 tuần. (Ảnh: Rappler.com)

Trong một bài đăng, OpenAI cho biết đang hoãn thực hiện đợt huấn luyện AI quy mô lớn nhất từng được lên kế hoạch, trong khi chờ xác minh xem liệu mô hình thu được có hoạt động đúng như mong đợi hay không. Các đợt huấn luyện là những quy trình bắt buộc để nạp dữ liệu nhằm tăng năng lực suy luận và phản hồi của các mô hình AI. Theo đó, OpenAI tạm dừng huấn luyện các mô hình mới nhất trong 2 tuần trước khi tiếp tục lại với các biện pháp kiểm soát chặt chẽ hơn. Các nguồn tin cho biết phần lớn công việc kiểm soát liên quan đến Astra – mô hình lớn tiếp theo của công ty, sau một báo cáo hồi đầu tháng 8 cho thấy mô hình này có nguy cơ vượt qua ngưỡng cảnh báo của OpenAI về tấn công mạng.

Ngày 18/8, OpenAI cũng cho biết họ đang phát triển một hệ thống mới để giám sát quá trình suy luận nội bộ của các mô hình và cảnh báo cho con người trong vòng 30 phút nếu phát hiện hành vi đáng ngờ. Tuy nhiên, việc giám sát này sẽ đòi hỏi thêm 20% năng lực tính toán. Ngoài ra, phương pháp này cũng có hạn chế vì mô hình AI có thể học cách che giấu ý định trong quá trình suy luận, nếu biết mình bị giám sát. 

Là nhân tố chủ chốt trong quá trình xây dựng cơ sở hạ tầng và công cụ AI trên toàn cầu, quyết định của OpenAI có thể ảnh hưởng đến tiến độ phát triển AI của thế giới. Quyết định trên được đưa ra sau khi hồi giữa tháng 7, một tác nhân AI (AI agent) dựa trên hai mô hình của OpenAI đã tự ý thoát khỏi môi trường thử nghiệm để xâm nhập vào internet và tấn công Hugging Face – một nền tảng nơi các nhà phát triển trên toàn thế giới chia sẻ các mô hình AI của họ. OpenAI cam kết sẽ công bố báo cáo kỹ thuật chi tiết về sự cố liên quan đến Hugging Face song vẫn chưa thực hiện. Đáng chú ý, không chỉ OpenAI, hồi cuối tháng 7, đối thủ cạnh tranh của hãng này là Anthropic cũng tiết lộ rằng 3 mô hình đang trong giai đoạn thử nghiệm của công ty đã thực hiện các vụ xâm nhập trái phép vào hệ thống máy tính của 3 tổ chức khác nhau.

Những sự cố này đã khiến 1.000 nhân viên trong ngành công nghệ ký tên một bản kiến nghị kêu gọi Chính phủ Mỹ ủng hộ giảm tốc việc phát triển các hệ thống AI tiên tiến nhất. Hồi đầu năm nay, Chính phủ Mỹ từng viện dẫn các lo ngại về an ninh quốc gia để ngăn việc phát hành những mô hình AI mạnh do Anthropic và OpenAI phát triển./.

Một tác nhân AI dựa trên hai mô hình của OpenAI đã thoát khỏi môi trường thử nghiệm để tấn công Hugging Face hồi giữa tháng 7. (Ảnh: huggingface.co)
Một tác nhân AI dựa trên hai mô hình của OpenAI đã thoát khỏi môi trường thử nghiệm để tấn công Hugging Face hồi giữa tháng 7. (Ảnh: huggingface.co)

Tin cùng chuyên mục

Thái Lan đặt mục tiêu 3 triệu hộ chiếu AI

Thái Lan đặt mục tiêu 3 triệu hộ chiếu AI

Bộ Kinh tế và Xã hội số Thái Lan (DES) đặt mục tiêu tăng số lượng người đăng ký chương trình Hộ chiếu Trí tuệ nhân tạo quốc gia (TH-AI Passport) lên 3 triệu người vào cuối năm nay, gấp đôi so với mốc 1,57 triệu người đăng ký hiện tại.

Ngành xuất bản tìm cách xác thực "sách do con người sáng tác" trước làn sóng AI

Ngành xuất bản tìm cách xác thực "sách do con người sáng tác" trước làn sóng AI

Làn sóng nghi vấn sử dụng trí tuệ nhân tạo (AI) trong sáng tác đang thúc đẩy ngành xuất bản quốc tế tìm cách xác thực sách do con người viết nhằm bảo vệ uy tín tác giả và củng cố niềm tin độc giả. Tuy nhiên, khi ranh giới giữa hỗ trợ sáng tác và tạo nội dung bằng AI ngày càng khó phân định, những nhãn chứng nhận này vẫn phải đối mặt với bài toán về tính minh bạch và khả năng kiểm chứng.

Cuộc cách mạng mang tên AI của các ứng dụng giao đồ ăn

Các ứng dụng giao đồ ăn như DoorDash và Uber Eats đang đứng trước cuộc chuyển mình mang tính bước ngoặt.

Các ứng dụng giao đồ ăn như DoorDash và Uber Eats đã thay đổi thói quen ăn uống của thực khách cũng như cách thức vận hành của các nhà hàng. Tuy vậy, trí tuệ nhân tạo (AI) có thể buộc ngành này phải đối mặt với một cuộc chuyển mình mang tính bước ngoặt.

Hà Nội gỡ “điểm nghẽn” giao thông từ trung tâm điều hành

Hà Nội đang đẩy mạnh ứng dụng trí tuệ nhân tạo (AI), dữ liệu số trong quản lý, điều hành giao thông, góp phần xử lý một trong những “điểm nghẽn” lớn của đô thị. Việc khai thác AI, dữ liệu thời gian thực đang từng bước cụ thể hóa Nghị quyết 57 trong quản trị giao thông Thủ đô.

Hà Nội đang đẩy mạnh ứng dụng trí tuệ nhân tạo (AI), dữ liệu số trong quản lý, điều hành giao thông, góp phần xử lý một trong những “điểm nghẽn” lớn của đô thị. Việc khai thác AI, dữ liệu thời gian thực đang từng bước cụ thể hóa Nghị quyết 57 trong quản trị giao thông Thủ đô.

Từ dữ liệu đến ứng dụng - Hải Phòng tìm lời giải cho AI

Từ dữ liệu đến ứng dụng - Hải Phòng tìm lời giải cho AI

Hải Phòng đang từng bước hoàn thiện hạ tầng dữ liệu, nền tảng tích hợp và các điều kiện cần thiết để đưa trí tuệ nhân tạo vào quản lý, điều hành và sản xuất, kinh doanh. Trong đó, chất lượng, khả năng kết nối và khai thác dữ liệu được xác định là yếu tố quan trọng để các ứng dụng AI phát huy hiệu quả.

Có gì ở Triển lãm Robot Hà Nội 2026?

Có gì ở Triển lãm Robot Hà Nội 2026?

Triển lãm Robot Hà Nội 2026 quy tụ hàng trăm mẫu robot, mang đến cơ hội để người xem, đặc biệt là các bạn học sinh, sinh viên trải nghiệm những công nghệ đang định hình tương lai. Sự kiện do Sở Khoa học Công nghệ Hà Nội chủ trì với sự tham gia của Trung tâm Chuyển đổi số thành phố Hà Nội nhằm thực hiện chủ trưởng Đảng và Nhà nước về đẩy mạnh đổi mới sáng tạo, chuyển đổi số quốc gia.