Công cụ phát hiện AI- khắc tinh của nạn đạo văn
Từ rất lâu trước khi ứng dụng trí tuệ nhân tạo (AI) ChatGPT trở nên phổ biến, các nhà giáo dục và biên tập viên thường xuyên sử dụng các công cụ chống đạo văn để kiểm tra tính trung thực của người viết đối với tác phẩm của họ.

Các công cụ này hoạt động bằng cách so sánh văn bản với một cơ sở dữ liệu chứa nội dung từ khắp nơi trên web, những bài báo học thuật và nhiều nguồn khác để tìm kiếm các câu và cụm từ trùng lặp. Một số công cụ, chẳng hạn như Turnitin, cung cấp tỷ lệ phần trăm thể hiện mức độ trùng lặp giữa bài viết của sinh viên với các tác phẩm khác. Do nguy cơ báo cáo sai (nhận diện nhầm văn bản của người viết là AI) và sự thiếu chắc chắn về việc liệu nội dung có bị sao chép cố ý hay không, một số nhà giáo dục đã từ bỏ việc sử dụng công cụ cụ thể này.
Tuy nhiên, hiện nay, cuộc săn lùng nội dung sao chép đang chuyển thành một cuộc chiến chống lại các tác phẩm do AI tạo ra. Ngay khi sinh viên bắt đầu sử dụng ChatGPT, Google Gemini và Microsoft Copilot, các giáo viên cũng nhanh chóng áp dụng các công cụ được gọi là "công cụ phát hiện AI". Một cuộc khảo sát của Trung tâm Dân chủ và Công nghệ cho thấy 43% số giáo viên từ lớp 6 đến lớp 12 tại Mỹ thường xuyên sử dụng các công cụ phát hiện AI trong giai đoạn 2024-2025. Một số trường đại học vốn đã sử dụng Turnitin trong hệ thống quản lý học tập của họ nhận thấy rằng dịch vụ này tự động kích hoạt tính năng phát hiện AI khi công cụ này được ra mắt vào năm 2023.
Thay vì so sánh các đoạn văn bản cụ thể, những công cụ phát hiện AI như GPTZero, Pangram và công cụ do Turnitin phát triển lại dựa vào các mô hình AI của chính chúng để phán đoán xem liệu văn bản đó có phải do con người viết hay không — một quy trình được cho là còn mơ hồ hơn nhiều so với việc đối chiếu văn bản trên web. Theo GPTZero, các công cụ phát hiện AI sử dụng thuật toán để phân tích cách dùng từ, nhịp điệu và cấu trúc của văn bản, cũng như nhận diện các đặc điểm về độ dài và giọng điệu thường thấy trong văn bản do AI viết.
Việc đánh giá mang tính chủ quan này không có cơ sở vững chắc như phương pháp đối chiếu văn bản trực tuyến và có thể đưa ra kết quả sai lệch đối với những người viết sử dụng tiếng Anh như ngôn ngữ thứ hai. Mặc dù vậy, Turnitin cho biết công cụ phát hiện AI của họ chỉ gắn nhãn sai chưa đến 1% nội dung do con người viết là AI, trong khi Pangram tuyên bố tỷ lệ báo cáo sai của họ chỉ là 1/10.000. GPTZero cũng khẳng định họ có tỷ lệ nhầm lẫn nội dung của con người với AI thấp tương tự.

Cư dân mạng đã bắt đầu cáo buộc lẫn nhau là "có giọng văn giống AI", nhưng sự phổ biến của các công cụ phát hiện AI càng làm gia tăng làn sóng phát hiện hành vi thiếu trung thực nhắm vào các mô hình ngôn ngữ lớn (LLM). Trong một số vụ việc gây chú ý, những cáo buộc sử dụng AI để viết bài đã ảnh hưởng trực tiếp đến sinh kế và danh tiếng của nhiều người. Tháng trước, nhà xuất bản Minotaur đã hủy bỏ hợp đồng sách trị giá 2 triệu USD do lo ngại tác giả Jerry Falade sử dụng AI nhưng ông kiên quyết phủ nhận.
Một nghiên cứu năm 2023 của Đại học Stanford cho thấy các công cụ phát hiện AI thường xuyên nhận diện sai các bài luận do người không nói tiếng Anh bản ngữ viết là sản phẩm của AI, với tỷ lệ cao hơn so với bài viết của người bản ngữ. Theo Đại học California, Los Angeles, các công cụ phát hiện AI được huấn luyện để nhận diện những khuôn mẫu có thể cho thấy sự hiện diện của AI, chẳng hạn như việc lặp lại các từ và cụm từ, văn phong quá trang trọng hoặc quá suồng sã, và các cách diễn đạt vô nghĩa.
Một số công cụ, như QuillBot, còn đo lường "tính khó dự đoán" của văn bản vì "AI có xu hướng lựa chọn ngôn ngữ 'rõ ràng' hoặc phổ biến nhất so với văn bản do con người tạo ra". Chúng cũng có thể tìm kiếm cấu trúc câu không thay đổi xuyên suốt văn bản như một dấu hiệu khác của AI. Tuy nhiên, bản thân các chỉ số này không khẳng định chắc chắn đó là sản phẩm của AI, vì một số người có thể sở hữu phong cách viết mang những đặc điểm tương tự.
Sự thiếu tin cậy vào các công cụ phát hiện AI đã khiến một số cơ sở giáo dục quyết định ngừng hoàn toàn việc sử dụng chúng. Các trường đại học như Yale, Johns Hopkins, Vanderbilt, Georgetown và nhiều trường khác đã vô hiệu hóa hoặc hạn chế sử dụng những công cụ phát hiện AI. Viện Công nghệ Massachusetts (MIT) cũng đưa ra cảnh báo "các công cụ phát hiện AI không thực sự hiệu quả".

Thay vì dựa vào các công cụ để sàng lọc nội dung do AI tạo ra, nhiều trường học đang khuyến khích những nhà giáo dục xem xét lại phương pháp giảng dạy. Ví dụ, Đại học Chicago gợi ý giáo viên nên yêu cầu sinh viên đọc chậm lại, chia nhỏ các bài tập viết dài và yêu cầu sinh viên tự suy ngẫm về bài làm của mình. Đại học Stanford cho biết các giảng viên có thể cân nhắc tổ chức kiểm tra, đánh giá ngay tại lớp học, trong khi MIT khuyên giảng viên nên tạo điều kiện để sinh viên tự nguyện khai báo nếu có sử dụng AI hỗ trợ làm bài tập mà không bị phạt.
Khi AI ngày càng trở nên phổ biến cả trong và ngoài lớp học, các nỗ lực nhằm phân biệt đâu là nội dung do con người viết và đâu là do máy móc tạo ra cũng đang gia tăng mạnh mẽ. Một số nền tảng trực tuyến thậm chí còn làm trầm trọng thêm sự nghi ngờ về việc sử dụng AI. Substack đã tích hợp công cụ Pangram vào ứng dụng của mình, cho phép người dùng quét các bài blog để tìm kiếm nội dung nghi do AI tạo ra, trong khi LinkedIn bổ sung nút "có vẻ là nội dung rác do AI tạo ra" vào những bài đăng. Kết quả là một kỷ nguyên mới của sự thiếu tin tưởng đã hình thành: độc giả liên tục đặt câu hỏi liệu nội dung họ đang đọc có phải do AI viết hay không, còn những người viết thực thụ thì cố gắng hết sức để văn phong của mình không bị nhầm lẫn với sản phẩm của AI.
Tin cùng chuyên mục
Chiếc bánh quy khởi đầu là rác thải nhựa
Kiosk hành chính công thông minh: Từng bước chuyển từ hồ sơ giấy sang sử dụng dữ liệu số
Hà Nội cho phép thử nghiệm xe tự hành, robotaxi tại Hòa Lạc
Chip AI Jalapeño có thể làm rạn nứt quan hệ hợp tác OpenAI-Nvidia
Ngành cơ khí tăng tốc chuyển đổi số
Thực hiện Chiến lược phát triển công nghiệp quốc gia, định hướng phát triển ngành cơ khí trở thành ngành công nghiệp nền tảng, việc ứng dụng các công nghệ số tiên tiến trong thiết kế, sản xuất và quản lý vận hành đang trở thành yêu cầu cấp thiết đối với các doanh nghiệp cơ khí và sản xuất công nghiệp.
Mở rộng không gian phát triển cho nhà khoa học nữ
Việt Nam đang sở hữu một lực lượng nữ trí thức khoa học và công nghệ đông đảo, với tỷ lệ nữ giới trong lực lượng nghiên cứu và phát triển cao hơn đáng kể mức trung bình của thế giới. Nhiều công trình nghiên cứu có giá trị đã được tạo ra, nhưng hành trình từ phòng thí nghiệm đến thị trường vẫn còn không ít khoảng trống.
TP Hồ Chí Minh thúc đẩy sử dụng hiệu quả quỹ phát triển khoa học và công nghệ
Ngày 25/8, Sở Khoa học và Công nghệ TP Hồ Chí Minh tổ chức Hội nghị “Thúc đẩy hoạt động phát triển khoa học, công nghệ, đổi mới sáng tạo và chuyển đổi số thông qua việc sử dụng quỹ phát triển khoa học và công nghệ của doanh nghiệp trên địa bàn Thành phố Hồ Chí Minh” với sự tham dự của đại diện các doanh nghiệp, cơ quan, tổ chức và đơn vị trên địa bàn.