Công cụ phát hiện AI- khắc tinh của nạn đạo văn
Từ rất lâu trước khi ứng dụng trí tuệ nhân tạo (AI) ChatGPT trở nên phổ biến, các nhà giáo dục và biên tập viên thường xuyên sử dụng các công cụ chống đạo văn để kiểm tra tính trung thực của người viết đối với tác phẩm của họ.

Các công cụ này hoạt động bằng cách so sánh văn bản với một cơ sở dữ liệu chứa nội dung từ khắp nơi trên web, những bài báo học thuật và nhiều nguồn khác để tìm kiếm các câu và cụm từ trùng lặp. Một số công cụ, chẳng hạn như Turnitin, cung cấp tỷ lệ phần trăm thể hiện mức độ trùng lặp giữa bài viết của sinh viên với các tác phẩm khác. Do nguy cơ báo cáo sai (nhận diện nhầm văn bản của người viết là AI) và sự thiếu chắc chắn về việc liệu nội dung có bị sao chép cố ý hay không, một số nhà giáo dục đã từ bỏ việc sử dụng công cụ cụ thể này.
Tuy nhiên, hiện nay, cuộc săn lùng nội dung sao chép đang chuyển thành một cuộc chiến chống lại các tác phẩm do AI tạo ra. Ngay khi sinh viên bắt đầu sử dụng ChatGPT, Google Gemini và Microsoft Copilot, các giáo viên cũng nhanh chóng áp dụng các công cụ được gọi là "công cụ phát hiện AI". Một cuộc khảo sát của Trung tâm Dân chủ và Công nghệ cho thấy 43% số giáo viên từ lớp 6 đến lớp 12 tại Mỹ thường xuyên sử dụng các công cụ phát hiện AI trong giai đoạn 2024-2025. Một số trường đại học vốn đã sử dụng Turnitin trong hệ thống quản lý học tập của họ nhận thấy rằng dịch vụ này tự động kích hoạt tính năng phát hiện AI khi công cụ này được ra mắt vào năm 2023.
Thay vì so sánh các đoạn văn bản cụ thể, những công cụ phát hiện AI như GPTZero, Pangram và công cụ do Turnitin phát triển lại dựa vào các mô hình AI của chính chúng để phán đoán xem liệu văn bản đó có phải do con người viết hay không — một quy trình được cho là còn mơ hồ hơn nhiều so với việc đối chiếu văn bản trên web. Theo GPTZero, các công cụ phát hiện AI sử dụng thuật toán để phân tích cách dùng từ, nhịp điệu và cấu trúc của văn bản, cũng như nhận diện các đặc điểm về độ dài và giọng điệu thường thấy trong văn bản do AI viết.
Việc đánh giá mang tính chủ quan này không có cơ sở vững chắc như phương pháp đối chiếu văn bản trực tuyến và có thể đưa ra kết quả sai lệch đối với những người viết sử dụng tiếng Anh như ngôn ngữ thứ hai. Mặc dù vậy, Turnitin cho biết công cụ phát hiện AI của họ chỉ gắn nhãn sai chưa đến 1% nội dung do con người viết là AI, trong khi Pangram tuyên bố tỷ lệ báo cáo sai của họ chỉ là 1/10.000. GPTZero cũng khẳng định họ có tỷ lệ nhầm lẫn nội dung của con người với AI thấp tương tự.

Cư dân mạng đã bắt đầu cáo buộc lẫn nhau là "có giọng văn giống AI", nhưng sự phổ biến của các công cụ phát hiện AI càng làm gia tăng làn sóng phát hiện hành vi thiếu trung thực nhắm vào các mô hình ngôn ngữ lớn (LLM). Trong một số vụ việc gây chú ý, những cáo buộc sử dụng AI để viết bài đã ảnh hưởng trực tiếp đến sinh kế và danh tiếng của nhiều người. Tháng trước, nhà xuất bản Minotaur đã hủy bỏ hợp đồng sách trị giá 2 triệu USD do lo ngại tác giả Jerry Falade sử dụng AI nhưng ông kiên quyết phủ nhận.
Một nghiên cứu năm 2023 của Đại học Stanford cho thấy các công cụ phát hiện AI thường xuyên nhận diện sai các bài luận do người không nói tiếng Anh bản ngữ viết là sản phẩm của AI, với tỷ lệ cao hơn so với bài viết của người bản ngữ. Theo Đại học California, Los Angeles, các công cụ phát hiện AI được huấn luyện để nhận diện những khuôn mẫu có thể cho thấy sự hiện diện của AI, chẳng hạn như việc lặp lại các từ và cụm từ, văn phong quá trang trọng hoặc quá suồng sã, và các cách diễn đạt vô nghĩa.
Một số công cụ, như QuillBot, còn đo lường "tính khó dự đoán" của văn bản vì "AI có xu hướng lựa chọn ngôn ngữ 'rõ ràng' hoặc phổ biến nhất so với văn bản do con người tạo ra". Chúng cũng có thể tìm kiếm cấu trúc câu không thay đổi xuyên suốt văn bản như một dấu hiệu khác của AI. Tuy nhiên, bản thân các chỉ số này không khẳng định chắc chắn đó là sản phẩm của AI, vì một số người có thể sở hữu phong cách viết mang những đặc điểm tương tự.
Sự thiếu tin cậy vào các công cụ phát hiện AI đã khiến một số cơ sở giáo dục quyết định ngừng hoàn toàn việc sử dụng chúng. Các trường đại học như Yale, Johns Hopkins, Vanderbilt, Georgetown và nhiều trường khác đã vô hiệu hóa hoặc hạn chế sử dụng những công cụ phát hiện AI. Viện Công nghệ Massachusetts (MIT) cũng đưa ra cảnh báo "các công cụ phát hiện AI không thực sự hiệu quả".

Thay vì dựa vào các công cụ để sàng lọc nội dung do AI tạo ra, nhiều trường học đang khuyến khích những nhà giáo dục xem xét lại phương pháp giảng dạy. Ví dụ, Đại học Chicago gợi ý giáo viên nên yêu cầu sinh viên đọc chậm lại, chia nhỏ các bài tập viết dài và yêu cầu sinh viên tự suy ngẫm về bài làm của mình. Đại học Stanford cho biết các giảng viên có thể cân nhắc tổ chức kiểm tra, đánh giá ngay tại lớp học, trong khi MIT khuyên giảng viên nên tạo điều kiện để sinh viên tự nguyện khai báo nếu có sử dụng AI hỗ trợ làm bài tập mà không bị phạt.
Khi AI ngày càng trở nên phổ biến cả trong và ngoài lớp học, các nỗ lực nhằm phân biệt đâu là nội dung do con người viết và đâu là do máy móc tạo ra cũng đang gia tăng mạnh mẽ. Một số nền tảng trực tuyến thậm chí còn làm trầm trọng thêm sự nghi ngờ về việc sử dụng AI. Substack đã tích hợp công cụ Pangram vào ứng dụng của mình, cho phép người dùng quét các bài blog để tìm kiếm nội dung nghi do AI tạo ra, trong khi LinkedIn bổ sung nút "có vẻ là nội dung rác do AI tạo ra" vào những bài đăng. Kết quả là một kỷ nguyên mới của sự thiếu tin tưởng đã hình thành: độc giả liên tục đặt câu hỏi liệu nội dung họ đang đọc có phải do AI viết hay không, còn những người viết thực thụ thì cố gắng hết sức để văn phong của mình không bị nhầm lẫn với sản phẩm của AI.
Tin cùng chuyên mục
Thái Lan đặt mục tiêu 3 triệu hộ chiếu AI
Đưa công nghệ mới vào đào tạo nghề, đảm bảo đáp ứng nhu cầu thị trường lao động
Chi phí điện năng khi sử dụng pin lưu trữ năng lượng sẽ ngày càng giảm
Pin lưu trữ năng lượng Mặt Trời là thiết bị tích trữ phần điện năng dư thừa mà hệ thống tấm pin quang điện tạo ra vào ban ngày, sau đó giải phóng lại để sử dụng vào ban đêm, khi trời nhiều mây hoặc trong trường hợp mất điện lưới. Pin lưu trữ năng lượng có thể được coi như một “kho điện dự phòng” giúp các hộ gia đình và doanh nghiệp chủ động về nguồn điện, giảm phụ thuộc hoàn toàn vào điện lưới.
Ngành xuất bản tìm cách xác thực "sách do con người sáng tác" trước làn sóng AI
Làn sóng nghi vấn sử dụng trí tuệ nhân tạo (AI) trong sáng tác đang thúc đẩy ngành xuất bản quốc tế tìm cách xác thực sách do con người viết nhằm bảo vệ uy tín tác giả và củng cố niềm tin độc giả. Tuy nhiên, khi ranh giới giữa hỗ trợ sáng tác và tạo nội dung bằng AI ngày càng khó phân định, những nhãn chứng nhận này vẫn phải đối mặt với bài toán về tính minh bạch và khả năng kiểm chứng.
Mexico phá đường dây dùng AI giả giọng của nhiều nhân vật quan trọng
Cuộc cách mạng mang tên AI của các ứng dụng giao đồ ăn
Đầu tư chuyển đổi số phải tạo ra kết quả thực chất
Từng bước xây dựng Bắc Ninh trở thành “thành phố điều hành bằng dữ liệu”
Từ dữ liệu đến ứng dụng - Hải Phòng tìm lời giải cho AI
Hải Phòng đang từng bước hoàn thiện hạ tầng dữ liệu, nền tảng tích hợp và các điều kiện cần thiết để đưa trí tuệ nhân tạo vào quản lý, điều hành và sản xuất, kinh doanh. Trong đó, chất lượng, khả năng kết nối và khai thác dữ liệu được xác định là yếu tố quan trọng để các ứng dụng AI phát huy hiệu quả.