Huấn luyện mô hình AI: Khi quy định chưa theo kịp thực tế

Có lẽ chúng ta đã biết rằng các mô hình trí tuệ nhân tạo (AI) ChatGPT, Gemini, Claude và những chatbot khác được huấn luyện dựa trên các kho dữ liệu khổng lồ (gần như vô tận) gồm các tác phẩm đã xuất bản - bao gồm hàng trăm triệu cuốn sách, bài viết trực tuyến, tài liệu học thuật và về cơ bản là bất cứ thứ gì chúng ta có thể tìm thấy trên mạng Internet.

Anh Quân
24/08/2026
09:44
Media
ChatGPT ngày càng trở nên phổ biến. (Ảnh: AFP/TTXVN)

Hầu hết các tác giả đã vô tình hoặc không hề hay biết đóng góp vào việc phát triển chính những công cụ AI đang đe dọa đến sinh kế của họ. Bà Cathy Gellis, một luật sư chuyên về sở hữu trí tuệ, bản quyền và công nghệ, cho rằng một trong những vấn đề của toàn bộ lĩnh vực pháp lý và công nghệ này là có quá nhiều diễn biến phức tạp đang diễn ra. 

Năm 2025, trong một trong những phán quyết đầu tiên thuộc loại này, Thẩm phán William Alsup đã yêu cầu công ty công nghệ Anthropic phải trả khoản tiền dàn xếp bản quyền khổng lồ lên tới 1,5 tỷ USD cho một nhóm các nhà văn có tác phẩm được sử dụng để huấn luyện các mô hình AI của doanh nghiệp này. Thoạt nhìn, đây có vẻ là một chiến thắng cho các tác giả, nhưng thực tế Thẩm phán Alsup lại phán quyết rằng việc huấn luyện AI của Anthropic là hợp pháp. Lý do khiến Anthropic bị phạt là vì họ đã lấy các cuốn sách này từ những "thư viện ngầm" trực tuyến bất hợp pháp.

Thẩm phán Alsup cho biết giống như bất kỳ độc giả nào khao khát trở thành nhà văn, các mô hình ngôn ngữ lớn (LLM) của Anthropic được huấn luyện dựa trên những  tác phẩm không phải để sao chép hay thay thế chúng, mà là để chuyển hướng và tạo ra một thứ gì đó khác biệt khi so sánh cách LLM tiếp nhận hàng nghìn tỷ từ ngữ với việc một nhà văn nghiên cứu văn học.

Bà Gellis cho rằng phán quyết này có lợi hơn cho các công ty AI. Khoản tiền phạt 1,5 tỷ USD chẳng thấm vào đâu đối với một công ty dự kiến đạt doanh thu hàng năm khoảng 200 tỷ USD vào năm 2028.

Theo bà, nhìn chung đây là tin tốt cho hoạt động huấn luyện AI khi thẩm phán Alsup xem xét tình hình và coi việc đó tương đương với việc đọc một tác phẩm có bản quyền thay vì sao chép tác phẩm đó. Luật bản quyền xoay quanh hành vi sao chép, chứ không xoay quanh việc sử dụng, trải nghiệm, tiếp nhận hay đọc tác phẩm. Luật bản quyền chưa được cập nhật kể từ năm 1976, đồng nghĩa với việc các thẩm phán phải tìm cách diễn giải những hướng dẫn từ 50 năm trước khi đối mặt với các vấn đề pháp lý có khả năng định hình tương lai của ngành công nghiệp AI.

Media
Công nhân làm việc tại nhà máy của hãng sản xuất chip Renesas Electronics ở Nhật Bản. (Ảnh: AFP/TTXVN)

Ông Jason Henderson, Luật sư cấp cao kiêm người sáng lập Nhóm thực hành Luật Sở hữu trí tuệ & Truyền thông tại JWL International, cho rằng mọi người đều rất lo lắng vì các quy định pháp luật còn thiếu nhất quán, và nguyên nhân chính là vấn đề này. Họ biết rằng các mô hình AI được huấn luyện dựa trên khối lượng dữ liệu khổng lồ, trong khi luật pháp vẫn chưa thực sự bắt kịp thực tế đó.

Những vấn đề này thường xoay quanh học thuyết "sử dụng hợp lý" - cụ thể là liệu việc sử dụng một tác phẩm có bản quyền có mang tính "chuyển đổi" (tạo ra giá trị mới khác biệt) đủ để được coi là hợp pháp hay không.

"Sử dụng hợp lý" là một ngoại lệ trong luật bản quyền, cho phép sử dụng các tài liệu có bản quyền mà không cần sự cho phép rõ ràng, nhằm bảo vệ quyền bình luận và phát triển tiếp các tác phẩm thông qua các hình thức như phê bình, nhại lại, giáo dục và các phương thức khác. Các thẩm phán sẽ xem xét những yếu tố cụ thể khi quyết định liệu một hành động có thuộc phạm vi "sử dụng hợp lý" hay không, bao gồm mục đích và bản chất của tác phẩm, khối lượng nội dung được sử dụng và tác động của nó đối với thị trường.

Theo ông Henderson, bản chất của luật bản quyền luôn là bảo vệ và phát triển thị trường. Lập luận của tòa án (trong các vụ kiện liên quan đến AI) hiện vẫn còn thiếu thống nhất. Tuy nhiên, xu hướng phán quyết thường nghiêng về hướng này: nếu các doanh nghiệp huấn luyện mô hình AI dựa trên tài sản của người khác với mục đích cạnh tranh trực tiếp, tòa án sẽ không ủng hộ hành động đó... Ngược lại, nếu hoạt động của họ không nhằm mục đích cạnh tranh, tòa án thường sẽ tìm cách công nhận tính hợp lệ của nó.

Ông Henderson đang đề cập đến vụ kiện mà công ty truyền thông và công nghệ Thomson Reuters đã khởi kiện công ty nghiên cứu Ross Intelligence vì hành vi sao chép nội dung của họ nhằm xây dựng một nền tảng pháp lý cạnh tranh dựa trên AI. Trong phán quyết năm 2025, thẩm phán Stephanos Bibas cho rằng việc sử dụng của Ross không mang tính chuyển đổi vì nó không có 'mục đích xa hơn hoặc tính chất khác biệt' so với mục đích của Thomson Reuters. 

Media
AI đang trở thành một phần tất yếu của cuộc sống. (Ảnh: TTXVN)

Trong vụ kiện đó, Thẩm phán Bibas kết luận rằng việc huấn luyện mô hình AI dựa trên nội dung của Reuters để tạo ra một nền tảng mới cạnh tranh trực tiếp với chính Reuters không được coi là "sử dụng hợp lý". Mặc dù các tác giả có thể lập luận rằng các chatbot đang cạnh tranh với họ bằng cách sử dụng tác phẩm của họ để tạo ra những cuốn sách tổng hợp mới, nhưng lập luận này vẫn chưa được tòa án chấp nhận. Khi bàn về mối quan hệ giữa AI và bản quyền, bà Gellis cho rằng việc thu hẹp phạm vi thảo luận là rất hữu ích – bởi lẽ, quan điểm về bản quyền trong quá trình huấn luyện AI khác biệt hoàn toàn so với quan điểm về bản quyền đối với nội dung do AI tạo ra.

Trong vụ Thaler kiện Perlmutter, tòa án đã ra phán quyết rằng nếu một tác phẩm được tạo ra 100% bằng AI thì nó không có bản quyền, điều này mở ra một loạt vấn đề mới – làm cách nào chúng ta có thể chứng minh chắc chắn liệu một tác phẩm có được tạo ra bằng AI hay không, và nếu vậy, làm sao chúng ta biết được bao nhiêu phần trăm trong số đó được tạo ra hoặc được hỗ trợ bởi AI?

Hầu hết các công ty AI vẫn đang phải tìm lời giải cho vấn đề trên và câu trả lời sẽ không thể có trong một sớm một chiều./. 

Tin cùng chuyên mục

Thái Lan đặt mục tiêu 3 triệu hộ chiếu AI

Thái Lan đặt mục tiêu 3 triệu hộ chiếu AI

Bộ Kinh tế và Xã hội số Thái Lan (DES) đặt mục tiêu tăng số lượng người đăng ký chương trình Hộ chiếu Trí tuệ nhân tạo quốc gia (TH-AI Passport) lên 3 triệu người vào cuối năm nay, gấp đôi so với mốc 1,57 triệu người đăng ký hiện tại.

Chi phí điện năng khi sử dụng pin lưu trữ năng lượng sẽ ngày càng giảm

Pin lưu trữ năng lượng có thể được coi như một “kho điện dự phòng” giúp các hộ gia đình và doanh nghiệp chủ động về nguồn điện, giảm phụ thuộc hoàn toàn vào điện lưới.

Pin lưu trữ năng lượng Mặt Trời là thiết bị tích trữ phần điện năng dư thừa mà hệ thống tấm pin quang điện tạo ra vào ban ngày, sau đó giải phóng lại để sử dụng vào ban đêm, khi trời nhiều mây hoặc trong trường hợp mất điện lưới. Pin lưu trữ năng lượng có thể được coi như một “kho điện dự phòng” giúp các hộ gia đình và doanh nghiệp chủ động về nguồn điện, giảm phụ thuộc hoàn toàn vào điện lưới.

Cuộc cách mạng mang tên AI của các ứng dụng giao đồ ăn

Các ứng dụng giao đồ ăn như DoorDash và Uber Eats đang đứng trước cuộc chuyển mình mang tính bước ngoặt.

Các ứng dụng giao đồ ăn như DoorDash và Uber Eats đã thay đổi thói quen ăn uống của thực khách cũng như cách thức vận hành của các nhà hàng. Tuy vậy, trí tuệ nhân tạo (AI) có thể buộc ngành này phải đối mặt với một cuộc chuyển mình mang tính bước ngoặt.

Đầu tư chuyển đổi số phải tạo ra kết quả thực chất

Đầu tư chuyển đổi số phải tạo ra kết quả thực chất

Sáng 9/10, tại Trung tâm Triển lãm Việt Nam (VEC, Hà Nội), Bộ Khoa học và Công nghệ (KH&CN) đã tổ chức chương trình Chào mừng Ngày Chuyển đổi số quốc gia năm 2026 với chủ đề “Từ kiến trúc, nền tảng, dữ liệu đến kết quả thực chất, nâng cao hiệu quả quản trị quốc gia”.

Nguy cơ AI xâm phạm bản quyền âm nhạc trên toàn thế giới

Nguy cơ AI xâm phạm bản quyền âm nhạc trên toàn thế giới

Ngành công nghiệp âm nhạc Australia cảnh báo việc nới lỏng các quy định bảo vệ bản quyền có thể cho phép các công ty công nghệ như OpenAI và Anthropic sử dụng tác phẩm có bản quyền để huấn luyện trí tuệ nhân tạo (AI) mà không cần xin phép, đe dọa quyền lợi của các nhạc sĩ, nhà văn và những người sáng tạo trên toàn thế giới.

OpenAI dự báo doanh thu thấp hơn gần 30% so với kỳ vọng

OpenAI dự báo doanh thu thấp hơn gần 30% so với kỳ vọng

Ngày 8/10, truyền thông quốc tế đưa tin doanh thu quy đổi theo năm của OpenAI thấp hơn khoảng 20 tỷ USD so với mức mà các nhà đầu tư kỳ vọng, làm dấy lên những nghi ngại về sự vững chắc của hoạt động kinh doanh trong lĩnh vực trí tuệ nhân tạo (AI).

Mỹ chi hàng tỷ USD để mở khoá “thời đại hoàng kim” của khoa học

Mỹ chi hàng tỷ USD để mở khoá “thời đại hoàng kim” của khoa học

Ngày 8/10, chính quyền Tổng thống Mỹ Donald Trump đã công bố loạt chương trình đầu tư và hợp tác khoa học trị giá hơn 6 tỷ USD với sự tham gia của chính phủ liên bang, các công ty công nghệ, trường đại học và tổ chức từ thiện, nhằm thúc đẩy nghiên cứu và đổi mới sáng tạo.