Khi các website từ chối “nuôi” AI của Google
Trong nhiều năm, Google thống trị không gian mạng nhờ một thỏa thuận ngầm hiểu: Các trang web cho phép Google thu thập dữ liệu, đổi lại hãng sẽ dẫn dắt người dùng thực truy cập vào các trang này. Tuy nhiên, thỏa thuận này đang dần rạn nứt.
Suốt hai thập kỷ qua, quan hệ giữa Google và những người làm nội dung trên Internet vận hành theo một nguyên tắc đơn giản. Các trang web cho phép công cụ thu thập dữ liệu của Google quét toàn bộ trang của mình. Đổi lại, Google đưa người đọc quay trở lại đúng những trang đó thông qua kết quả tìm kiếm.
Đây là một trao đổi có lợi cho cả hai bên: Google có kho dữ liệu khổng lồ, còn chủ trang web có lượng truy cập để bán quảng cáo hoặc bán hàng.
Nhưng với sự phát triển của Trí tuệ nhân tạo (AI), thỏa thuận này đã thay đổi bản chất khi cùng một công cụ thu thập dữ liệu hiện phục vụ hai mục đích: vừa lập chỉ mục cho công cụ tìm kiếm, vừa cung cấp nguyên liệu cho Gemini - mô hình AI chủ lực của Google.
Điều đó đồng nghĩa nội dung do con người viết ra có thể được dùng để tạo ra các câu trả lời tự động, trong khi người đọc không còn lý do phải nhấp chuột vào trang gốc.
Ông Matthew Prince, Giám đốc điều hành công ty an ninh mạng Cloudflare cho biết phạm vi quét dữ liệu của Google rộng gấp 3,2 lần so với công cụ của OpenAI và gấp 4,8 lần so với của Microsoft.
Theo ông, việc gộp chung hai chức năng khiến các đơn vị xuất bản nội dung rơi vào thế tiến thoái lưỡng nan: nếu họ muốn ngăn nội dung của mình bị dùng để huấn luyện AI thì buộc phải chấp nhận biến mất khỏi kết quả tìm kiếm, nhưng đó là nguồn sống của phần lớn website hiện nay.
*Khi máy móc đông hơn người
Hệ quả của xu hướng này không dừng lại ở câu chuyện của riêng ngành báo chí. Nếu AI ngày càng đọc, tóm tắt và viết lại nội dung mà không dẫn người đọc trở lại trang gốc, nguồn lợi kinh tế cho việc tạo ra thông tin nguyên bản sẽ dần biến mất. Khi đó, Internet có nguy cơ trở nên nghèo nàn và kém hữu ích hơn, bởi những nội dung mới chủ yếu được tạo ra từ máy móc sao chép và cô đọng lại.
Số liệu của Cloudflare cho thấy trong năm 2026, các tác nhân AI (những chương trình tự động thực hiện tác vụ thay người dùng) đã tạo ra hơn 57% lưu lượng truy cập Internet, so với khoảng 42% đến từ con người. Đây là lần đầu tiên hoạt động của máy móc vượt qua con người trên không gian mạng. Ông Prince dự báo khoảng cách này sẽ còn nới rộng trong vài năm tới.
Hiện các tác nhân AI vẫn chủ yếu nằm trong tay giới lập trình và doanh nghiệp. Tuy nhiên, Meta mới đây thông báo sẽ sớm đưa công cụ này tới người dùng phổ thông trên Facebook Messenger, WhatsApp và Instagram, với định hướng đủ đơn giản để hàng tỷ người có thể sử dụng ngay.
*Sức ép buộc Google điều chỉnh

Theo một tài liệu nội bộ được công bố trong một vụ kiện chống độc quyền tại Mỹ, Google từng cân nhắc phương án cho phép các trang web từ chối cung cấp dữ liệu cho AI mà vẫn giữ nguyên vị trí trong kết quả tìm kiếm hồi tháng 4/2024, ngay trước khi ra mắt tính năng tóm tắt bằng AI. Phương án này sau đó bị gác lại với lý do lĩnh vực này đang chuyển thành một không gian thương mại hóa.
Áp lực hiện đến từ cả thị trường lẫn cơ quan quản lý. Cloudflare tuyên bố từ ngày 15/9 sẽ mặc định chặn các công cụ thu thập dữ liệu đa mục đích đối với nhóm khách hàng có doanh thu quảng cáo, đồng nghĩa Google có thể mất quyền truy cập vào hàng triệu trang web.
Về phía nhà quản lý, hồi tháng 6, Cơ quan Cạnh tranh và Thị trường Anh (CMA) đã yêu cầu Google trao cho chủ sở hữu trang web quyền lựa chọn rõ ràng trong việc ngăn nội dung bị sử dụng cho các sản phẩm AI, đồng thời không được hạ thứ hạng tìm kiếm của những trang này như một biện pháp đáp trả.
Đại diện Google xác nhận hãng đang thử nghiệm tùy chọn nói trên và dự kiến áp dụng trên phạm vi toàn cầu sau khi hoàn tất giai đoạn thử nghiệm tại Anh.
Dù vậy, giới chuyên gia cho rằng việc nới lỏng chính sách vẫn chưa đủ. Thay vì phải đặt niềm tin vào lời hứa của Google, giải pháp triệt để nhất là buộc hãng này phải tách bạch hoàn toàn công cụ thu thập dữ liệu thành hai hệ thống riêng biệt - một cho tìm kiếm, một cho AI - để các trang web tự quyết định. Khi đó, các website có thể chủ động đóng cửa với AI ngay từ đầu mà không sợ ảnh hưởng đến thứ hạng tìm kiếm.
Với 90% thị phần tìm kiếm trực tuyến trong tay, Google vẫn là cánh cửa chính dẫn vào thế giới Internet. Cách tập đoàn này xử lý dữ liệu trực tuyến ra sao sẽ quyết định phần lớn tương lai của kinh tế nội dung số trong kỷ nguyên công nghệ mới./.
Tin cùng chuyên mục
Các nền kinh tế đang phát triển đối mặt nguy cơ tụt hậu về AI nghiêm trọng nhất
Ngày 25/8, phát biểu mở đầu tại một cuộc tọa đàm diễn ra tại Washington D.C, Mỹ, Tổng Giám đốc Quỹ Tiền tệ Quốc tế (IMF) Kristalina Georgieva nhận định tác động trong tương lai của trí tuệ nhân tạo (AI) vẫn bị phủ bóng bởi những yếu tố chưa thể biết, và các nền kinh tế đang phát triển có nguy cơ tụt hậu về AI nghiêm trọng nhất.
Người Trẻ Dùng Tri Thức Số Kết Nối Các Thế Hệ
Trong dòng chảy chuyển đổi số, những người trẻ có lợi thế về công nghệ, kiến thức và khả năng thích ứng nhanh, thì việc chia sẻ những lợi thế đó với cộng đồng cũng là một cách để tuổi trẻ thể hiện trách nhiệm xã hội. Tại Hà Nội, những giảng viên trẻ đang làm điều đó bằng những lớp học đặc biệt – nơi công nghệ trở thành cầu nối giữa các thế hệ.
Giới trẻ Mỹ từ hào hứng đến dè chừng về Trí tuệ nhân tạo
OpenAI bị điều tra tại Mỹ sau vụ AI “tự ý” tấn công mạng
Ấn Độ: AI đang tạo việc làm thay vì lấy đi việc làm
AI thay thế các chuyên gia ngân hàng - xu hướng tạm thời hay dài hạn?
Ông Chris Churchman, người đứng đầu nền tảng kỹ thuật số dành cho khách hàng tổ chức có tên Marquee của ngân hàng Goldman Sachs, vừa cảnh báo việc sử dụng trí tuệ nhân tạo (AI) ngày càng nhiều trên thị trường tài chính Phố Wall có nguy cơ làm suy giảm năng lực tư duy của thế hệ chuyên gia tài chính kế cận.
Cơn sốt AI đưa thị trấn nhỏ của Áo lên bản đồ công nghệ
Huấn luyện mô hình AI: Khi quy định chưa theo kịp thực tế
Có lẽ chúng ta đã biết rằng các mô hình trí tuệ nhân tạo (AI) ChatGPT, Gemini, Claude và những chatbot khác được huấn luyện dựa trên các kho dữ liệu khổng lồ (gần như vô tận) gồm các tác phẩm đã xuất bản - bao gồm hàng trăm triệu cuốn sách, bài viết trực tuyến, tài liệu học thuật và về cơ bản là bất cứ thứ gì chúng ta có thể tìm thấy trên mạng Internet.
Nền tảng số góp phần kết nối “hành trình trở về" của các liệt sĩ
Hành trình đưa các Anh hùng liệt sĩ trở về quê hương đang được tiếp nối bằng sức mạnh công nghệ số. Mỗi dữ liệu được khớp nối, mỗi dấu tích được xác định là nỗ lực tận cùng của lòng thành kính và đạo lý "Uống nước nhớ nguồn". Công nghệ đã trở thành nhịp cầu thiêng liêng kết nối quá khứ với hiện tại, đưa các Anh hùng liệt sĩ trở về trong vòng tay ấm áp của đất mẹ.