Tính năng AI tạo sinh mới nhất của Google Earth hứa hẹn mang đến một cách thức mới mẻ để quan sát các di tích lịch sử và sự phát triển của đô thị. Đồng thời, nó cũng mở ra một chiếc hộp Pandora về thông tin sai lệch kỹ thuật số. Bằng cách cho phép người dùng định hình lại hình ảnh vệ tinh và hình ảnh 3D bằng các câu lệnh văn bản, nền tảng này giúp việc tạo ra các nội dung "bóp méo thực tế" trở nên dễ dàng.

Sức mạnh và Hiểm họa của Nano Banana 2

Google đã triển khai tính năng này trên toàn thế giới trên phiên bản web của Google Earth, chạy trên mô hình “Nano Banana 2”. Các tài liệu của Google quảng bá đây là một công cụ dành cho các nhà quy hoạch và nhà sử học để hình dung các dự án bất động sản hoặc các tàn tích cổ xưa. Tuy nhiên, trên thực tế, công cụ này tỏ ra biến động hơn nhiều.

Nhà sáng tạo kỹ thuật số Henk van Ess từ Digital Digging đã cho thấy mô hình này có thể tạo ra những hình ảnh cực kỳ nhạy cảm và mang tính kích động như thế nào. Chỉ với vài câu lệnh đơn giản, ông đã tạo ra một cảnh tượng về “người tị nạn gần biên giới Mexico” và một hố bom bên cạnh một bệnh viện ở Gaza. Những hình ảnh này bám sát vào địa lý thực tế, không giống như những lỗi "ảo giác" (hallucinations) rõ rệt như tượng Nhân sư kết hợp với Tượng Nữ thần Tự do, và do đó gây ra rủi ro lớn hơn trong việc lan truyền những thông tin sai lệch về địa chính trị.

Cuộc chiến về Đóng dấu chìm kỹ thuật số

Google đã đáp trả bằng cách tăng cường các biện pháp bảo vệ kỹ thuật. Mọi hình ảnh Nano Banana hiện đều mang một dấu chìm kỹ thuật số SynthID. Google hướng dẫn người dùng quét các hình ảnh nghi vấn bằng ứng dụng Gemini hoặc Google Lens để gắn cờ nội dung do AI tạo ra, thậm chí có thể thêm thẻ “@verifyai” trong Gemini để được hỗ trợ.

Nhưng các biện pháp bảo vệ này vẫn chưa thực sự hoàn hảo. Van Ess đã đánh lừa được trình phát hiện AI của Hive bằng một video đã được AI chỉnh sửa lấy nguồn từ Google Earth, cho thấy chỉ riêng dấu chìm là không đủ để ngăn chặn những kẻ có ý đồ xấu. Sự việc này nhấn mạnh một cuộc chạy đua vũ trang đang leo thang giữa các mô hình tạo sinh và các trình phát hiện được dùng để kiểm soát chúng.

Tại sao điều này lại quan trọng đối với Hệ sinh thái AI

Tranh cãi về Google Earth làm nổi bật một "khoảng cách thực tế" đang cận kề đối với ngành công nghiệp AI. Khi các mô hình chuyển dịch từ việc tạo ra nghệ thuật cách điệu sang thao túng dữ liệu "thực tế khách quan" (ground truth) — ví dụ như hình ảnh vệ tinh — mức độ rủi ro đã nhảy vọt từ thẩm mỹ sang sự tồn vong.

Các nhà phát triển và lãnh đạo công nghệ nên coi đây là một lời cảnh báo. Khi AI vận hành các công cụ mà mọi người tin tưởng để tìm kiếm sự thật khách quan, một dấu chìm kỹ thuật số chỉ cung cấp một lớp phòng thủ duy nhất. Van Ess và các chuyên gia khác lập luận rằng phương thuốc đáng tin cậy duy nhất là xác minh chéo giữa các nền tảng: so sánh kết quả đầu ra của Google Earth với các nguồn vệ tinh đáng tin cậy như Sentinel-2 hoặc Landsat. Khi AI tạo sinh ngày càng thâm nhập sâu hơn vào bản đồ và điều hướng, việc phân biệt giữa một hình ảnh dựng tổng hợp và một hình ảnh chụp thực tế sẽ trở thành một kỹ năng cốt lõi của năng lực số (digital literacy).

Những điểm chính cần lưu ý

  • Thông tin sai lệch với rủi ro cao: Nano Banana 2 có thể tạo ra những hình ảnh cực kỳ chân thực và nhạy cảm, làm thay đổi nhận thức của công chúng về các xung đột địa chính trị.
  • Hạn chế của việc đóng dấu chìm: Dấu chìm SynthID của Google có hỗ trợ, nhưng các bản demo cho thấy các trình phát hiện AI vẫn có thể bị vượt qua, vì vậy các biện pháp bảo vệ kỹ thuật vẫn chưa đủ.
  • Nhu cầu xác minh đa nguồn: Người dùng phải kiểm tra chéo hình ảnh vệ tinh với dữ liệu quỹ đạo thứ cấp từ các nền tảng như Sentinel-2 hoặc Landsat để xác nhận tính xác thực.

Kết luận

Nano Banana 2 của Google cung cấp cho những người dùng hợp pháp các công cụ trực quan hóa mạnh mẽ, nhưng nó cũng trao cho bất kỳ ai một cây cọ để vẽ nên những câu chuyện địa chính trị sai lệch trên một bức tranh quy mô toàn hành tinh. Một dấu chìm vô hình chỉ gợi ý về nguồn gốc tổng hợp; nó không đảm bảo điều đó. Cho đến khi khả năng phát hiện được cải thiện và việc kiểm tra đa nguồn trở thành thói quen, người xem phải đặt dấu hỏi trước bất kỳ hình ảnh vệ tinh gây sốc nào xuất hiện bất ngờ.