AI & Content

Watermark cho hình ảnh do AI tạo ra thực sự làm được gì

Watermark có thể hỗ trợ truy xuất nguồn gốc, thực thi chính sách và công bố thông tin. Chúng không thể khiến nội dung tổng hợp trở nên đáng tin một cách kỳ diệu.

The Wux Webtools Team The Wux Webtools Team 23 phút đọc Hỗ trợ AI, được con người xem xét
Illustration of an image file being inspected for watermark and provenance signals
Mục lục
  1. Lời hứa nghe đơn giản hơn thực tế
  2. Trước hết, hãy xác định loại watermark
  3. Watermark hiển thị
  4. Watermark vô hình
  5. Metadata và hồ sơ truy xuất nguồn gốc
  6. Watermark thực sự làm được gì
  7. 1. Nó hỗ trợ công bố thông tin trung thực
  8. 2. Nó cung cấp cho nền tảng một tín hiệu kiểm duyệt
  9. 3. Nó giúp bảo toàn chuỗi lưu giữ
  10. 4. Nó làm tăng chi phí đánh lừa
  11. Những gì nó không làm được
  12. Nó không chứng minh một hình ảnh là đúng sự thật
  13. Nó không giải quyết quyền ghi công hoặc bản quyền
  14. Nó không sống sót qua mọi biến đổi
  15. Nó không hoạt động nếu không được áp dụng
  16. Một chính sách thực tế cho các nhóm dùng hình ảnh AI
  17. Phát hiện nên mang tính xác suất, không phải đạo đức hóa
  18. Trường hợp sử dụng tốt nhất: quy trình đáng tin cậy, không phải kiểm soát hoàn hảo
  19. Kết luận

Lời hứa nghe đơn giản hơn thực tế

Watermark cho hình ảnh AI thường được trình bày như một cách khắc phục thực tế cho nội dung tổng hợp: đánh dấu hình ảnh được tạo ra, phát hiện dấu đó về sau, rồi giúp người xem tự tin hơn về điều họ đang nhìn thấy.

Điều đó đúng một phần. Watermark có thể giúp các nền tảng gắn nhãn hình ảnh do AI tạo ra, giúp nhà xuất bản ghi lại quy trình làm việc, và giúp điều tra viên phân biệt giữa một số tài sản do con người tạo ra và do máy tạo ra. Đây là một lớp hữu ích.

Nhưng nó không phải là cỗ máy sự thật phổ quát. Watermark có thể bị xóa, bị bỏ sót, bị giả mạo, bị suy giảm, bị loại khỏi metadata, hoặc trở nên vô nghĩa chỉ vì một ảnh chụp màn hình. Ngay cả khi hoạt động, nó thường chỉ trả lời một câu hỏi hẹp: tệp này, hoặc thứ gì đó giống nó, đã đi qua một hệ thống áp dụng dấu này chưa?

Điều đó khác với việc trả lời những câu hỏi mà hầu hết mọi người thực sự quan tâm: Hình ảnh này có thật không? Ai tạo ra nó? Nó đã bị chỉnh sửa chưa? Nó có gây hiểu lầm không? Tôi có quyền sử dụng nó không?

Watermark chỉ giúp trả lời những câu hỏi đó khi nó là một phần của hệ thống truy xuất nguồn gốc và công bố thông tin rộng hơn.

Trước hết, hãy xác định loại watermark

Mọi người dùng từ watermark để chỉ nhiều thứ khác nhau.

Watermark hiển thị

Đây là những dấu rõ ràng được đặt lên trên hình ảnh: logo, nhãn, họa tiết chéo, hoặc chú thích nói rằng hình ảnh được tạo bởi AI.

Watermark hiển thị dễ để con người hiểu. Chúng cũng dễ bị cắt bỏ, che phủ, làm mờ, hoặc xóa bằng công cụ chỉnh sửa ảnh. Giá trị chính của chúng là công bố thông tin tại thời điểm xuất bản, chứ không phải độ tin cậy pháp chứng.

Chúng hoạt động tốt nhất khi nhà xuất bản muốn trung thực. Chúng hoạt động kém khi nhà xuất bản muốn đánh lừa.

Watermark vô hình

Watermark vô hình là các tín hiệu được nhúng vào pixel của hình ảnh. Một công cụ phát hiện sau đó có thể kiểm tra xem tín hiệu có hiện diện hay không.

Đây là mô hình được các hệ thống như SynthID và các cách tiếp cận watermark ở cấp trình tạo khác sử dụng. Sức hấp dẫn rất rõ: hình ảnh có thể trông bình thường, trong khi vẫn mang một tín hiệu máy có thể phát hiện.

Sự đánh đổi là tính mong manh. Một số watermark vô hình sống sót qua nén, thay đổi kích thước, điều chỉnh màu, hoặc cắt xén nhẹ. Một số khác thì không. Dấu mạnh hơn có thể bền hơn, nhưng có thể ảnh hưởng đến chất lượng hoặc dễ bị tấn công đối kháng. Chi tiết có ý nghĩa rất lớn, và công chúng hiếm khi nhìn thấy đủ chi tiết để tự đánh giá độc lập.

Metadata và hồ sơ truy xuất nguồn gốc

Cách tiếp cận thứ ba không phải là watermark theo nghĩa ở cấp pixel. Nó gắn thông tin vào tệp: ai tạo ra tệp, công cụ nào được sử dụng, những chỉnh sửa nào đã được thực hiện, và thông tin xác thực có được một bên đáng tin cậy ký hay không.

Đây là nơi C2PA, Coalition for Content Provenance and Authenticity, xuất hiện. C2PA nhằm chuẩn hóa thông tin xác thực nội dung để hình ảnh và các phương tiện khác có thể mang dữ liệu truy xuất nguồn gốc đã ký qua các công cụ và nền tảng.

Cách tiếp cận này giàu biểu đạt hơn watermark. Nó có thể nói nhiều hơn là AI hay không phải AI. Nó có thể mô tả chỉnh sửa, nguồn, và chuỗi lưu giữ. Nhưng nó phụ thuộc vào hỗ trợ phần mềm, niềm tin vào các bên ký, và việc metadata vẫn được gắn kèm. Bất kỳ ai từng xử lý tải ảnh lên đều biết metadata thường bị tự động loại bỏ. Cùng bản năng bảo vệ quyền riêng tư đứng sau việc xóa metadata EXIF trước khi chia sẻ ảnh cũng làm các hệ thống truy xuất nguồn gốc trở nên phức tạp hơn.

Watermark thực sự làm được gì

Watermark hữu ích khi bạn yêu cầu nó làm đúng việc.

1. Nó hỗ trợ công bố thông tin trung thực

Đối với các nhóm xuất bản hình ảnh có hỗ trợ của AI, watermark có thể giúp việc công bố thông tin nhất quán hơn. Một tòa soạn, sàn giao dịch, trường học, hoặc nhóm thiết kế có thể yêu cầu hình ảnh được tạo ra phải mang nhãn hiển thị, dấu vô hình, thông tin xác thực đã ký, hoặc một sự kết hợp nào đó.

Điều đó không ngăn tác nhân xấu xóa dấu. Nhưng nó giảm sự mơ hồ bên trong các tổ chức muốn hành xử có trách nhiệm.

Điều này tương tự công bố biên tập đối với văn bản AI. Chuẩn mực hữu ích không phải là cảm giác tội lỗi mang tính trình diễn; mà là sự rõ ràng thực tế. Nếu nhóm của bạn sử dụng tài sản tổng hợp, một chính sách ngắn giải thích khi nào và cách bạn công bố chúng sẽ hữu ích hơn những lo lắng mơ hồ. Nguyên tắc tương tự áp dụng cho công bố AI trung thực trên một website nhỏ: hãy nói cho người dùng biết điều gì ảnh hưởng đáng kể đến cách họ hiểu.

2. Nó cung cấp cho nền tảng một tín hiệu kiểm duyệt

Các nền tảng cần tín hiệu ở quy mô lớn. Một watermark đáng tin cậy có thể giúp họ chuyển nội dung tải lên để xem xét, áp dụng nhãn, thực thi chính sách quảng cáo, hoặc giới hạn một số cách sử dụng nhất định.

Điều này không đòi hỏi độ chính xác hoàn hảo. Một hệ thống kiểm duyệt có thể dùng phát hiện watermark như một tín hiệu trong nhiều tín hiệu: hành vi tài khoản, lịch sử tải lên, độ tương đồng hình ảnh, báo cáo của người dùng, và ngữ cảnh nội dung.

Nguy hiểm nằm ở việc xem tín hiệu đó là kết luận. Một watermark được phát hiện có thể cho thấy hình ảnh đến từ một trình tạo cụ thể. Việc thiếu watermark không chứng minh hình ảnh là thật.

3. Nó giúp bảo toàn chuỗi lưu giữ

Đối với nhà xuất bản, kho lưu trữ, nhóm pháp lý, và nhà nghiên cứu, truy xuất nguồn gốc có thể thực sự có giá trị. Nếu một tệp mang thông tin xác thực đã ký từ lúc tạo qua chỉnh sửa đến xuất bản, người xem xét sau này có thể hiểu nó đã thay đổi như thế nào.

Điều này ít liên quan đến việc bắt mọi hình ảnh giả trên web mở, và liên quan nhiều hơn đến việc xây dựng quy trình làm việc đáng tin cậy. Một ban ảnh có thể xác minh rằng hình ảnh đến từ một máy ảnh đã biết, đi qua phần mềm chỉnh sửa được phê duyệt, và được xuất bởi một biên tập viên cụ thể. Một nhóm thiết kế có thể theo dõi liệu một minh họa đã được tạo ra, sửa đổi, cấp phép, và phê duyệt hay chưa.

Thông tin xác thực kiểu C2PA mạnh nhất trong những môi trường được kiểm soát này. Chúng yếu hơn khi hình ảnh được sao chép qua các hệ thống không xác định, bị chụp màn hình, hoặc đăng lại nhiều lần.

4. Nó làm tăng chi phí đánh lừa

Watermark không chặn được sự đánh lừa. Nó có thể khiến việc đánh lừa tốn thêm một chút công sức.

Nếu một trình tạo mặc định áp dụng watermark vô hình bền vững, người muốn giả mạo hình ảnh tổng hợp thành ảnh gốc từ máy ảnh có thể cần thêm các bước tẩy rửa: chỉnh sửa, mã hóa lại, chụp màn hình, hoặc dùng mô hình không có dấu. Những bước đó có thể làm giảm chất lượng, để lại dấu vết khác, hoặc tăng ma sát vận hành.

Điều đó không hào nhoáng, nhưng bảo mật thường hoạt động theo cách này. Bạn hiếm khi loại bỏ được lạm dụng. Bạn khiến các kiểu lạm dụng phổ biến chậm hơn, kém tin cậy hơn, và dễ điều tra hơn.

Những gì nó không làm được

Các giới hạn là nơi các nhóm thường gặp rắc rối.

Nó không chứng minh một hình ảnh là đúng sự thật

Một bức ảnh thật vẫn có thể gây hiểu lầm. Một hình ảnh tổng hợp có thể được gắn nhãn rõ ràng mà vẫn truyền đạt điều sai lệch. Watermark cho bạn biết về nguồn gốc hoặc quá trình xử lý, không phải sự thật.

Một hình ảnh AI được gắn nhãn về một chính trị gia đang làm điều hư cấu vẫn có thể là vấn đề thông tin sai lệch. Một bức ảnh thật với chú thích đánh lừa cũng là vấn đề thông tin sai lệch. Truy xuất nguồn gốc giúp ích, nhưng diễn giải vẫn quan trọng.

Nó không giải quyết quyền ghi công hoặc bản quyền

Một watermark ghi rằng được tạo bởi AI không cho bạn biết liệu đầu ra có xâm phạm tác phẩm của người khác hay không, liệu prompt có dùng tên của một nghệ sĩ còn sống hay không, hoặc liệu dữ liệu huấn luyện có được thu thập theo cách có đạo đức hay không.

Đó là những câu hỏi pháp lý và đạo đức riêng biệt. Chúng quan trọng, nhưng không thể được rút gọn thành một watermark nhị phân.

Nếu nhóm của bạn dùng hình ảnh được tạo ra trong công việc hướng tới công chúng, watermark nên đi cùng rà soát giấy phép, ghi chép nguồn, và đánh giá cơ bản về sự cần thiết. Hình ảnh tổng hợp có chi phí vượt ngoài khả năng phát hiện, như đã thảo luận trong chi phí ẩn của hình ảnh do AI tạo ra trên web mở.

Nó không sống sót qua mọi biến đổi

Hình ảnh thường xuyên bị nén, thay đổi kích thước, chuyển mã, chụp màn hình, lọc, và đăng lại. Một số hệ thống được thiết kế để chịu được các biến đổi phổ biến. Không hệ thống nào nên được giả định là sống sót qua mọi biến đổi.

Metadata đặc biệt mong manh. Nhiều nền tảng xã hội, hệ thống quản lý nội dung, ứng dụng nhắn tin, và pipeline tối ưu hóa loại bỏ metadata để giảm kích thước tệp hoặc bảo vệ quyền riêng tư. Watermark ở cấp pixel có thể sống sót qua nhiều biến đổi hơn, nhưng vẫn có thể bị tấn công.

Nó không hoạt động nếu không được áp dụng

Một tiêu chuẩn truy xuất nguồn gốc chỉ hữu ích nếu công cụ tạo, công cụ chỉnh sửa, hệ thống xuất bản, nền tảng, và người xem đều hỗ trợ nó.

Đây là vấn đề triển khai nhàm chán. Nếu một trình tạo đánh dấu đầu ra còn trình tạo khác thì không, phạm vi phát hiện chỉ là một phần. Nếu phần mềm chỉnh sửa làm rơi mất thông tin xác thực, chuỗi sẽ đứt. Nếu trình duyệt và nền tảng không hiển thị thông tin xác thực rõ ràng, người dùng thông thường sẽ không bao giờ thấy chúng.

Watermark không chỉ là một tính năng kỹ thuật. Nó là một thỏa thuận hệ sinh thái.

Một chính sách thực tế cho các nhóm dùng hình ảnh AI

Hầu hết tổ chức không cần trở thành phòng thí nghiệm giám định truyền thông. Họ cần một bộ quy tắc khả thi.

Một chính sách hợp lý trông như sau:

  • Gắn nhãn hình ảnh tổng hợp khi bản chất tổng hợp có thể ảnh hưởng đến cách diễn giải.
  • Lưu giữ tệp nguồn, prompt, giấy phép, và phê duyệt đối với hình ảnh AI đã xuất bản.
  • Ưu tiên các công cụ hỗ trợ thông tin xác thực truy xuất nguồn gốc hoặc watermark bền vững.
  • Không xem việc thiếu watermark là bằng chứng về tính xác thực.
  • Tránh dùng hình ảnh do AI tạo ra cho các bối cảnh tài liệu, bằng chứng, y tế, pháp lý, hoặc nhạy cảm về tin tức, trừ khi có quy trình công bố và rà soát rất rõ ràng.

Đối với các nhóm marketing và sản phẩm, sai lầm phổ biến nhất không phải là lừa dối ác ý. Đó là sự mơ hồ tùy tiện. Một ảnh hero rõ ràng mang tính minh họa cần ít công bố hơn một ảnh sản phẩm giả, chân dung khách hàng giả, hoặc hình ảnh sự kiện tổng hợp. Hình ảnh càng yêu cầu người xem tin rằng nó mô tả một người, địa điểm, sản phẩm, hoặc sự kiện có thật, thì công bố của bạn càng cần mạnh hơn.

Các nhóm thiết kế cũng nên quyết định công bố nằm ở đâu. Đôi khi nhãn hiển thị là phù hợp. Đôi khi metadata và tín dụng hình ảnh là đủ. Đôi khi câu trả lời đúng là không dùng hình ảnh được tạo ra đó.

Phát hiện nên mang tính xác suất, không phải đạo đức hóa

Phát hiện watermark là một tín hiệu, không phải phán quyết. Điều này quan trọng vì sự tự tin sai lầm có thể gây hại cho con người.

Một bộ phát hiện có thể bỏ sót hình ảnh đã đánh dấu sau khi chỉnh sửa nặng. Nó có thể gắn cờ sai một hình ảnh. Nó có thể hoạt động tốt với một trình tạo và kém với trình tạo khác. Nó có thể được tinh chỉnh cho điều kiện phòng thí nghiệm thay vì môi trường phân phối thực tế lộn xộn.

Vì vậy câu hỏi vận hành không nên là: Đây có phải AI không? Nó nên là: Chúng ta có bằng chứng gì, bằng chứng đó đáng tin cậy đến đâu, và chúng ta đang đưa ra quyết định gì từ nó?

Một nền tảng quyết định có thêm nhãn nhẹ hay không có thể chấp nhận nhiều bất định hơn một trường học cáo buộc học sinh vi phạm hoặc một nhà xuất bản cáo buộc gian lận. Hệ quả càng cao, bạn càng cần nhiều bằng chứng củng cố.

Đây cũng là sự thận trọng áp dụng cho phát hiện nội dung AI nói chung: bộ phát hiện hữu ích để phân loại ban đầu, không phải để làm thẩm phán.

Trường hợp sử dụng tốt nhất: quy trình đáng tin cậy, không phải kiểm soát hoàn hảo

Lập luận mạnh nhất cho watermark không phải là bắt mọi hình ảnh tổng hợp sau khi nó thoát ra internet. Điều đó quá tham vọng.

Lập luận mạnh hơn là xây dựng quy trình làm việc đáng tin cậy trước khi xuất bản:

  • Trình tạo đánh dấu đầu ra.
  • Phần mềm chỉnh sửa bảo toàn thông tin xác thực.
  • Hệ thống quản lý nội dung lưu trữ chúng.
  • Nhà xuất bản hiển thị chúng khi phù hợp.
  • Người xem xét có thể kiểm tra chuỗi sau này.

Quy trình đó sẽ không chặn mọi tác nhân xấu. Nó sẽ khiến các tác nhân có trách nhiệm trở nên dễ hiểu hơn.

Sự phân biệt đó quan trọng. Watermark thường được tiếp thị như một bức tường phòng thủ chống lại thông tin sai lệch. Trên thực tế, nó gần với một dấu vết hồ sơ hơn. Dấu vết hồ sơ có giá trị. Chúng cũng không đầy đủ, bị mất mát, và chỉ đáng tin bằng các tổ chức duy trì chúng.

<!-- tool-cta:start -->

💡 Hãy thử điều này: Để xem các chữ ký AI được nhúng có thể mong manh đến mức nào, hãy thử AI Metadata Masker, công cụ cho thấy những dấu hiệu như vậy có thể dễ dàng bị thay đổi hoặc xóa bỏ ra sao.

<!-- tool-cta:end -->

Kết luận

Watermark cho hình ảnh do AI tạo ra làm được ba việc hữu ích: hỗ trợ công bố thông tin, cung cấp cho nền tảng và nhà xuất bản một tín hiệu kiểm duyệt, và giúp bảo toàn truy xuất nguồn gốc trong các quy trình được kiểm soát.

Nó không chứng minh sự thật, không giải quyết bản quyền, không bảo đảm ghi công, và không nhận diện đáng tin cậy mọi hình ảnh tổng hợp ngoài môi trường mở.

Lập trường thực tế không phải là hoài nghi cũng không phải là tin tưởng mù quáng. Hãy dùng watermark ở nơi nó làm giảm mơ hồ. Ưu tiên truy xuất nguồn gốc dựa trên tiêu chuẩn ở nơi chuỗi lưu giữ quan trọng. Giữ rà soát của con người cho các trường hợp rủi ro cao. Và đừng để một dấu kỹ thuật thay thế phán đoán biên tập.

Câu hỏi thường gặp

Có thể xóa watermark trên hình ảnh AI không?
Thường là có. Dấu hiển thị có thể bị cắt hoặc chỉnh sửa bỏ đi. Metadata có thể bị loại bỏ. Dấu vô hình ở cấp pixel có thể sống sót qua các chỉnh sửa phổ biến, nhưng kẻ tấn công quyết tâm có thể cố làm suy giảm hoặc xóa chúng.
Việc thiếu watermark có chứng minh hình ảnh là thật không?
Không. Thiếu watermark chỉ có nghĩa là không phát hiện được dấu được hỗ trợ nào. Hình ảnh có thể là thật, được tạo bởi một mô hình không đánh dấu, bị chỉnh sửa đến khi dấu biến mất, hoặc được sao chép qua một hệ thống đã loại bỏ metadata.
C2PA có giống watermark không?
Không hẳn. C2PA là một tiêu chuẩn truy xuất nguồn gốc để gắn thông tin xác thực nội dung đã ký vào phương tiện. Nó có thể ghi lại lịch sử tạo và chỉnh sửa. Nó có thể bổ trợ cho watermark, nhưng không đơn giản là một dấu pixel ẩn.
Website có nên gắn nhãn hiển thị cho hình ảnh do AI tạo ra không?
Nên làm vậy khi bản chất tổng hợp có thể thay đổi cách người xem diễn giải hình ảnh. Nghệ thuật trừu tượng trang trí có thể cần ít công bố. Người, sản phẩm, sự kiện, hoặc cảnh theo phong cách tài liệu được tạo tổng hợp thường cần nhãn rõ ràng hơn.
Các bộ phát hiện watermark AI có đủ đáng tin cậy để thực thi không?
Chúng có thể hỗ trợ kiểm duyệt rủi ro thấp và quy trình rà soát, nhưng không nên là bằng chứng duy nhất trong các quyết định có hệ quả lớn. Hãy xem phát hiện là mang tính xác suất và củng cố bằng bằng chứng khác.

Nguồn & tài liệu tham khảo thêm

  1. C2PA Technical Specification
  2. Google DeepMind: Identifying AI-generated images with SynthID
  3. NIST AI 100-4: Reducing Risks Posed by Synthetic Content
  4. Partnership on AI: Responsible Practices for Synthetic Media
Về tác giả
The Wux Webtools Team

Cập nhật lần cuối:

Tiếp tục đọc