Chi phí ẩn của hình ảnh do AI tạo trên web mở
Mỗi hình ảnh tổng hợp đều đi kèm một hóa đơn năng lượng và một khoản nợ huấn luyện. Điều đó có ý nghĩa gì với web vào năm 2026.
Mục lục
Ảo tưởng về hình ảnh không tốn chi phí
Các trình tạo ảnh bằng AI mang lại cảm giác gần như không có ma sát. Bạn nhập một prompt, chờ mười lăm giây, rồi có một hình hero cho bài viết blog. Không cần thuê nhiếp ảnh gia, không cần gói đăng ký ảnh stock, không đau đầu về giấy phép. Chi phí biên dường như bằng không.
Nhưng phép tính thực tế không vận hành như vậy. Mỗi hình ảnh được tạo ra đều đòi hỏi một lượng tính toán đáng kể—khoảng từ 0,3 đến 2,9 watt-giờ cho mỗi ảnh, tùy thuộc vào mô hình và độ phân giải. Con số đó xấp xỉ việc sạc một chiếc smartphone, cho mỗi ảnh. Nhân lên với hàng triệu hình ảnh được tạo ra mỗi ngày, và bạn đang nhìn vào mức tiêu thụ năng lượng của một thành phố nhỏ, từng ngày một.
Chi phí môi trường không phải khoản chi ẩn duy nhất. Còn có khoản nợ huấn luyện: thực tế là các mô hình này được xây dựng trên những tập dữ liệu bị thu thập mà không có sự đồng ý của nghệ sĩ, nhiếp ảnh gia và họa sĩ minh họa—những người chưa từng chấp thuận để tác phẩm của mình được dùng theo cách này. Các câu hỏi pháp lý và đạo đức vẫn chưa được giải quyết—chúng chỉ đang bị trì hoãn trong khi công nghệ tiếp tục lao về phía trước.
Nghiên cứu thực sự nói gì
Một nghiên cứu năm 2023 từ các nhà nghiên cứu tại Carnegie Mellon và Hugging Face cho thấy việc tạo một hình ảnh duy nhất bằng Stable Diffusion tiêu thụ lượng năng lượng xấp xỉ sạc đầy một chiếc smartphone. DALL-E và Midjourney, vốn chạy trên hạ tầng lớn hơn, nhiều khả năng tiêu thụ nhiều hơn.
Điều đó có thể nghe có vẻ nhỏ nhặt cho đến khi bạn xét đến quy mô. Cuối năm 2025, Adobe báo cáo rằng Firefly đã tạo hơn 12 tỷ hình ảnh kể từ khi ra mắt. Nếu mỗi ảnh chỉ mang một mức tính toán thận trọng là 0,5 watt-giờ, thì đó là 6 gigawatt-giờ—đủ để cấp điện cho khoảng 550 hộ gia đình tại Mỹ trong một năm.
Giai đoạn huấn luyện còn tệ hơn. Huấn luyện một mô hình ảnh lớn như DALL-E 3 hoặc Midjourney v6 đòi hỏi lượng tính toán tương đương với phát thải trọn đời của nhiều chiếc ô tô. OpenAI chưa công bố số liệu chính xác, nhưng các ước tính từ giới nghiên cứu AI cho thấy chi phí huấn luyện nằm trong khoảng 500-1.000 tấn CO₂ cho mỗi lần lặp mô hình.
Rồi còn câu hỏi về bản quyền. Tháng 1 năm 2024, US Copyright Office tái khẳng định rằng hình ảnh do AI tạo không thể được bảo hộ bản quyền trừ khi chúng chứa đủ yếu tố tác giả của con người. Trong khi đó, các vụ kiện từ Getty Images, các tập thể nghệ sĩ và những nhà sáng tạo cá nhân vẫn đang đi qua hệ thống tòa án tại Mỹ và EU. Bối cảnh pháp lý vẫn chưa ổn định, nhưng hướng đi thì rõ ràng: sử dụng hình ảnh do AI tạo kéo theo rủi ro danh tiếng và pháp lý mà ba năm trước chưa tồn tại.
Khi nào hình ảnh tổng hợp là hợp lý
Đây không phải là lập luận rằng không bao giờ nên dùng hình ảnh do AI tạo. Có những trường hợp sử dụng chính đáng, nơi sự đánh đổi là hợp lý:
- Tạo mẫu và phác thảo ý tưởng trước khi đặt làm tác phẩm cuối cùng
- Hình ảnh placeholder trong môi trường phát triển, vốn sẽ không bao giờ được đưa lên production
- Sơ đồ kỹ thuật có tính đặc thù cao khi không có ảnh stock phù hợp và việc đặt làm riêng quá đắt
- Yếu tố trang trí trong tài liệu nội bộ, nơi độ chỉn chu về thị giác quan trọng nhưng việc ghi công thì không
Điểm mấu chốt là sự chủ đích. Nếu bạn tạo một hình ảnh chỉ vì cách đó nhanh hơn việc suy nghĩ xem mình có thực sự cần một hình ảnh hay không, có lẽ bạn đang đưa ra lựa chọn sai.
Sử dụng có trách nhiệm trông như thế nào trong thực tế
Nếu bạn dùng hình ảnh do AI tạo trên một website hướng ra công chúng, đây là tiêu chuẩn tối thiểu để tôn trọng cả độc giả lẫn hệ sinh thái rộng hơn:
Công bố rõ ràng. Đừng chôn thông tin đó ở footer hoặc trong điều khoản dịch vụ. Nếu một hình ảnh là tổng hợp, hãy nói rõ trong alt text hoặc chú thích. Độc giả có thể chấp nhận sự thật; họ không chấp nhận cảm giác bị đánh lừa. Chúng tôi đã viết chi tiết hơn về công bố AI một cách trung thực trông như thế nào.
Tối ưu hóa mạnh tay. Hình ảnh do AI tạo thường được đưa lên ở độ phân giải cao không cần thiết vì trình tạo mặc định là 1024×1024 hoặc lớn hơn. Hãy nén đúng cách và phục vụ chúng theo kiểu responsive. Nếu bạn tạo ảnh ở phía client, xử lý chúng trong trình duyệt có thể giảm tải máy chủ và cải thiện quyền riêng tư.
Ưu tiên hình ảnh thật khi có sẵn. Ảnh stock có những vấn đề đạo đức riêng, nhưng ít nhất nguồn gốc là rõ ràng và chi phí năng lượng được phân bổ qua nhiều lần sử dụng. Nếu Unsplash có một bức ảnh phù hợp, hãy dùng nó.
Viết alt text tốt hơn. Hình ảnh do AI tạo thường khá chung chung về mặt thị giác, khiến alt text được cân nhắc kỹ càng càng trở nên quan trọng. Một hình hero mang tính trang trí về "một cảnh quan đô thị tương lai" không cần một bài tiểu thuyết, nhưng nó cần đủ ngữ cảnh để người dùng trình đọc màn hình hiểu vì sao nó có mặt ở đó. Hướng dẫn về alt text năm 2026 của chúng tôi phân tích sâu vấn đề này.
Câu hỏi về tính bền vững mà không ai muốn trả lời
Phản ứng của ngành AI trước các lo ngại về năng lượng là hứa hẹn những cải thiện hiệu suất trong tương lai. Mô hình sẽ nhỏ hơn, phần cứng sẽ nhanh hơn, năng lượng tái tạo sẽ bù đắp carbon. Tất cả những điều đó có lẽ đều đúng, nhưng chúng không giải quyết vấn đề căn bản: chúng ta đang thêm một lớp tiêu tốn năng lượng mới vào mọi quyết định sáng tạo trên web.
Dấu chân carbon của web đã tăng trong nhiều năm, bị thúc đẩy bởi các gói JavaScript nặng hơn, nhiều video hơn, nhiều script theo dõi hơn. Hình ảnh do AI tạo là phần mới nhất được thêm vào đống đó. Câu hỏi không phải là liệu công nghệ có cải thiện hay không—nó sẽ cải thiện. Câu hỏi là liệu chúng ta có sẵn sàng thêm chi phí này vào mọi bài viết blog, mọi trang sản phẩm, mọi landing page, chỉ vì chúng ta có thể làm vậy hay không.
Câu trả lời trung thực là hầu hết website không cần nhiều hình ảnh như hiện nay. Hình hero, đường phân tách mục, nền trang trí—phần lớn tồn tại vì các template trực quan kỳ vọng chúng, chứ không phải vì độc giả cần chúng. Tạo ảnh bằng AI khiến việc lấp đầy các vị trí đó dễ hơn, nhưng không khiến các vị trí đó trở nên cần thiết.
<!-- tool-cta:start -->
💡 Hãy thử cách này: Nếu bạn đang kiểm tra các nguồn hình ảnh để tìm nội dung do AI tạo, AI Image Detector có thể gắn cờ các hình ảnh có khả năng là tổng hợp trước khi bạn xuất bản chúng.
<!-- tool-cta:end -->
Một tiêu chuẩn khả thi cho năm 2026
Đây là một khung thực tế để cân bằng giữa tiện ích và trách nhiệm:
- Mặc định là không dùng hình ảnh. Bắt đầu bằng văn bản. Chỉ thêm hình ảnh khi nó thực sự làm rõ hoặc nâng cao nội dung.
- Ưu tiên hình ảnh thật. Dùng ảnh chụp, minh họa hoặc sơ đồ do con người tạo ra, với ghi công rõ ràng.
- Nếu bạn tạo bằng AI, hãy công bố. Làm cho việc hình ảnh đó là tổng hợp trở nên hiển nhiên, và giải thích vì sao bạn chọn tạo bằng AI thay vì các phương án khác.
- Tối ưu hóa không khoan nhượng. Nén, thay đổi kích thước và phục vụ hình ảnh một cách có trách nhiệm. Mỗi kilobyte bạn không gửi đi là năng lượng bạn không tiêu tốn.
- Kiểm toán định kỳ. Cứ sáu tháng, hãy rà soát thư viện hình ảnh của bạn. Xóa những gì không cần, thay thế những gì có thể, và ghi lại những gì chưa thể thay thế.
Đây không phải một bài kiểm tra về sự thuần khiết. Đây là sự thừa nhận rằng mọi quyết định kỹ thuật đều có chi phí, và minh bạch là cái giá tối thiểu khi dùng những công cụ còn mang các khoản nợ đạo đức và môi trường chưa được giải quyết.
Web không cần ít hình ảnh hơn. Nó cần nhiều hình ảnh có chủ đích hơn.


