Тот факт, что весь контент в интернете имеет цифровой «отпечаток» мало кого удивит, но знаете ли вы, что уже все крупные соцсети, нейросети и поисковые системы благодаря идентификации контента могут очень много узнать о его авторе? На первый взгляд может показаться, что ничего важного, вот только для любителей трафика это проблема, ведь на основе метаданных рекламные платформы легко связывают аккаунты и присылают массовые баны. Чтобы этого избежать, разберем один из последних стандартов маркировки данных C2PA и на его примере узнаем, как работают цифровые отпечатки и как от них избавиться.
Что такое C2PA
C2PA (Coalition for Content Provenance and Authenticity) — стандарт маркировки данных, присваивающий разным видам контента (фото, видео, аудио и даже документам) информацию о его происхождении и полную историю правок.
Основан C2PA в феврале 2021 года в ходе сотрудничества ряда крупнейших компаний: Adobe, BBC, Intel, Microsoft и др. Первая версия C2PA вышла в начале 2022 года, после чего компании поочередно начали внедрять этот стандарт в свои продукты, например FB начал использовать C2PA для маркировки ИИ-контента.
Что касается нашего времени, то в 2026 году C2PA внедряется повсеместно, фактически любая крупная соцсеть или нейросеть предполагает его наличие. В WordPress есть даже специальный плагин, который автоматически проставляет «метку» C2PA на все фото и видео на сайте, позволяя впоследствии администратору заявлять об авторских правах на контент. При этом стандарт продолжает развиваться, пополняя списки сертификатов, форматов и типов метаданных.
Данные, собираемые C2PA
C2PA как стандарт пытается сохранить конфиденциальность и даже дает пользователям право не разглашать о себе лишнюю информацию, тем не менее собирает он очень много, а именно:
Информацию об устройстве (модель и серию).
Информацию об авторе (соцаккаунты и любые верификации).
Дату, время и геопозицию юзера.
Где было создано фото или видео.
Этапы обработки контента (то есть в каких приложениях обрабатывалось фото или видео, какие фильтры использовались и т. п.).
Ряд других данных.
Как вы понимаете, если C2PA собрал всю эту информацию и «зашил» в метаданные, то алгоритмы любой популярной соцсети или поисковой системы легко «съедают» эту информацию, как только файл загружается на их платформу.
Конечно, соцсети утверждают, что C2PA нужен, чтобы идентифицировать контент на ИИ-элементы и определить устройство генерации, но любой, кто в теме, понимает, что не только это их интересует. Ведь чем больше информации о пользователе имеет любая компания, тем больше у нее возможностей что-то ему продать или заблокировать.
Уникальность C2PA как стандарта
Уникальность стандарта заключается в том, что он рассчитан на все популярные форматы, которые только используются среди изображений, видео, аудио и документов. А это значит, что практически любой тип контента, который сейчас появляется, уже имеет «зашитый» в метаданных C2PA-отпечаток.
В 2026 году C2PA внедряется даже в обычные камеры по типу Nikon/Sony и программный софт (например, «Фотошоп»). Поэтому если пользователь поменяет какие-то элементы изображения, сгенерированного в Midjourney (или в любой другой нейронке) при помощи «Фотошопа», то C2PA не удалится, а просто появится новая цепочка метаданных, где будет информация, когда и где его редактировали. НО! Если внести изменения при помощи инструмента, который не поддерживает на данный момент C2PA-формат, то метаданные исчезнут или станут невалидными (среди таких инструментов можно выделить обычный Paint или GIMP).
Считываемость C2PA
Если задаться вопросом: легко ли считывается этот стандарт? Короткий ответ — да.
Meta* прямо пишет, что она маркирует ИИ-контент, а значит, использует индикаторы для его распознавания. А если FB* проверяет контент и понимает, какая нейронка его сгенерировала, то связать аккаунты, которые загружали его в рамках платформы, она сможет еще быстрее.
Фрагмент из статьи Meta
Meta* использует C2PA как классификатор еще с 2022 года, а вот Google Ads немного припозднился и начал юзать C2PA только в 2024-м для проверки контента на запрещенное содержание.
Как избавиться от метаданных (включая C2PA)
Теперь самое интересное — это как избавиться от этого «водяного знака», да и в принципе любых других метаданных. Один из самых простых и повсеместно доступных способов — использовать Телеграм/WhatsApp.
Разберем ситуацию на примере Телеграма (Ватсап работает похожим образом). Телеграм при отправке себе изображений и видео сжимает и преобразует их, создавая тем самым новое изображение/видео. Но работает это только в одном случае: если вы скинете фото именно как фотографию, а видео как видео, то есть скидывать изображения и видео как файл НЕЛЬЗЯ, ибо тогда метаданные сохраняются.
Если совсем просто, то, когда пользователь загружает любой контент именно как «файл», то он сохраняется как оригинал, а если пользователь отправляет изображение как фотографию, то ТГ будет сжимать ее, создавая новую фотографию (да, качество чуть-чуть падает, но метаданные стираются), с видео функционал работает примерно так же.
Пройдемся по всем форматам в Телеграме:
При отправке изображений в Телеграме (как обычных фото) происходит процесс конвертации и переупаковки изображения, из-за чего получается уже новая фотография (ее новая версия) в меньшем качестве, но без метаданных.
При отправке видео Телеграм работает аналогично как с фотографиями, только, помимо изменения картинки, меняет еще и кодек, из-за чего получается новое видео.
Аудио и голосовые сообщения также зависят от способа отправки, хотя они даже при обычной отправке могут сохранять часть тегов неизменными.
Другие типы файлов используют ветку «документы» и отдельные атрибуты, поэтому там метаданные практически не удаляются (то есть если скинуть документ себе в ТГ и скачать его, то вы скачаете оригинал со всеми метаданными).
Есть ли смысл бороться с метаданными и что будет дальше?
В 2026 году победить метаданные еще можно, и делать это нужно. Но все планомерно идет к тому, что весь контент будет безошибочно идентифицирован, и это лишь вопрос времени.
Проблема в том, что уже придумана невидимая водяная метка Soft Binding, которая препятствует полной потере метаданных, то есть если «вырвать» метаданные из файла, то водяная метка останется и позволит их восстановить (найти в отдельном реестре).
Почему не удалить и Soft Binding? Потому что этот «водяной знак» находится в самих пикселях, и поэтому, чтобы от него избавиться, нужно либо знать алгоритм его внесения, либо исказить изображение так сильно, чтобы оно было просто нечитаемым (например, ухудшить качество картинки раз в 5–10) Помимо этого, социальные сети в принципе никогда не будут бороться с метаданными или «водяными знаками», ибо им это выгодно (для них это дополнительный источник информации о пользователе).
Что касается поисковых систем, то Google уже давно занимается технологией SynthID (один из видов Soft Binding), которая позволит находить метаданные файла после процесса сжатия и других изменений. И хотя подобные технологии еще находятся на ранних этапах тестов, мировые компании явно намекают, что они не готовы терять никакую информацию о пользователе, ведь от этого в конечном итоге зависит их прибыль.
Фрагмент из статьи Google
Заключение
Как итог, в 2026 году бороться с метаданными еще можно, но получится ли от них избавиться в будущем — хороший вопрос. Ответ отрицательный: фактически все идет к тому, что компании хотят и будут собирать все больше информации о каждом пользователе и о каждом рекламодателе, а это приведет к еще более жесткой модерации любого контента.
* Meta запрещена на территории РФ.