Новосибирские разработчики создали модель с искусственным интеллектом, которая устанавливает подлинность фотографий на основе их структуры. Анализ всей архитектуры изображения позволяет установить расположение артефактов даже в сжатых или измененных файлах.
Фото: Bzzz.News/Клава Назарова
Ученые из НГТУ НЭТИ разработали алгоритм на основе технологии Vision Transformer (ViT), который анализирует архитектуру изображения и на основе полученных данных устанавливает, было ли оно сгенерировано с помощью Stable Diffusion, Midjourney или DALL?E. Как показало исследование, система анализирует общую структуру картинки и фиксирует равномерное распределение артефактов, характерное для искусственно созданных объектов, сообщили в пресс-службе вуза.
В то время как сверточные сети видят лишь локальные текстуры, ViT восстанавливает взаимосвязи по всему кадру. Кроме того, большинство детекторов требуют обучения на десятках тысяч примеров и сбиваются при сжатии или изменении разрешения, в то время как новосибирская разработка сохраняет до 89% точности за счет полного охвата картинки.
Подобный подход имеет значение для криминалистики, где набор размеченных синтетических изображений существенно ограничен. Также технология может использоваться в новостных агентствах, соцсетях, системах верификации мультимедийного контента и при проверке авторских работ.
Ранее Bzzz.News сообщал, что российские специалисты разработали нейросеть для выявления депрессии



