Нейросети 18+: что они реально умеют с обычной фотографией

Разговоры про искусственный интеллект чаще всего крутятся вокруг чат-ботов и картинок по текстовому запросу. Но есть целый пласт нейросетей, занятых другим: они ничего не рисуют с нуля, а переделывают то, что уже есть на снимке. Убирают одежду, подставляют другое лицо, заставляют человека на фотографии двигаться. Ещё пару лет назад для этого нужны были видеокарта, терпение и умение ставить Stable Diffusion руками. Сейчас всё то же самое работает в браузере и занимает меньше минуты.
Разберём без восторгов и без паники: как эти сервисы устроены, что у них получается, что не получается и где проходят границы, за которые заходить не стоит.
Как нейросеть «снимает» одежду
Никакого «просвечивания» ткани, разумеется, нет — под одеждой на снимке нет никаких данных, там просто пиксели ткани. Работает это иначе: алгоритм стирает выбранную область и заново дорисовывает её, опираясь на позу, освещение, тон кожи и анатомию, которые видит на остальной части кадра. Технически это называется inpainting — та же механика, что убирает лишнего прохожего с отпускной фотографии, только задача обратная.
Отсюда сразу два следствия. Первое: результат — это правдоподобная выдумка, а не «то, что было на самом деле». Второе: качество упирается в исходник сильнее, чем в модель. Ровный свет, человек целиком в кадре, поза без сложных перекрытий — выйдет убедительно. Тёмное фото со смартфона, руки поперёк корпуса, объёмное пальто — модель начнёт додумывать, и это будет заметно.
Категорию сервисов, которые этим занимаются, в рунете собирательно называют порно ИИ — под этим ярлыком уживаются и однокнопочные телеграм-боты, и полноценные веб-сервисы с несколькими инструментами сразу.
Замена лица: дипфейк стал бытовой функцией
Face swap прошёл путь от исследовательской диковинки до обычной кнопки. Современным моделям хватает одного фото-донора: они снимают с него геометрию лица и переносят на целевой кадр, подгоняя под чужой ракурс, свет и оттенок кожи. Ещё недавно для сопоставимого результата требовались сотни кадров и часы обучения модели.
Слабые места остались прежними: сильный поворот головы, очки, волосы поперёк лица, контрастное боковое освещение. И чем дальше пропорции лица донора от лица на целевом снимке, тем заметнее стык.
Оживить снимок: из фотографии в видео
Самое заметное изменение последнего года — image-to-video. На входе одна картинка, на выходе короткий ролик, где человек с неё двигается. Устроено это двумя способами. Первый — готовые шаблоны движения: выбрал сценарий, загрузил фото, через несколько минут забрал результат. Второй — описание своими словами: вы объясняете текстом, что должно происходить в кадре, и задаёте длительность, обычно от пяти до тридцати секунд.
Деталь, о которую спотыкаются все новички: промпт описывает движение, а не сцену. Видео всегда стартует ровно с той картинки, которую вы загрузили. Просить «то же самое, но на пляже» бесполезно — модель либо проигнорирует, либо развалит кадр. Нужна другая обстановка — сначала меняйте исходное фото, потом оживляйте.
Сколько это стоит
Экономика у всех сервисов примерно одинаковая: внутренняя валюта — кредиты, каждое действие списывает фиксированное количество. Для ориентира — расценки Razdevai, где все четыре инструмента собраны в одном интерфейсе: раздеватор — 10 кредитов, замена лица — 10, видео по шаблону — 30, редактирование картинки текстовым промптом — 10. При регистрации начисляют 10 кредитов и карта для этого не нужна, то есть одну генерацию можно сделать, ничего не заплатив. Дальше пополнение от 599 ₽, оплата в рублях через СБП.
У конкурентов цифры отличаются, но порядок тот же. На что стоит смотреть при выборе: есть ли водяной знак и размытие на результате, отдают ли файл в исходном разрешении, что происходит с загруженными фотографиями после генерации и можно ли платить рублями без танцев с зарубежной картой.
Чего ждать не стоит
- Попадания с первого раза. Нормальная практика — две-три попытки с разными исходниками. Часть кредитов уходит в мусорные результаты, это заложено в жанр.
- Чуда из плохого фото. Если лицо занимает сорок пикселей, а кадр снят в темноте, ни одна модель это не вытянет.
- Полного контроля над деталями. Руки, пальцы, украшения, сложные узоры на ткани — традиционно слабое место генеративных моделей. Стало заметно лучше, но идеально не стало.
- Длинного сюжета в видео. Ролики короткие не от жадности разработчиков: чем длиннее генерация, тем сильнее модель уплывает от исходного кадра.
Закон и здравый смысл
Здесь коротко и без вариантов. Первое: снимки несовершеннолетних — абсолютное табу, у вменяемых сервисов на входе стоит автоматическая проверка и такое фото просто не примут. Это не вопрос правил площадки, это уголовная статья, и никаких смягчающих обстоятельств тут не бывает.
Второе: согласие. Обработать фотографию реального человека, который об этом не знает, а тем более куда-то выложить результат — прямая дорога к иску и к статье о клевете или распространении. Технически сервису всё равно, чьё фото вы загрузили; юридически отвечать будете вы. Разумная граница проходит там же, где и во всей взрослой тематике: совершеннолетние, согласие, и результат остаётся при вас.
Итог простой. Технология переехала из разряда «нужен мощный компьютер и полдня» в разряд «браузер и минута». Волшебной она от этого не стала: исходное фото по-прежнему решает больше, чем модель, а часть попыток уходит в брак. Но порог входа исчез — и именно поэтому разговор об этих инструментах стоит вести спокойно и предметно, а не в жанре страшилки.





Посетители, находящиеся в группе Гости, не могут оставлять комментарии к данной публикации.