Инпейнтинг — что это, как работает маска и чем отличается от аутпейнтинга
Инпейнтинг (inpainting) — перерисовка выделенной маской области изображения: нейросеть заполняет её новым содержимым, согласуя свет, фактуру и перспективу с остальным кадром.
Инпейнтинг (inpainting) — это перерисовка выделенной области изображения: часть кадра закрывают маской, а алгоритм или нейросеть заполняет её новым содержимым так, чтобы свет, фактура и перспектива совпали с остальным снимком. Всё, что осталось за маской, не меняется. На этой технике держатся удаление лишних объектов, ретушь старых фото и один из способов заменить вещь на человеке.
В съёмке одежды это рабочий инструмент постобработки: убрать прищепку на боковом шве, дорисовать срезанный край рукава, поменять деталь без пересъёмки.
Что такое инпейнтинг простыми словами
Инпейнтинг — заполнение «дыры» в изображении правдоподобным содержимым по окружающему контексту.
Слово английское: inpaint буквально значит «вписывать красками». Пришло оно из реставрации живописи, где так называют тонировку утрат: реставратор вписывает недостающий фрагмент, продолжая рисунок и цвет от уцелевших краёв. В компьютерную графику термин перенесли исследователи Бертальмио, Сапиро, Касельес и Бальестер. В 2000 году они представили на конференции SIGGRAPH алгоритм, который продолжал линии одинаковой яркости от границы области внутрь — ровно так, как работает реставратор.
С тех пор сменилось три поколения методов:
| Поколение | Как заполняет область | Где сильно | Где ломается |
|---|---|---|---|
| Классические алгоритмы | растягивают соседние пиксели внутрь маски | царапины, пыль, тонкие надписи | крупные объекты, сложная фактура |
| Патч-методы | копируют похожие фрагменты из того же снимка | однородный фон: трава, стена, песок | лица, руки, предметы с чёткой формой |
| Нейросети | генерируют новое содержимое, в том числе по тексту | большие области, замена предметов | мелкая графика, точное повторение деталей |
Патч-подход лежит, например, в основе «заливки с учётом содержимого» в Photoshop, а нейросетевой вариант там же называется генеративной заливкой.
Как устроен инпейнтинг: маска, контекст, шум
Любой инпейнтинг получает три входа: исходный кадр, маску и задание — что должно появиться под маской. У классических алгоритмов задание одно: «продолжи фон». Генеративным моделям его формулируют текстом или подают картинкой-образцом.
Маска — чёрно-белая карта того же размера, что и снимок. Обычно белое модель перерисовывает, чёрное сохраняет, а серые пиксели на растушёванном краю смешивает. Маску рисуют кистью, загружают отдельным файлом или строят автоматически: модель сегментации сама выделяет человека, волосы, одежду или фон.
Генерация. В диффузионных моделях область под маской заполняется шумом, и дальше модель за несколько десятков шагов очищает его, на каждом шаге сверяясь с открытой частью кадра и с запросом. Поэтому дорисованный фрагмент получает свет и перспективу сцены, а не выглядит вклеенным.
Настройки, которые в интерфейсах вроде Automatic1111, Forge и ComfyUI влияют на результат сильнее всего:
- denoising strength — насколько далеко уйти от исходника. Низкие значения сохраняют форму и меняют фактуру, высокие рисуют заново;
- mask blur — ширина растушёвки края в пикселях: без неё на границе остаётся шов;
- only masked — перерисовать увеличенный фрагмент вокруг маски, а не весь кадр; выручает с мелкими деталями вроде пуговиц и застёжек;
- masked content — что лежит под маской перед стартом: оригинал, размытая заливка цветами кадра или шум. Оригинал удобен, когда меняется только цвет, шум — когда под маской должно появиться совсем другое.
Чем отличается от аутпейнтинга и image-to-image
Инпейнтинг рисует внутри кадра, аутпейнтинг — за его границами, а image-to-image перерисовывает кадр целиком. Это три режима одного семейства, и путают их постоянно.
| Инпейнтинг | Аутпейнтинг | Image-to-image | |
|---|---|---|---|
| Где рисует | внутри маски | на добавленном поле за краем | по всему кадру |
| На что опирается | на края области со всех сторон | на одну сторону исходника | на композицию исходника |
| Что сохраняется | всё за маской, пиксель в пиксель | весь исходный кадр | общая композиция, но не детали |
| Типичная задача | убрать объект, заменить деталь | превратить горизонталь в вертикаль | сменить стиль, свет, настроение |
| Главный риск | шов и ореол на границе | выдуманный фон, кривая перспектива | лицо и вещи уплывают от оригинала |
В e-commerce эти режимы идут в связке. Горизонтальный кадр со съёмки не влезает в вертикальную карточку — аутпейнтинг достраивает пол и фон сверху и снизу. На том же кадре виден край стойки — его убирают инпейнтингом. Технически аутпейнтинг часто и есть инпейнтинг: холст увеличивают, а пустую зону отдают той же модели как маску.
Как применять на фото одежды и товаров
Техника хороша там, где нужно исправить одно место и не тронуть остальное. Если меняется больше половины кадра, честнее перегенерировать снимок целиком или переснять.
Задачи, которые на съёмке каталога встречаются постоянно:
- убрать прищепки и зажимы, которыми вещь подогнана на манекене, торчащую нитку, ярлык, пылинку на тёмном трикотаже;
- дорисовать край рукава или подол, срезанный кадрированием;
- убрать с фона уличного кадра прохожего, урну, провод;
- заменить деталь: цвет пояса, пуговицы, фон за вещью;
- заменить вещь на человеке — самый сложный сценарий, о нём ниже.
Оговорка для продавцов: на фото для карточки товар должен совпадать с тем, что получит покупатель. Ретушь пылинок — нормальная практика, а пуговицы или цвет, которых у реальной вещи нет, — прямой путь к возвратам.
Как рисовать маску, чтобы не переделывать:
- Делайте маску чуть шире объекта и захватывайте его тень. Узкая маска оставляет ореол — светлый или тёмный контур по краю.
- Если новая деталь другой формы, рисуйте маску по новому силуэту. Макси-юбку в маску мини не впишет ни одна модель: ей просто некуда поместиться.
- Описывайте в запросе только то, что под маской: «чёрный кожаный ремень с матовой пряжкой», а не весь кадр.
- Генерируйте несколько вариантов и выбирайте лучший, а не правьте первый до бесконечности.
- Проверяйте результат в масштабе 100%: граница маски, край ткани, пальцы рядом с зоной правки.
Замена вещи на человеке: маска плюс образец
Замена вещи на человеке — самый требовательный случай инпейнтинга: под маской нужно нарисовать не «какую-нибудь куртку», а конкретную, с её цветом, фактурой и кроем. Одного текстового запроса для этого мало.
Поэтому многие модели виртуальной примерки устроены как инпейнтинг с образцом. Сегментация находит на фото зону одежды и закрывает её маской, лицо и фон остаются открытыми. На вход модели идут снимок с маской, сама маска и изображение вещи, которое заменяет текстовый запрос. Под маской появляется именно эта вещь, а складки и свет подстраиваются под позу и сцену.
У такого подхода есть потолок. Новая вещь ограничена формой маски, по краю иногда проступает старая одежда — воротник из-под свитера, лямка из-под платья, — а руки перед корпусом сбивают сегментацию.
Замена одежды на фото в AI Dressup идёт дальше классической маски: кадр не правится по выделенной области, а собирается заново. Нейросеть удерживает лицо, фигуру и позу, а одежду строит с нуля, поэтому от прежнего наряда ничего не остаётся. Обратная сторона та же, что у любой перегенерации: фон и мелкие детали не повторяют исходник пиксель в пиксель. Маску при этом рисовать не нужно вовсе — как это выглядит по шагам, разобрано в статье о том, как на Вайлдберриз примерить вещь по фото.
Ошибки и ограничения
Почти весь брак виден в двух местах: на границе маски и в мелких деталях. Проверять нужно именно их.
- Шов и ореол. Маска впритык или без растушёвки — по краю остаётся контур или полоса другого оттенка.
- Чужой свет. Дорисованная область освещена сама по себе: тень падает не туда, блик не совпадает с источником.
- Приблизительная графика. Принт, вышитый логотип, тонкая полоска, надпись на груди — модель понимает, что рисунок есть, но повторяет его неточно.
- Руки и пальцы. Если они попали в маску, ждите лишний палец или сросшиеся фаланги.
- Остатки старого объекта. Маска не покрыла его целиком — из-под новой вещи выглядывает прежняя.
- Слишком большая маска. Когда перерисовывается почти весь кадр, контекста не остаётся, и модель фактически рисует новую картинку.
Два ограничения не технические. Первое: инпейнтинг — визуализация, а не измерение. Вещь, аккуратно вписанная в кадр, ничего не говорит о том, как она сядет в жизни. Второе — этика: правьте только свои снимки или фото людей, которые дали согласие, и не выдавайте сгенерированный кадр за подлинную фотографию.
Связанные понятия
Инпейнтинг — одна из операций генеративного ИИ по редактированию изображений. Соседние термины:
- Аутпейнтинг — дорисовка за границами кадра, «инпейнтинг наружу».
- Сегментация — автоматическое выделение объектов на фото; из неё получают маску.
- Удаление фона — родственная, но другая операция: фон не дорисовывается, а отделяется от объекта.
- ControlNet — дополнительные условия для генерации: поза, контур, глубина. У ControlNet есть и собственная inpaint-модель.
- Virtual try-on — примерка вещи на фото человека, которую часто строят на инпейнтинге с образцом.
Если коротко: инпейнтинг меняет то, что под маской, и бережёт всё остальное. Чем точнее маска и задание, тем меньше ручной работы после генерации.
Также называют: inpainting, inpaint, инпэйнтинг, image inpainting, дорисовка по маске, перерисовка области
Вопросы и ответы
Что такое инпейнтинг?
Инпейнтинг, или inpainting, — это перерисовка выбранной области изображения. Пользователь закрашивает маской часть кадра, а программа заполняет её новым содержимым, опираясь на то, что видно вокруг: свет, цвет, фактуру, линии перспективы. Всё за пределами маски остаётся нетронутым. Слово пришло из реставрации живописи, где так называют восполнение утрат красочного слоя, а в компьютерную графику его перенесли исследователи, в 2000 году представившие на конференции SIGGRAPH алгоритм цифрового инпейнтинга. Сегодня техника работает в трёх вариантах: классические алгоритмы растягивают соседние пиксели и хорошо убирают царапины, патч-методы копируют похожие фрагменты из того же снимка, а нейросети генерируют новое содержимое, в том числе по текстовому описанию. На практике инпейнтингом убирают лишние объекты и надписи, восстанавливают старые фото, дорисовывают обрезанные детали и меняют отдельные элементы кадра, например вещь на человеке.
Чем инпейнтинг отличается от аутпейнтинга?
Направлением. Инпейнтинг работает внутри кадра: модель видит края области со всех сторон и согласует дорисовку с окружением. Аутпейнтинг, или outpainting, расширяет изображение за его границы: к снимку добавляют пустое поле сбоку, сверху или снизу, и нейросеть продолжает сцену туда, где исходных пикселей нет вовсе. Поэтому аутпейнтинг опирается только на одну сторону и чаще додумывает: интерьер, продолжение улицы, пол под ногами. Задачи тоже разные. Инпейнтингом убирают прищепку на вещи, провод на фоне или прохожего, меняют деталь одежды. Аутпейнтингом превращают горизонтальный кадр в вертикальный под карточку товара или сторис, добавляют воздух вокруг тесно скадрированной фигуры. Технически обе операции часто выполняет одна и та же модель, разница лишь в том, где лежит маска: внутри картинки или на добавленном поле. Во многих интерфейсах аутпейнтинг так и устроен — холст увеличивают, а пустую зону отдают инпейнтингу.
Что позволяет сделать функция inpaint?
Функция inpaint позволяет изменить только выбранный участок изображения и не трогать остальное. Самые частые сценарии такие. Удалить объект: человека на заднем плане, провод, мусор, дату на собственном снимке. Исправить дефект: царапину, пятно, залом на старой фотографии. Дорисовать недостающее: обрезанный край рукава, кусок фона после кадрирования. Заменить элемент: цвет пояса, пуговицы, небо за окном, вещь на человеке. В генеративных моделях к маске добавляется текстовое описание, и под маской появляется то, что вы попросили, а не просто продолжение фона. В редакторах эта функция может называться иначе: перерисовка области, генеративная заливка, кисть восстановления. Ограничение везде одно: чем больше маска и чем сложнее содержимое под ней, тем выше шанс, что свет, масштаб или мелкая графика не совпадут с остальным кадром. Поэтому результат проверяют в полном масштабе и обычно генерируют несколько вариантов, чтобы выбрать лучший.
Как переводится inpaint и как назвать это по-русски?
Inpaint — английский глагол, буквально «вписывать красками, дорисовывать внутрь», а inpainting — образованное от него существительное. В реставрации живописи так называют тонировку утрат: реставратор вписывает недостающий фрагмент, продолжая рисунок и цвет от сохранившихся краёв. Устоявшегося русского перевода у термина нет, поэтому в профессиональной среде чаще говорят транслитом: инпейнтинг, реже инпэйнтинг. В русскоязычных интерфейсах встречаются описательные варианты: перерисовка области, дорисовка по маске, заполнение выделенного фрагмента, генеративная заливка в Photoshop. Все они описывают одно и то же действие. Технику не путайте с программой: Inpaint — ещё и название десктопного приложения компании Teorex для удаления объектов со снимков, поэтому запросы вроде «inpaint скачать» обычно относятся к нему, а не к нейросетевому методу. Сама техника реализована во многих редакторах и нейросетях и не принадлежит какой-то одной программе.
Что такое маска в inpaint?
Маска — это карта того, что нужно перерисовать. Обычно это чёрно-белое изображение того же размера, что и исходник: белые пиксели модель заменяет, чёрные сохраняет, серые на мягком краю смешивает. В редакторах маску рисуют кистью прямо поверх фото, в продвинутых интерфейсах загружают отдельным файлом или строят автоматически: модель сегментации сама выделяет человека, лицо, волосы, одежду или фон. От маски зависит почти весь результат. Слишком тесная оставляет ореол и следы старого объекта по краю, слишком широкая заставляет модель перерисовывать лишнее и терять связь с кадром. Рабочее правило из ретуши: маска чуть шире объекта, захватывает его тень, а край растушёван на несколько пикселей. Если под маской должна появиться вещь другой формы, например длинное платье вместо короткого, маску рисуют по новому силуэту, иначе новой вещи просто некуда поместиться. Английское masked inpainting означает то же самое — инпейнтинг по маске.
Как работает inpaint в Stable Diffusion?
В Stable Diffusion инпейнтинг — частный случай генерации из шума. Модель получает исходный кадр, маску и текстовый запрос. Область под маской зашумляется, а затем за несколько десятков шагов очищается, и на каждом шаге модель сверяется с открытой частью кадра и с запросом, поэтому дорисовка подстраивается под свет и перспективу снимка. Существуют специальные inpaint-версии моделей: например, у stable-diffusion-inpainting от Runway к обычному входу добавлены каналы для маски и замаскированного изображения, и такая модель заметно аккуратнее сшивает границу. В интерфейсах вроде Automatic1111, Forge, ComfyUI и Fooocus на результат сильнее всего влияют несколько настроек. Denoising strength задаёт, насколько далеко уйти от исходника. Mask blur смягчает край. Режим only masked перерисовывает увеличенный фрагмент вокруг маски, что помогает с мелкими деталями. Masked content определяет, что лежит под маской перед стартом: оригинал, заливка или шум. Для сложных случаев подключают ControlNet, чтобы удержать позу или контур.
Какие нейросети умеют делать inpainting?
Инпейнтинг сегодня есть в большинстве генеративных моделей для изображений, различается удобство. Открытые модели семейств Stable Diffusion и FLUX умеют его через специальные inpaint-версии и интерфейсы вроде ComfyUI, Fooocus и Automatic1111; у FLUX для этого выпущена отдельная модель Fill. В Midjourney похожая функция называется Vary Region: область выделяют рамкой или лассо и перегенерируют. В Photoshop это генеративная заливка, в браузерных сервисах и мобильных приложениях — кисть «убрать объект» или «заменить». Для удаления объектов без генерации нового содержимого часто берут открытую модель LaMa: она хорошо заполняет большие дыры фоном. Список быстро меняется, модели обновляются, функции переименовываются. Поэтому при выборе смотрите не на название, а на три вещи: можно ли рисовать маску вручную, можно ли текстом задать, что появится под ней, и сохраняет ли сервис исходное разрешение. Для замены одежды на человеке обычного инпейнтинга мало: нужны модели, которые принимают ещё и изображение самой вещи.
Можно ли сделать inpaint онлайн бесплатно?
Можно, путей несколько. Браузерные редакторы с кистью удаления объектов обычно дают попробовать бесплатно, но ограничивают разрешение, число правок или ставят водяной знак. Условия у каждого свои и регулярно меняются, поэтому их проверяют на сайте сервиса перед работой. Полностью бесплатный путь — открытые модели Stable Diffusion или FLUX, запущенные на своём компьютере через ComfyUI, Fooocus или Automatic1111. Платить за сервис не нужно, но понадобится видеокарта с достаточным объёмом памяти и время на настройку. Третий путь подходит, если задача прикладная: не искать инпейнтинг как таковой, а взять сервис под конкретную работу. Для примерки и замены одежды на своём снимке маску рисовать не нужно вовсе: в AI Dressup есть бесплатный старт, а нейросеть сама пересобирает кадр с новой вещью, сохраняя лицо, фигуру и позу. Какой бы путь вы ни выбрали, загружайте только свои фотографии или снимки людей, которые дали на это согласие.
Бывает ли инпейнтинг для видео?
Бывает, и это заметно более сложная задача. На фото модели достаточно один раз правдоподобно заполнить область, а в видео заполнение должно совпадать от кадра к кадру: если дорисовать каждый кадр отдельно, фон на месте удалённого объекта начнёт дрожать и мерцать. Поэтому видеоинпейнтинг учитывает движение: алгоритм отслеживает маску во времени, берёт недостающие пиксели из соседних кадров, где этот участок был открыт, и генерирует только остаток. Типичные задачи те же, что на фото: убрать прохожего, микрофон, провод или логотип на собственном ролике, заменить деталь. Такие инструменты есть в видеоредакторах с ИИ — например, у Runway удаление объекта из ролика вынесено в отдельный инструмент — и в исследовательских моделях с открытым кодом. Названия функций у сервисов меняются, поэтому актуальный набор смотрите в справке редактора. Ограничения похожи, только строже: быстрое движение, перекрытия и сложные тени ломают результат чаще, чем на статичном кадре. Для роликов с одеждой видеоинпейнтинг пока скорее инструмент ретуши, чем способ переодеть человека в движении.