Ещё недавно слово «ретушь» означало долгие часы в графическом редакторе: маски, слои, кисти, кривые. Нейросети перевернули этот процесс — теперь снимок правят фразой. Вы пишете «убери отражение в окне, оставь тон кожи», и модель сама понимает, что менять, а что беречь. За пару лет сформировался целый рынок таких инструментов: одни заточены под скорость, другие под хирургическую точность, третьи вообще не требуют промпта. В этом обзоре — актуальные модели 2026 года и честный расклад, кому какая подходит.
Все перечисленные нейросети собраны в одном месте — агрегаторе . Сервис работает на русском языке, не требует VPN и зарубежной карты, а на старте даёт 100 приветственных токенов, чтобы попробовать модели без оплаты.
Ниже - подробный обзор ИИ для обработки фото.
Seedream 4.5

— флагман ByteDance, который выбирают за естественность результата. В нём генерация и правка живут в одной модели: загружаете исходник, добавляете до десяти референсов, а дальше модель переносит объект в новую сцену, меняет свет и материалы, не ломая сам предмет. Сильная сторона — «честная» картинка: кожа, волосы, фактура ткани и студийный свет выглядят так, будто кадр снимали, а не рисовали. Вывод нативные 4K, что закрывает печать и каталоги. Стоит около $0.036 за изображение. Слабость — нет интерактивных выделений, поэтому крупную зону иногда пересобирают вместе со всем кадром.
Seedream 5 Pro

— ответ ByteDance на главную претензию фотографов к прежним версиям: «модель трогает лишнее». Релиз 8 июля 2026 года принёс точечные инструменты — лассо, рамку, набросок от руки, пипетку и референс материала, так что можно перекрасить один элемент, не касаясь остальных. Вторая фишка — послойный вывод: фон отдельно, до двадцати прозрачных PNG-слоёв отдельно, макет можно верстать дальше. Расплата — потолок 2K–3K вместо 4K, цена около $0.054 и более строгая модерация на лицах. Её смысл — в слоях и выделениях.
Seedream 5 Lite

— облегчённая пятёрка, где ставку сделали не на пиксели, а на «понимание». Главное отличие от 4.5 — два необычных режима правки. Первый работает по намерению: вместо технического задания пишете «убери дешевизну» или «сделай журнально», и модель сама решает, что поменять. Второй — правка по образцу: показываете пару «до и после», и это же превращение применяется к десяткам кадров. До четырнадцати референсов, вывод до 2K. Плоскость картинки и плывущий мелкий текст — осознанная цена за скорость и низкую стоимость кадра.
Nano Banana 2

— универсальный «рабочий конь» от Google, с которого чаще всего и начинают знакомство с ИИ-ретушью. Модель понимает бытовые формулировки: попросите заменить одежду, переставить вазу или убрать человека — композиция и свет исходника сохранятся. Опорой служат до десяти референсов объектов и до четырёх референсов персонажа, поэтому лицо и товар не «плавают» между кадрами. Поддерживаются последовательные правки без потери качества, вывод до 4K, обработка занимает 4–6 секунд, а цена стартует с $0.067 за 1K. На выводах стоит невидимый знак SynthID, а мелкие надписи лучше проверять.
Nano Banana Pro

— старшая модель линейки Gemini, рассчитанная на точность, а не на красоту. Она глубже «думает» о кадре: уверенно держит плотную вёрстку, десятки строк текста, повторяющийся фирменный стиль и многоэлементные сцены. В наборе до шести объектных, пяти персонажных и трёх стилевых референсов — можно одновременно задать товар, человека и визуальный язык. Разрешение до 4K. Скорость и цена кусаются: около $0.134 за кадр 1K–2K, генерация идёт десятки секунд. Для соцсетей это избыточно, зато для упаковки и рекламы — то, что нужно.
Nano Banana Lite

— бюджетная и самая шустрая версия «банана», созданная под поток: превью, черновики, сотни однотипных карточек. Ориентир — 4 секунды на кадр 1K при $0.034, вдвое дешевле Nano Banana 2. Правки полноценные, но модель честно не тянет длинные цепочки итераций и гору референсов, а вывод ограничен 1K. Рабочая экономия простая: массу кадров гоняете через Lite, лучшие доводите на старших моделях.
GPT Image 2.5

— релиз OpenAI от 8 сентября 2026 года, сделанный именно про редактирование. Поставляется двумя движками: быстрым Flare и максимально точным Sunburst. Главное, за что модель ценят, — она меняет ровно то, о чём просили, и держит лица узнаваемыми даже после десятков проходов. Поддержаны инпейнтинг, до шестнадцати референсов, промпт до 20 000 символов, вывод до 4K и прозрачный фон. Токены не подорожали: $8 за миллион входных изображений. Есть C2PA-метаданные и невидимый водяной знак.
GPT Image 2

— предшественник, который рано списывать. Его авторегрессионная архитектура воспринимает запрос как связный текст, поэтому длинные многоуровневые описания и плотная вёрстка даются ему стабильнее, чем наследнику. Отсюда и профиль — правка фото с надписями: баннеры, витрины, упаковки, постеры. До шестнадцати референсов, 4K, те же ~99% точности текста и более широкий выбор соотношений сторон. Плюс модель дешевле и уже встроена во многие рабочие процессы, поэтому студии держат её в продакшене.
FLUX.2 Pro

— модель Black Forest Labs для тех, кто правит фото из кода, а не вручную. Отдельный endpoint на редактирование принимает до девяти референсов и адресует их прямо в промпте: «человека из первой, одежду из четвёртой, фон из третьей». Никаких масок и подбора параметров — фиксированная оптимизация даёт предсказуемый результат на всём потоке, что важно для автогенерации карточек и баннеров. Врезка в реальные снимки получается без читаемых стыков. Цена от $0.03 за мегапиксель — на 4K выходит дороже конкурентов.
FLUX.2 Klein

— компактное семейство на 4B и 9B параметров ради мгновенного цикла «загрузил — поправил — увидел». Одна архитектура закрывает генерацию, правку одного исходника и работу с референсами (до четырёх), а отклик — доли секунды на топовых картах и пара секунд на RTX 3060/4060. Ключевое отличие от остальных — открытые веса: 4B лежит под Apache 2.0 и запускается локально, в том числе в ComfyUI. От $0.014 за картинку это самый дешёвый вход в линейку. Уступает старшим моделям в детализации и тексте.
Qwen Image 3

— инструмент Alibaba для «содержательных» правок, а не косметики. Инструкции принимаются объёмом до 4500 токенов, то есть можно вложить настоящее техническое задание. Сильна в трёх вещах: переписывает текст внутри изображения, не трогая шрифт и перспективу; переносит и заменяет объекты по одному-трём референсам; реставрирует повреждённые и выцветшие снимки, сохраняя фактуру оригинала. Умеет расширять кадр панорамированием. Вывод до 2048×2048. Минус — закрытые веса и отсутствие публичных бенчмарков.
WAN 2.7 Image

от Tongyi Lab сочетает генерацию и правку с двумя заметными механизмами. Thinking mode сначала осмысливает запрос и планирует композицию, а уже потом рисует, из-за чего сложные инструкции исполняются чище. Интерактивный режим позволяет двигать и заменять выделенную область вплоть до попиксельного редактирования, не задевая лицо и прочие неупомянутые детали. До девяти референсов, извлечение палитры одним кликом, тонкая настройка внешности персонажа. 2K в базе, 4K в Pro, доступ только через облако и API.
Grok Imagine

— модель Imagine Image 2.0, которая работает внутри Grok в Quality Mode. Отправная точка — ваш готовый файл, а не чистый лист. Реальные сценарии: убрать лишних людей и надписи, сменить фон, перекрасить одежду, поправить свет, развернуть объект в другой ракурс. До пяти референсов, вывод 1K–2K, плюс «волшебная палочка» для выборочных правок и Smart Resize для смены формата. Зависимость качества от тарифа и региона, строгая модерация и слабоватая проработка кожи — главные оговорки.
Midjourney

долго оставался генератором, но 27 августа 2026 года в V8.2 появилась Edit Model, объединившая четыре сценария в один. Она правит фото текстовой инструкцией, собирает кадр из четырёх референсов, закрашивает выделенные области кистью и расширяет холст за границы снимка, а ещё переводит фотографию в набросок или живопись. Вызывается в Discord флагом --edit. Важно помнить: это художественный инструмент — при размытой формулировке он «задевает» лишнее, а инпейнтинг сбрасывает HD-разрешение до стандартного.
FeyNoBg

— открытая модель на BiRefNet, и ей вообще не нужен промпт: отдаёте изображение, получаете вырезанный объект на прозрачном фоне. Ценность в точности — первое место на четырёх из восьми профильных бенчмарков и корректная работа с 4K и 8K. Модель ничего не дорисовывает: пиксели остаются вашими, что принципиально для каталогов, где товар обязан быть настоящим. Волосы, мех, провода и низкоконтрастные сцены — то, на чём падают обычные сегментаторы, — она отрабатывает чисто.
Topaz Image Upscale

— восстановительный инструмент семейства Gigapixel, который повышает чёткость без выдумывания деталей. Потолок — 512 мегапикселей при исходниках до 32MP, с отдельными пресетами под фото, арт, CGI и сканы и настройкой детализации и шумодава. Генеративные модели меняют сцену, а Topaz доводит кадр до печати и снимает «мыло» и пластиковый эффект. Менять композицию или убирать объекты он не умеет — это территория генеративной правки.
Ещё четыре модели
Стоит упомянуть и младшие версии. Оригинальный — простой и надёжный редактор, но вывод всего 1024 px, и Google уже переводит его в legacy. — открытая 7B-модель с нативным 2K, удобная для локального запуска. и правят стиль, объекты и фон быстро и дёшево, однако потолок около 1024 px оставляет их в роли черновика. Наконец, — прошлое поколение OpenAI, которое берут лишь ради экономии.
Как выбирать
Отталкивайтесь от задачи, а не от бренда. Убрать лишнее и заменить фон — GPT Image 2.5 Sunburst или Nano Banana 2. Портретная ретушь без «пластика» — Seedream 4.5, а для полностью живого лица свяжите правку с Topaz. Товар на новом фоне — Seedream 4.5 или FLUX.2 Pro. Всё, что связано с надписями, — Qwen Image 3 или GPT Image 2. Черновики и переборы вариантов — FLUX.2 Klein и Nano Banana Lite. Вырезание фона — FeyNoBg, финальная чёткость — Topaz Image Upscale.
По деньгам разброс заметный: от $0.014 за кадр у FLUX.2 Klein и ~$0.034–0.036 у Nano Banana Lite и Seedream 4.5 до $0.054–0.134 у премиальных режимов. Для печати смотрите на нативные 4K — Seedream 4.5, Nano Banana 2, GPT Image 2.5, FLUX.2 Pro. Если данные чувствительны, а объёмы большие, FLUX.2 Klein 4B и FeyNoBg запускаются на собственном GPU, в отличие от закрытых Nano Banana, GPT Image и Qwen.
Итог
Универсального «лучшего» инструмента нет — есть набор под разные роли. Базовый редактор, который понимает речь и помнит объекты, — Nano Banana 2, GPT Image 2.5, Seedream 4.5. Точечное вмешательство в область — Seedream 5 Pro, WAN 2.7 Image, Midjourney. Скоростной конвейер — FLUX.2 Klein и Nano Banana Lite. И два безпромптовых помощника — FeyNoBg и Topaz Image Upscale. Главное правило напоследок: не пытайтесь исправить всё одной командой. Двигайтесь шагами — фон, объект, свет, текст — и оставляйте апскейл на финал.
Нет комментариев
Комментарии доступны после входа