Снял я как-то кусок видео на пляже. День, солнце, всё классно. А по задумке там должна была быть ночь, луна над водой, мрачноватая атмосфера. И вот сижу я с этим дневным роликом и думаю: либо переснимать вечером, либо лезть в монтажку и неделю мучиться с масками. Ни то, ни другое не радовало, честно.
В итоге я сделал из дня ночь за две генерации. Без переснимания, без плясок с бубном. Помогла мне в этом Switch X нейросеть, и сейчас расскажу про неё по порядку, потому что штука реально вывозит то, на чём спотыкаются почти все остальные видеомодели.
В чём главная боль? Обычные нейросети для видео перерисовывают вас целиком. Просишь поменять фон, а они заодно переделывают вам лицо, мимику плывёт, губы не попадают в речь. Switch X работает иначе, и в этом вся фишка.
Если совсем просто: Switch X это видеомодель от Bytedance (тех же ребят, что делают TikTok), и её главная задача не выдумать видео с нуля, а взять ваш исходный ролик и поменять только то, что вы попросите. Фон. Освещение. Окружение. А вас при этом оставить как есть. Лицо, мимику, движение губ, объекты в руках.
Почувствуйте разницу с тем же Kling или Veo. Те модели генерируют каждый кадр заново, поэтому на длинных роликах человек начинает «плыть», лицо чуть меняется от кадра к кадру, а липсинк живёт своей жизнью. Switch X держит вас цепко.
Расскажу, как я до этого дошёл. Был у меня ролик, где на воротник прицепилась петличка, маленький микрофон. Бросалась в глаза. Я полез убирать её через маски в монтажке, кадр за кадром. И всё, приехали: кадры не совпадали между собой, маска ехала, петличка то появлялась, то пропадала, в итоге получилась каша. Промучился вечер, плюнул. А потом прогнал тот же ролик через Switch X, и он чисто всё пересобрал, сохранив меня в кадре. Вот тогда меня и зацепило.
Мы тут с ребятами были прям в восторге от этой модели, когда тестили. И хорошая новость: Switch X уже доступен в Syntx AI, так что не нужны ни зарубежные карты, ни смена гео. Зашёл, загрузил видео, работаешь.
Начну с того самого пляжа. Релайт, то есть замена освещения, это первое, ради чего стоит брать Switch X. Я взял дневной ролик, подготовил картинку, где та же сцена выглядит как ночь, добавил луну, и нейронка перекрасила мне всё видео в ночное. Свет, тени, отблески на воде. А я сам в кадре остался ровно таким же, как снимался.
Второе это замена фона с сохранением человека. По сути я могу взять себя из одной локации и аккуратно перенести в другую. Стоял на улице у дома, а оказался, условно, на фоне гор. При этом не нужен никакой зелёный фон, как раньше в съёмке. Switch X сам понимает, где вы, а где задник.
Третье и, по-моему, самое вкусное это липсинк. Раз модель сохраняет ваше лицо, то и губы остаются ровно там, где надо, в такт речи. Никакого эффекта, когда человек говорит, а рот живёт отдельно.
Но я не был бы собой, если бы не рассказал, где оно косячит. Был у меня ролик, где я держал в руках планшет. Хотел поменять сцену вокруг, а планшет в руках при этом крутился сам по себе и не хотел разворачиваться как надо. Объекты в руках Switch X иногда трактует по-своему. И второй момент: если задать слишком перенасыщенный, дико изменённый фон, модель начинает захлёбываться и результат разваливается. Чем спокойнее и логичнее новая сцена, тем чище итог.
Тут всё проще, чем кажется на первый взгляд. Сейчас по шагам.
Заходите в раздел с видеомоделями и выбираете Switch X. Дальше грузите два файла. Первый это ваше исходное видео, то, что снимали. Второй это референсное изображение, то есть картинка с тем, что вы хотите получить в итоге: с нужным фоном или светом.
Видео можно обрезать прямо в окне, не надо заранее резать в монтажке. Важный момент по длине: лимит 240 кадров. Если у вас ролик в 24 кадра в секунду, это ровно 10 секунд. Если 25 кадров, выйдет 9,6 секунды. Не пугайтесь этих цифр, просто держите в голове, что один заход это примерно десятка.
Теперь про референсный кадр. Я готовлю его в Nano Banana Pro. Беру первый кадр своего видео и говорю модели, что хочу: поменять день на ночь, добавить луну, сменить майку, подрисовать другое окружение. Получаю готовую картинку-ориентир и кидаю её в Switch X. Кстати, Nano Banana Pro лежит там же, в Syntx AI, так что я не прыгаю между десятью сервисами, всё в одном окне делаю.
И ещё приятное: для простой генерации промпт можно вообще не писать. Загрузили видео, загрузили картинку, и поехали. Текстом докручиваете только если хотите что-то особенное.
Наша система сама подберет вам исполнителей на услуги, связанные с разработкой сайта или приложения, поисковой оптимизацией, контекстной рекламой, маркетингом, SMM и PR.
Заполнить заявку
13691 тендер
проведено за восемь лет работы нашего сайта.
Вот тут многие новички пугаются и закрывают вкладку. Зря. Маски это не страшно, если понять логику.
Логика такая: то, что вы закрашиваете, остаётся нетронутым. То, что не закрашено, нейронка может менять. Всё. По сути вы пальцем показываете модели: «вот это не трогай, а вокруг делай что хочешь».
Режимов несколько. Есть авто, когда система сама пытается выделить человека. Есть Fill, то есть полная заливка, удобно для релайта, когда вы меняете свет на всей сцене целиком. И есть ручной, когда вы сами кистью обводите нужное.
Один совет из практики: выделяйте не только лицо и тело, но и руки. Если руки оставить без маски, они начинают жить своей жизнью, пальцы могут поплыть. И не забудьте про замочек, маленькая кнопка, которая фиксирует маску, чтобы она сохранилась и не слетела при генерации.
Это та грабля, на которую я наступил лично, поэтому слушайте внимательно.
Сначала я делал по логике «выделяю только себя, остальное меняю». Звучит правильно? А на деле нейронка теряла привязку к пространству, и я в кадре начинал слегка скользить по земле, будто ноги едут по льду. Жесть, короче, смотрелось неестественно.
Решение оказалось простым: надо выделять маской не только себя, но и небольшой кусок заднего фона рядом, землю под ногами, например. Так у модели появляется точка опоры, привязка к пространству, и человек перестаёт «плавать».
Был у меня ещё кейс с видео, где девушка стояла на снегу. Кадр был узковат, по бокам чёрные полоски. Я через подготовку референса расширил сцену, добавил снега по краям, убрал эти полоски, и Switch X собрал полноценный широкий кадр. Вот такие штуки реально решаются за пару минут, когда понимаешь принцип.
Соберу в кучу всё, на чём спотыкаются на старте.
Первое это микротряска. У меня был случай: я в кадре стоял, чуть согнув ноги, переминался почти незаметно. А нейронка восприняла это как движение и попыталась его доработать, в итоге картинка пошла мелкой дрожью. Снимайте устойчиво, без лишней микродинамики, если она вам в кадре не нужна.
Второе уже упоминал, но повторю, потому что важно. Не задавайте слишком дикий, перегруженный новый фон. Чем сильнее вы меняете сцену относительно исходника, тем выше шанс, что развалится. Идите от реальности.
И третье, самое главное по мышлению. Думайте как режиссёр ещё на съёмке. Если хотите потом «посадить» себя в космос или в кафе, то и снимайтесь в подходящей позе. Хотите сидеть в финальной сцене? Снимайтесь сидя. Switch X меняет окружение, но позу и движение он берёт из вашего исходника. Чем ближе исходник к задумке, тем меньше потом боли.
Кстати, про боль и лишние траты. Когда я только заходил в ИИ-контент, я с дуру оформил подписки сразу на пять разных сервисов. Пользовался по факту двумя, остальное просто сжигало деньги каждый месяц. Сейчас и Switch X, и Nano Banana Pro, и ещё куча моделей у меня в одном Syntx AI по одной подписке. И токены не сгорают разом, тратятся ровно под задачу. После того моего слива денег это прям отдушина.
Сколько секунд видео можно сделать за раз?
Лимит 240 кадров. Это 10 секунд при 24 кадрах в секунду или 9,6 секунды при 25 кадрах. Для большинства роликов в соцсети нарезка по десятке заходит нормально.
Чем Switch X отличается от Kling?
Kling и подобные перерисовывают каждый кадр заново, поэтому лицо и липсинк со временем плывут. Switch X сохраняет вас из исходного видео и меняет только фон или свет. Если вам важно остаться собой в кадре, это решающая разница.
Нужно ли писать сложные промпты?
Для простой замены фона или света можно не писать вообще. Достаточно загрузить видео и референсную картинку. Текст добавляете, только если хотите докрутить что-то конкретное.
Нужен ли зелёный фон при съёмке?
Нет. В этом и кайф. Switch X сам отделяет человека от фона, хромакей не требуется.
Сколько стоит и где попробовать?
Switch X доступен в Syntx AI по токенной модели, отдельную подписку именно на него оформлять не надо. На старте там дают бесплатные токены, как раз чтобы погонять модель и понять, ваше это или нет.
Switch X закрывает ту самую головную боль, из-за которой народ матерится на видеонейросети: он не уродует ваше лицо и не ломает липсинк, а меняет только то, что вы просите. Дальше всё решает практика и нормально подготовленный первый кадр. Маски не страшные, скольжение лечится привязкой к фону, тряска лечится устойчивой съёмкой. Пара заходов, и вы поймёте логику.
Если хотите попробовать сами, заходите в Syntx AI, там Switch X уже стоит, рядом Nano Banana Pro для подготовки кадров и ещё десятки моделей под одной подпиской. На старте кидают бесплатные токены, как раз хватит потестить. Заходить можно через сайт или сразу через Telegram-бот Syntx AI, кому где удобнее.
А я пошёл дальше крутить день в ночь, мне это почему-то особенно зашло. Если статья была полезной, напишите в комментариях, какую модель разобрать в следующий раз.