Skip to content

Что будет, если писать промпты на китайском? Тестирую мифы Seedance 2.5

Тестируем мифы о Sedance 2.5: работают ли промпты на китайском, смайлы и длинные запросы в генерации видео с ИИ.

Key Takeaways

  • Смайлы работают как полноценные промпты и могут помочь сократить длину запроса.
  • Обход цензуры с помощью смайлов возможен, но не гарантирован.
  • Длинные промты не всегда улучшают результат, важна логика и структура описания.
  • Негативные промты могут ухудшать качество генерации в Sedance 2.5.
  • Промпты на китайском языке не дают значительного преимущества перед английским.

What the video covers

  • Sedance 2.5 недавно вышел и вокруг него появилось множество мифов.
  • Проверяется, можно ли использовать смайлы как полноценные промпты и обходить ли они цензуру.
  • Эксперимент с заменой слов на эмодзи показал, что смайлы работают и могут сокращать длину промпта.
  • Тест с обходом цензуры через смайлы показал, что они могут помочь, но не всегда проходят полностью.
  • Миф о том, что чем длиннее промт, тем лучше, проверяется на примере короткого и очень длинного промтов.
  • Результаты показали, что слишком длинные промты могут ухудшать качество из-за повторений и путаницы.
  • Негативные промты могут создавать ошибки и искажения в генерации, что подтверждается тестом с гоночными машинами.
  • Sedance 2.5 не имеет отдельного поля для негативных промтов, в отличие от некоторых других моделей.
  • Проверка промптов на китайском языке показала, что существенного преимущества перед английским нет.
  • Главное для нейросети — структура и логика промта, а не язык или длина.

Answers

Questions about this video

Можно ли использовать смайлы вместо слов в промптах для Sedance 2.5?

Да, смайлы работают как полноценные промпты и могут описывать объекты и эмоции, что подтверждено тестами в видео.

Помогают ли смайлы обходить цензуру в Sedance 2.5?

Смайлы могут частично помочь обойти цензуру, так как модель хуже распознаёт опасный контент в виде эмодзи, но это не всегда гарантировано.

Стоит ли писать очень длинные промты для улучшения качества генерации?

Нет, слишком длинные промты могут ухудшать качество из-за повторений и путаницы. Важно писать логичные и структурированные описания.

Full Transcript — Download SRT & Markdown

00:00
Speaker A
Sed 2.0 вышел в конце марта. Sedns 2.5, его преемник, вышел недавно, и за это время накопилось уже множество мифов.
00:08
Speaker A
Некоторые мифы вас повернут в шок. Что лучше: очень короткий промт или промт на 10 000 символов? Сегодня такой будет.
00:14
Speaker A
Можно ли сделать промт только из смайлов, получить неплохой результат, ещё и обойти цензуру? В общем, сегодня мифов предостаточно. Давайте смотреть.
00:28
Speaker A
Есть миф, что Сиденс понимает смайлы как обычные слова. И теория вполне реальная, ведь смайлы, эмодзи — это обычные символы со своим значением. Например, Джорни даже официально подтверждает, что один эмодзи может быть целым промтом. Но таких данных про Sedens нет, поэтому
00:44
Speaker A
давайте проверим сами. Переходим в раздел видео. Сделана генерация в Sedence 2.5. Здесь я написал суперпростой промт, то есть лошадь, а, бежит по степи в закатное время. И здесь настолько всё просто, что я не буду выводить это на полный экран. То есть мы
01:00
Speaker A
видим лошадь, закатное время, и она бежит по такому вот полю. Далее я возьму и заменю слово лошадь на смайлик. И как мы видим, здесь всё тоже работает. Мы видим лошадь, степь и такое закатное время. А что, если заменить полностью всё
01:19
Speaker A
предложение на смайлы? Получается вот три таких простых смайла. То есть лошадь, закатное время и степь. Да, и мы получили лошадь, закатное время и степь.
01:31
Speaker A
Правда, здесь уже такая более как пустыня, но в целом миф, что смайлы можно использовать как полноценный запрос, промт, подтверждается. Но я придумал ещё один тест. Что если использовать смайлы для описания эмоций?
01:46
Speaker A
Ну, в жизни мы так и делаем. Но поймёт ли это Сиденс? Есть моя карта персонажа, и я прописываю, что я медленно поворачиваюсь к стороне камеры с такой как испуганной экспрессией, с испуганной эмоцией. Здесь всё словами, да. Ну, и мы
02:00
Speaker A
в целом получаем вот такое вот э видео. Ну что тут поделать? Я такой поворачиваюсь в камеру, и я испугался.
02:15
Speaker A
Всё сработало. Теперь давайте вот эту испуганную эмоцию заменим на вот такой вот смайлик. И в целом, да, я пугаюсь. Такой удивлённый испуг. По идее, сработало.
02:33
Speaker A
Теперь добавим эмоцию, что я должен быть злым. Буду злым. Поворачиваюсь. Хорошо. Кстати, здесь генерация получше. А где?
02:45
Speaker A
Ну, ну сработало же, да? Сработало. Я злой в конце. Хорошо, давайте закончим на позитивной ноте, добавим смайлик и получится ли мне улыбнуться.
03:01
Speaker A
Что ж, миф оказался не мифом, а оправдой. Вопрос: зачем это нужно? А затем, раз мы знаем, что смайлы работают, то есть миф, что они помогают обходить цензуру. Есть некоторые исследования, что смайлы снижали распознавание опасного контента в среднем на 15%. Но опять же, Sedс никто
03:19
Speaker A
не тестировал, поэтому это сделаем мы. Поэтому я прописал такой промт. И как вы видите, спойлер, он не прошёл. Я прописал то, что здесь испуганный человек застрелен практически в упор, кровь разлетается в разные стороны, и человек умирает. Ну, как видите, это не прошло.
03:38
Speaker A
Понятное дело, что я мог отдалёнными какими-нибудь синонимами прописать этот промт, чтобы он прошёл. Но здесь мы тестируем конкретный миф. Помогают ли смайлы при обходе такой цензуры. И что я сделал? Я заменил текст, который вы видели, на испуганный смайлик, пистолет,
03:56
Speaker A
а, ну, такой как след выстрела, кровь, каплю крови и череп. И что у меня получилось?
04:14
Speaker A
А я бы сказал, это немножко жёстко, и смайлы справились. То есть обычным текстом не прошло. Видимо, может быть, какое-то конкретное слово не понравилось, но смайлы сработали. Он понял, что тут нужно застрелить человека, как бы это сейчас не звучало.
04:29
Speaker A
Считается ли это за обход цензуры в целом, как вы видели, да, считается. Вопрос: зачем это нужно? Как это пригодится на практике? Единственная мысль, которую приходит: эмодзи занимает всего лишь два символа. То есть с помощью смайлов вы можете сократить свой
04:43
Speaker A
промт. Вопрос: нужно ли сокращать свой промт? Как раз-таки есть миф, связанный с длиной промта. Миф, что чем длиннее промт, тем лучше. При этом разные сервисы и агрегаторы дают совершенно разные лимиты, от нескольких тысяч до десятков тысяч. Но это не означает, что
04:59
Speaker A
модели действительно нужен такой объём. Или означает? Поэтому проведём простой тест. Возьмём один сюжет и один референс, но сделаем два промта. Первый будет короткий, вот вы сейчас его видите. Здесь 750 символов примерно.
05:13
Speaker A
Есть такая вот моя референсная карта персонажа, которую мы используем. И второй промт будет на 10 000 символов.
05:53
Speaker A
Ну что я могу сказать? Сама по себе разница между тысяче символов и 10 000 тысячами символов не такая большая, но там, где было меньше символов, то есть вот первый мой промт на 750 даже символов, а мне нравится больше. Он
06:06
Speaker A
какой-то динамичный, там более логичные переходы между сценами. То есть, особенно момент, когда я поднимаюсь по лестнице, ну, следующий кат, я уже поднялся по лестнице. А, да, как-то ключ странно достаю. Вот здесь сейчас будет странный кат такой, непонятно зачем, но
06:24
Speaker A
в версии, где всё подробно описано, а потерялась динамика, та, что была в коротком промте. Здесь я тоже нелогично забегаю с улицы в коридор, бегу по этому же коридору, поднимаюсь по лестнице и уже выбегаю на крышу. То есть всё-таки с
06:39
Speaker A
большим длинным промтом, э, я так подозреваю, что накапливаются какие-то ошибки, и нейронке сложно. Но самое главное и интересное, что мы узнали, если написать 10 000 символов, нейронка не остановится где-то на трёхтысячном символе и дальше как бы генерация не пойдёт и всё обрубится. То есть она
06:58
Speaker A
понимает такие запросы. Но вопрос, подтверждает ли это миф? Я бы сказал, что не совсем. То есть это не совсем миф. Это как техническое требование. И промт нужно писать развёрнуто, но не 10 000 символов для такой сцены. То есть здесь перебор с расписыванием. Прямо
07:16
Speaker A
тысяча раз повторяется одно и то же. Из-за того, что это одно и то же уточняется и повторяется, у нейронки как раз-таки возникли проблемы, как мне кажется. То есть, по сути, пишите подробно по сценам, вот по секундам то, что правильно здесь расписано, да? А и
07:34
Speaker A
этого будет более чем достаточно. Но чем длиннее промт, тем лучше? Нет, дело не в длине. И мы плавно подошли к мифу про повторение или уточнение или что негативный промт может путать Сиднс и увеличивать количество ошибок.
07:51
Speaker A
Например, вы генерируете гонки на трассе, и все машины должны быть красными. И вы пишете: "Никаких синих и белых машин". И есть шанс, что нейронка их добавит, потому что она прочитала, что есть синие или белые машины. При этом, например,
08:06
Speaker A
Клинк наоборот обожает негативные промты. У него даже есть отдельное поле для этого, в то время как у Сиденса такого поля нет. Поэтому проверим сами.
08:14
Speaker A
Создадим два видео с одним промтом. А один будет промт, вот который вы сейчас видите. Три гоночные машины едут по трассе, и во второй промт мы добавим негативные формулировки. Посмотрим, что получилось в первом.
08:43
Speaker A
Ну, в целом вышла нормальная генерация, такая ламповая, тёплая, без каких-то косяков особых. Давайте пропишем такой же промт, но уже добавим сюда часть с негативным промтом. То есть никаких белых машин, никакого блюра, никаких мм каких-то изменений позиций машины, каких-то дисторсий, искажений и тому
09:03
Speaker A
подобное. И смотрим, что у нас получилось. Ну, здесь мне понравилось, что цвета у машин какие-то более насыщенные, но в самом начале вот эти фары, какие-то странные фары. Во-первых, они как будто просто машины прозрачные, то есть уже есть какие-то искажения. И красные фары,
09:33
Speaker A
они как блюр. Очень странно, поскольку мы проверяем миг всё-таки, а не делаем тест нейронки, хотя это, по сути, есть тест. Я сделал генерации ещё раз. И давайте посмотрим, получился ли такой же результат без негативного промта.
10:03
Speaker A
Ну, в целом результат вышел реально аналогичный. Теперь давайте попробуем ещё раз с негативным промтом.
10:23
Speaker A
Ну, был какой-то странный вот этот момент. Вот здесь машина как будто оп, камера дёрнулась. То есть какая-то дисторсия произошла, и вот эта машина как-то плывёт. Ладно, сама генерация, в принципе, как и у предыдущего промта, не идеальна. Но здесь реально есть вот
10:38
Speaker A
огрехи. Опять-таки сзади фары, которые как в блюре в таком. Зачем он их добавил? То есть как будто бы реально негативный промт усложняет работу. В общем, частично это...
10:53
Speaker A
Лучше писать позитивные утверждения, что вот, например, как здесь у нас прописано, что а три машины должны быть красными фиолетовыми и зелёными. И это автоматически означает, что никаких белых машин быть не должно, потому что у нас есть чёткие три цвета. Или если хотите, чтобы
11:11
Speaker A
картинка была резкой, не нужно писать: "Не делай никакого блюра, не делай дисторсии". Делай, ну, нужно писать: "Делай картинку яркой и чёткой, резкой".
11:21
Speaker A
То есть негативные формулировки, они на самом деле не очень работают. Это правда. А вот и скидка в 15% на подписку для новых пользователей. Используйте Sidens 2.5 и кучу других нейросетей в одном месте быстро и удобно. Просто активируйте промокод при оформлении
11:37
Speaker A
подписки. Следующий миф - миф о том, что SDНс помнит прошлые генерации внутри одного диалога и может использовать их в следующих видео. В документации BY Dance упоминается про кэш и менеджмент контекста, но это просто общие механизмы по работе с загруженными файлами и в
11:56
Speaker A
целом с историей запросов. То есть это просто оптимизация, а не доказательство того, что Sens помнит ролики, которые вы сделали, или обучается на них прямо во время вашего диалога. И это надо протестировать. Собственно, как будет происходить тест. Я загрузил свою карту
12:12
Speaker A
персонажа и уже сделал несколько генераций с таким вот простеньким промтом, где указал обязательные конкретные вещи. То есть должен быть фиолетовый кейс, зелёный телефон, серебряная лошадь и вот такая вот надпись Зебра 741. Я сделал генерацию несколько раз, и давайте сразу их все
12:32
Speaker A
посмотрим. То есть на этих генерациях мы видим фиолетовый кейс, внутри мы видим лошадь серебряную, телефон звонит. зелёный телефон и надпись.
12:54
Speaker A
На двух генерациях мы видим правильную надпись. О'кей, мы сделали это. Давайте попробуем слегка изменённый промт уже без этих предметов.
13:14
Speaker A
И как вы видите, а вы не видите ни зелёного телефона, ни других предметов из прошлой генерации.
13:23
Speaker A
Теперь давайте в этом же диалоговом окне чате сделаем совершенно другой промт. Ну, из всех предыдущих генераций здесь только я, потому что я себя указал как карту персонажа, и ничего другого не повторяется. В общем, никаких сторонних предметов из предыдущих генераций в этих
13:50
Speaker A
генерациях я не наблюдаю, так что миф полностью развен. Во всяком случае, в синтаксе такого не наблюдается.
13:57
Speaker A
Следующий миф. Если написать в запросе, что видео снято на камеру из нулевых, то картинка станет реалистичней, лица станут менее пластиковыми. И у этой теории есть логика. Sedнит стиль и движение камеры. Это подтверждает даже сама Bйднce. А камера нулевых означает
14:13
Speaker A
мягкую резкость, цифровой шум, естественный смаз и небольшие движения оператора. То есть эти несовершенства могут скрыть пластиковость нейросети.
14:21
Speaker A
Давайте проверим. И снова берём мою карту персонажа, прописываем простой промт без упоминания камеры из начала нулевых. И смотрим, что у меня получилось.
14:41
Speaker A
То есть, по сути, я сделал портретный кадр вначале, потом я иду в полный рост и просто ухожу. Ну, выглядит реалистично. Sedens 2.5 всё-таки реально классно делает уже. Итак, давайте теперь добавим сюда вот такое вот упоминание, что весь всё видео снято на камеру начало
15:02
Speaker A
нулевых, такой мини DV Concorder снизу. Потом это тоже немножко упоминается. И смотрим. В целом, что первая генерация, что эта генерация мне нравится, потому что Sedens 2.5 делает прямо супер классно. И вот это небольшое добавление, то, что снято на камеру из начала нулевых, я
15:31
Speaker A
вижу, что картинка стала приятней. Ну, приятней по моим вкусовым предпочтениям. То есть она стала такой как ретровой, немножко грязнее, плавнее. Аа, но это прямо не улучшает видео, как мы хотели проверить. То есть это не стало реалистичней и не стало прямо менее
15:51
Speaker A
пластиковой, что ли, потому что Sed 2.5 и так классно генерит. Поэтому, вероятно, это было актуально для Sed 2.0. Для SDS 2.5 это не актуально, потому что он и так отлично справляется.
16:04
Speaker A
Но добавление такого кусочка промта - это отличный стилистический приём. И последний миф на сегодня. Sed 2.5 лучше понимает запросы на китайском языке, чем на английском. Проверим это на практике.
16:16
Speaker A
Возьмём одну и ту же экшн-сцену и создадим два промта: на английском и на китайском языке. Собственно, по классике берём мою карту персонажа и прописываю вот такой вот промт, где много разных вещей, то есть, что я должен держать в
16:31
Speaker A
правой руке, в левой, что нейронки, как бы чуть сложнее понять. И вот какой вышла генерация с использованием английского. Так, я бегу слева направо.
16:40
Speaker A
Правильно. Сейчас я должен взять правой рукой молоток. Всё правильно. Уронил ту тележку с инструментами, перепрыгнул бочку, разбил, нажал на кнопку, дверь начинает открываться. Опять какие-то искры добавил. Я влетаю. В целом, он всё сделал правильно. О'кей. Ну, понятное дело, этот промт какой-то вообще
16:59
Speaker A
странный. Зачем его использовать? Но тут много сложных моментов. Давайте посмотрим, как справилась китайская версия. Вот тут китайский промто прописан. Он, кстати, как будто занимает меньше символов. Ну ладно, смотрим. Так, во-первых, здесь я не сразу бегу слева направо, беру молоток в правую руку. Всё
17:18
Speaker A
правильно. Бегу дальше, перепрыгиваю бочку. Хорошо. Разбиваю окошко. Что я зачем-то нажимаю на кнопку, э, зачем я разбил тогда? Ну, пока что проверку он не проходит. Давайте ещё раз сделаем генерацию на английском. Я бегу слева направо, снова, правильно, беру в
17:39
Speaker A
правую руку, опрокидываю ящик с инструментами, прыгиваю через бочку. Всё правильно. Разбиваю кнопку. Нажимаю. Кстати, дверь открывается раньше, чем я нажал на кнопку. Плохо.
17:53
Speaker A
О'кей. Что нам даёт китайская версия? Я опять не бегу слева направо. Я бегу прямо, беру правой рукой, хорошо прокидываю инструменты, перепрыгиваю через бочку. Ну, разбиваю, наконец-то, и молотком нажимаю. Зачем?
18:10
Speaker A
Почему я молотком нажимаю? Оба промта сработали примерно одинаково. Заметного преимущества в китайском языке я не увидел. И похоже, что сиденс-то в целом, как и любой другой нейронки, важнее не язык, а сама структура. Правильное расположение объектов, то есть последовательность действий, тайминг и
18:27
Speaker A
прочее, прочее, прочее, что присуще хорошего промтаса. Конечно, один тест не даёт окончательного ответа, но миф о секретном преимуществе китайского языка здесь не подтверждается. На сегодня это были семь мифов про Seенs. Я знаю ещё несколько, а может быть, вы сами знаете
18:46
Speaker A
какие-нибудь. Так что пишите их в комментариях, и, может быть, тогда выйдет вторая часть с проверкой мифов. А теперь итоги конкурса. Победители прошлого выпуска у вас на экране. Если вы себя увидели, то пишите в нашу службу заботы, чтобы забрать свой приз. А мы,
19:00
Speaker A
как обычно, начинаем новый конкурс на 3V подписки в Синтакс. Нужно выполнить всего три простых шага: подписаться на канал, поставить лайк этому видео и написать ответ на вопрос в комментариях.
19:11
Speaker A
Какой из мифов этого выпуска вам пригодится больше всего и для чего? побеждают самые интересные ответы, а результаты уже в следующем выпуске. С вами был Артур. Всем пока.
Topics:Sedance 2.5промптыэмодзиобход цензурыдлинный промтнегативный промтИИ генерация видеокитайский языктест мифовискусственный интеллект

Get More with the SozAI App

Transcribe recordings, audio files, and YouTube videos — with AI summaries, speaker detection, and unlimited transcriptions.

Or transcribe another YouTube video here →