PromtStudio

PromtStudio

ТГ: @promtgs
На Пикабу
23К рейтинг 119 подписчиков 8 подписок 633 поста 28 в горячем

Причина по которой «Последний богатырь. Колобок» провалился в прокате


Автор видео: lyckitysplit

Подобное видео можно сделать с помощью seedance 2.0, Kling 3.0 или Veo 3.1

➡️ Все лучшие нейросети тут: TG | MAX

➡️ Обучение и Промты: TG | MAX

Показать полностью
5

Прогнал 10 промптов через MiniMax H3 и проверил, умеет ли она в кириллицу

Прогнал 10 промптов через MiniMax H3 и проверил, умеет ли она в кириллицу

Есть подборка из десяти профессиональных промптов под видеомодель MiniMax H3, каждый заточен под свою задачу: кинематографичный кадр, тизер по таймкодам, переход между двумя кадрами, инфлюенсер с зафиксированным лицом, перенос движения, товарка со звуком, титр с точным текстом, замена предмета в готовом ролике, демонстрация интерфейса и большой брифинг сразу с пятью референсами.

Я перевёл все десять на русский и прогнал через модель. Не выборочно, а все, по очереди, с реальными референсами, которые пришлось генерировать отдельно. Ниже что получилось, где модель попала, где промахнулась и на какие грабли я наступил по дороге.

Все ролики ниже - мои генерации, звук у них родной, модель пишет его сама вместе с картинкой. Гонял через наш агрегатор.

Сразу главный вопрос: работает ли кириллица

Это первое, что интересует любого, кто пишет по-русски. Все зарубежные обзоры проверяют текст в кадре на латинице и хвалят. А что с нашими буквами?

Проверял двумя промптами. В первом нужно было вывести титр «НАЙДИ СВОЙ ПУТЬ» на фоне горного гребня.

Создай 8-секундное раскрытие титра для премиальной кампании об активном отдыхе. [0-3с] Чёрный треккинговый ботинок ступает на мокрый сланец в туманном горном перевале; близкий низкий ракурс, звук дождя и протектора по камню. [3-6с] Камера поднимается вслед за ботинком, туман расходится и открывает широкий горный гребень на рассвете. [6-8с] По центру кадра появляется точный титр «НАЙДИ СВОЙ ПУТЬ» чистыми белыми прописными буквами на фоне тёмного гребня, затем замирает неподвижно. Выведи только этот титр и только эти три слова. Никакого другого текста, без опечаток, без логотипов, без лишних букв, без субтитров. Сдержанная кинематографическая цветокоррекция, 16:9.

Модель отрисовала титр чисто: правильные буквы, ровный кернинг, без лишних символов, титр держится неподвижно все финальные секунды.

Во втором был интерфейс игрового инвентаря с тремя подписями: «КАРТА», «СНАРЯЖЕНИЕ» и «КОМПАС».

Создай 10-секундный ролик-демонстрацию продукта в формате 16:9 для вымышленной стратегической игры: интерфейс инвентаря. [0-3с] Курсор открывает тёмно-серую панель снаряжения с тремя чётко разделёнными ячейками предметов; тихие щелчки интерфейса. [3-7с] Курсор перетаскивает бронзовый компас из левой ячейки в центральную; центральная ячейка получает мягкую синюю подсветку контура. [7-10с] Панель закрывается, открывая чистый внутриигровой вид: путник держит бронзовый компас на закате. Подписи интерфейса выведи точно так: «КАРТА», «СНАРЯЖЕНИЕ», «КОМПАС». Без лишних меню, без нечитаемого текста, без перекрывающихся панелей, без рук на клавиатуре. Контролируемая камера как при записи экрана, чёткие края интерфейса, сдержанное движение.

Все три подписи отрисованы верно. Но тут же вылезла проблема. В кадре была четвёртая, незаданная ячейка, и модель заполнила её сама - получилось «КОУЕННОВСИРИМ», набор букв, похожий на слово, но бессмысленный. Вывод: H3 отлично рисует ту кириллицу, которую вы явно прописали, и сочиняет ерунду там, где вы промолчали. Перечисляйте каждую видимую надпись, а остальное запрещайте отдельной строкой.

Ещё наблюдение: описание сцены модель прекрасно понимает по-русски. Ни один из десяти промптов не пришлось переводить обратно на английский.

Тайминги в промпте работают буквально

Формат, где сцена расписана по секундам, оказался самым надёжным приёмом подборки.

Создай 12-секундный тизер оригинального научно-фантастического триллера. [0-3с] Сверхкрупный план: рука в перчатке смахивает иней с треснувшего иллюминатора космического корабля; начинается низкий электрический гул. [3-7с] Резкая склейка на общий план интерьера: тот же астронавт стоит один в тёмной обзорной палубе, по помещению проходит красный аварийный свет; медленный наезд камеры вперёд. [7-10с] Резкая склейка на иллюминатор: огромный безмолвный объект проплывает за стеклом, заслоняя звёзды. [10-12с] Уход в чёрное. Один глубокий удар, затем тишина. Без читаемого текста, без логотипов, без комедии, без лишних членов экипажа. Высококонтрастный практический свет, кинематографический 21:9.

Детектор смены планов нашёл в готовом ролике ровно одну жёсткую склейку - на отметке 3,0 секунды. Именно там, где я её и просил. При этом содержание внутри куска модель трактует вольнее: огромный объект, который должен был проплыть за стеклом, толком не появился. Тайминг железный, наполнение творческое.

Базовый кадр без референсов

С этого промпта я начинал - проверить, тянет ли модель обычную режиссёрскую задачу без вложений.

Одинокий веломеханик закрывает узкую мастерскую в синий час. Один непрерывный кадр на 8 секунд: начинаем средне-общим планом от дверного проёма, механик опускает металлическую штору, затем медленный наезд камеры, тёплый свет ламп накаливания разливается по разбросанному инструменту и мокрому асфальту снаружи. Механик замирает, смотрит на улицу и выключает лампу над верстаком. Естественный шум дождя, шорох шин по мокрому асфальту вдалеке, один мягкий лязг шторы, без диалогов, без субтитров, без логотипов, без посторонних людей. Приземлённая современная драма, сдержанная холодно-синяя и янтарная палитра, реалистичные материалы, 16:9.

Мастерская, синий час, мокрый асфальт, тёплый свет ламп внутри против холодного снаружи, медленный наезд. Одна непрерывная сцена, ни одной лишней склейки.

Переход между двумя кадрами

Третий промпт строится на приёме, где начальный и конечный кадры заданы жёстко, а модель придумывает середину. Я сгенерировал два кадра: женщина в ярко-жёлтом пальто в вагоне метро и залитая солнцем песчаная дюна сверху.

Используй первый кадр как открывающую композицию, а последний кадр как обязательную финальную композицию. Создай 7-секундный переход: камера с рук на 35 мм следует за женщиной в ярко-жёлтом пальто, идущей по переполненному вагону метро. Когда двери закрываются, свет в салоне один раз мигает; камера наезжает на жёлтое пальто, пока кадр не заполняется жёлтой тканью. Продолжи движение в финальный кадр, где жёлтая ткань превратилась в залитую солнцем песчаную дюну, снятую сверху. Перенеси грохот поезда в звук сухого ветра. Сохрани движение героини вперёд. Без текста, без логотипов, без лишних склеек.

Модель наехала на пальто, пока жёлтая ткань не заполнила экран, и вывела из неё дюну. Фактура ворса в момент перехода рифмуется с рябью песка. Приём рабочий, но требует, чтобы у двух кадров было что-то общее - здесь общим был цвет и форма изгиба.

Референсное лицо действительно держится

Отдельно генерировал портрет девушки-блогера и отдавал его модели как источник внешности, а голос - отдельным аудиофайлом.

Используй Изображение 1 только для лица, волос, пропорций тела и внешности героини. Используй Аудио 1 только для её говорящего голоса и вокального характера. Создай 10-секундный вертикальный ролик автора в светлой домашней студии: героиня протягивает к камере небольшой блокнот для эскизов, улыбается и произносит: «Три эскиза, одна ясная идея». Начни со среднего плана, затем сделай мягкий шаг камерой ближе, пока блокнот входит в передний план. Мягкий свет из окна, достоверный шум комнаты, лёгкое движение бумаги, естественная синхронизация губ. Сохраняй внешность с Изображения 1 на всём ролике. Не меняй голос, не добавляй субтитры, не добавляй других людей, 9:16.

В готовом ролике та же героиня: те же веснушки, та же причёска, тот же светлый свитер. Камера делает шаг ближе, блокнот входит в передний план, лицо не поплыло ни на одном кадре.

Перенос движения с чужого видео

Пятый промпт просит взять движение камеры из одного видео, а внешность исполнителя из фотографии. Пришлось сначала снять сам референс движения - короткий круговой объезд пустой репетиционной комнаты.

Используй Видео 1 только для движения камеры и ритма тела: повтори его низкий круговой объезд. Используй Изображение 1 только для внешности исполнителя, одежды и черт лица. Создай 9-секундный клип музыкального выступления в пустой бетонной репетиционной комнате. Исполнитель начинает спиной к камере, один раз поворачивается в такт и заканчивает лицом к камере, не меняя внешности и костюма. Один непрерывный круговой проезд камеры, боковой свет через высокие окна, пыль в воздухе, скупой электронный бит и звук скольжения обуви. Без толпы, без зеркал, без текста, без смены костюма, 16:9.

Исполнитель начинает спиной к камере, разворачивается и заканчивает лицом, а камера всё это время идёт по дуге. Костюм и комната не изменились. Два источника, две разные роли, и они не подрались между собой.

Товарка со звуком

Здесь важен не столько кадр, сколько то, что модель пишет физические звуки предмета сама.

Создай 9-секундный вертикальный ролик-раскрытие товара: матовая кобальтово-синяя термобутылка на чёрной каменной столешнице. [0-2с] Капли конденсата скатываются по бутылке почти в тишине; макро-движение камеры от крышки к корпусу без логотипов. [2-6с] Рука поднимает бутылку, откручивает крышку и наливает газированную воду в прозрачный стакан; крупным стереозвуком передай щелчок крышки, шипение пузырьков и звук льющейся воды. [6-9с] Рука ставит бутылку рядом с наполненным стаканом, утренний свет даёт чистый контурный блик. Минималистичная тёмная кухня, резкий фокус на товаре, реалистичные вода и металл, без названия бренда, без этикеток, без закадрового голоса, 9:16.

Щелчок крышки, шипение пузырьков, звук льющейся воды - всё в одной генерации, отдельного этапа озвучки нет. Единственный прокол: стакан между планами поменял форму с низкого на высокий.

Лучший результат подборки: замена предмета

Восьмой промпт мне понравился больше всех, потому что его проще всего проверить. Сначала я сгенерировал исходник: мужчина в тёмном пальто идёт по мокрой вечерней улице с красным зонтом. Потом отдал этот ролик модели с задачей поменять только зонт на прозрачный.

Используя загруженное видео, сохрани оригинальное движение камеры, актёра, направление света, фон, кадрирование, цветокоррекцию, звуковую подложку и тайминг. Измени только красный зонт в руке актёра на прозрачный зонт с видимыми каплями дождя и реалистичными бликами по краю. Сохрани хват руки, темп ходьбы, тень и положение зонта без изменений. Не меняй лицо актёра, пальто, улицу, силу дождя, витрины и любой уже присутствующий текст. Замена должна следовать оригинальному движению на протяжении всего ролика.

Сравнил кадры попарно. Актёр тот же, пальто то же, походка та же, витрины на тех же местах, отражения на асфальте те же, движение камеры не сбилось. Поменялся ровно один предмет. Для правок готового материала это очень практичная штука: не надо переснимать сцену целиком из-за одной детали.

Максимальный брифинг: пять референсов сразу

Последний промпт - самый сложный. Лицо с одной картинки, ветровка со второй, кроссовки с третьей, движение камеры с видео, голос с аудио. Плюс три куска по таймкодам.

Используй Изображение 1 только для лица, волос, пропорций тела и внешности спортсмена. Используй Изображения 2 и 3 только для кобальтовой беговой ветровки, кроссовок и деталей продукта. Используй Видео 1 только для низкого бокового движения камеры вдоль героя. Используй Аудио 1 только для дыхания бегуна и произнесённой реплики «Не останавливайся». [0-4с] Едем сбоку рядом со спортсменом, бегущим в одиночку по мокрому городскому мосту перед рассветом; сохрани низкое боковое движение камеры из Видео 1. [4-8с] Переходим на крупный профиль, спортсмен произносит «Не останавливайся», попадая в Аудио 1. [8-12с] Склейка на кроссовок, приземляющийся в мелкую лужу, затем возврат к спортсмену, бегущему в бледный утренний свет. Изображения 2 и 3 использовать только для точной передачи одежды и обуви. Сохраняй внешность с Изображения 1. Мокрые шаги, контролируемое дыхание, далёкий шум транспорта, без логотипов, без других бегунов, без лишних реплик, без текста.

Роли между файлами модель не перепутала: спортсмен с нужным лицом бежит в нужной ветровке и в нужных кроссовках. Склейки встали на 4,08, 8,08 и 10,08 секунды - ровно по заданной сетке.

На какие грабли я наступил

Первое. Загрузка референсов - это не просто «прикрепить файл». Каждому файлу нужно явно указывать тип: картинка, видео или аудио. Пока я слал всё одним типом, генерации с видео и звуком падали с невнятной ошибкой, а деньги возвращались на баланс. Как только тип начал проставляться правильно, всё заработало с первого раза.

Второе. У аудио-референса жёсткие границы длительности: от двух до пятнадцати секунд. Моя реплика «Не останавливайся» вышла короче - 1,07 секунды, и модель отказалась работать. Лечится добавлением тишины в конец файла.

Третье. Ролики отдаются на двадцати четырёх кадрах в секунду, и это константа, а не настройка. В стандартном качестве горизонтальный кадр выходит 1344 на 768, вертикальный - 768 на 1344, сверхширокий - 1536 на 672. Звуковая дорожка есть у всех десяти роликов без исключения.

Что в итоге

Десять роликов, суммарно около полутора минут готового материала. Склейки внутри одной генерации встречаются там, где я их заказывал таймкодами, и не появляются там, где просил непрерывный кадр - в семи роликах из десяти детектор не нашёл ни одной лишней склейки. Ни одна генерация не потребовала больше одной попытки после того, как я починил загрузку референсов.

Если делаете короткие ролики для соцсетей, товарку или превью, самые полезные приёмы отсюда - замена предмета в готовом кадре, фиксация лица по фотографии и раскладка сцены по таймкодам. Эти три вещи работают предсказуемо и экономят пересъёмку.

Если нужен текст в кадре на русском - он получится, но перечисляйте каждую надпись явно и отдельной строкой запрещайте всё остальное. Иначе модель допишет своё.

А какой из приёмов кажется вам самым полезным? И что бы вы прогнали через модель первым делом - напишите, интересно сравнить.

Модель в боте: TG | MAX

Разборы моделей и промпты: TG | MAX

Показать полностью 9
2

Слили кадры со свадьбы Зендеи и Тома Холланда


Скромненько посидели, карри поели, масалы попили да и разошлись.

Подобное видео можно сделать с помощью seedance 2.0, Kling 3.0 или Veo 3.1

➡️ Все лучшие нейросети тут: TG | MAX

➡️ Обучение и Промты: TG | MAX

Показать полностью
4

Seedance 2.5: нейросеть снимает полминуты одним куском. И половина обзоров про неё врёт

Короткая история про то, как ByteDance выкатил Seedance 2.5, весь интернет хором написал «4K!», а 4K там нет. Ну и заодно про то, что модель реально умеет, потому что умеет она немало.

Сначала про то, почему это вообще новость

Все нейросети для видео до сих пор жили в одном и том же режиме: дай мне промпт, я тебе выдам четыре секунды. Ну восемь. Ну пятнадцать, если очень повезёт.

Дальше начинается ад. Хочешь ролик на полминуты - генеришь шесть кусков и склеиваешь. А на каждом стыке у героя чуть-чуть меняется лицо. Или свет. Или куртка была кожаная, а стала замшевая. И ты сидишь и придумываешь, как это спрятать: то перебивку воткнёшь, то затемнение, то просто смиришься.

Seedance 2.5 генерит тридцать секунд одним непрерывным куском. Склеивать нечего. Швов нет, потому что их физически неоткуда взять.

Официальное демо ByteDance: 30,042 секунды одним дублем. Герой в чёрном пальто проходит шесть комнат, и каждая сделана в своём стиле - фетровая анимация, монохром, подводный мир, фейерверки.

Ночной неоновый город под дождём, толпа с зонтами, в финале крупный план андроида. Тридцать секунд, одна генерация, камера не прерывается.

Два ролика выше стоит досмотреть до конца. В первом мужик в чёрном пальто идёт через шесть комнат подряд, и каждая в своём стиле: то фетровая анимация как в детском мультике, то чёрно-белая тоска, то вообще под водой, то фейерверки. Во втором - ночной город под дождём, куча людей в кадре, отражения в лужах, и камера ни разу не режется. Раньше такое собирали из шести кусков и потом неделю прятали стыки.

Сразу отвечу на вопрос, который обычно задают в комментариях: «а где потрогать?». Seedance 2.5 уже стоит в агрегаторе Cyber AI - всё на русском, без VPN и без регистрации на китайских сайтах. По цене генерации это сейчас самый доступный вариант из тех, что работают в России.

Потыкать: Telegram | MAX

А теперь по существу.

Теперь про враньё

Открываете любой обзор на английском - там написано «нативный 4K». Кое-где даже «10-битный цвет», для солидности.

Так вот. Никакого 4K в 2.5 не заявлено. Вообще.

Как получилось. На той же конференции, на той же сцене, минут через пять после анонса 2.5 ByteDance объявил апгрейд предыдущей версии, Seedance 2.0, до 4K. Две новости слиплись в голове у журналистов, характеристика переехала не туда, и дальше её начали переписывать друг у друга.

Проверить элементарно: в официальном посте про 2.5 про разрешение нет ни слова, на странице продукта тоже. Зато рядом отдельно висит страница «Seedance 2.0 4K».

А что на практике? Ребята, которые уже снимали на 2.5, получали 720p и потом догоняли апскейлером. Где-то доступны 480p и 720p.

Так что если вам критично 4K - вам нужна старая версия, не новая. Звучит абсурдно, но так и есть.

Что там реально классного

Пятьдесят референсов за раз. Тридцать фоток, десять видео, десять аудио. Раньше было девять картинок и по три видео и звука.

Зачем столько. Тридцати фотографий хватает, чтобы показать модели персонажа со всех сторон, зафиксировать форму предмета, задать цвета и показать локацию. И она всё это удержит.

Один чувак снял на 2.5 короткометражку на две с половиной минуты, используя всего три картинки: два портрета героев и один кадр бара. Всё. Никаких многостраничных описаний персонажей.

А потом ради интереса скормил модели целый гардероб одного героя и попросил менять одежду прямо внутри одной генерации. Герой остался узнаваемым во всех шмотках.

Встреча в аэропорту: тридцать секунд эмоций и мимики без единой склейки. Именно на таких сценах длинный дубль даёт больше всего.

Правка вместо перегенерации. Раньше любая правка означала «генерим заново и молимся». Теперь можно ткнуть в конкретную секунду ролика и поменять только её. Или заменить фон. Или пересобрать ракурс уже готового дубля.

Трёхмерная болванка для камеры. Это уже для тех, кто в теме: можно подсунуть модели серую нетекстурированную геометрию из 3D-редактора, и она поймёт, откуда и куда должна ехать камера. То есть проезд задаётся точно, а не «ну авось само красиво получится».

Реклама напитка, двадцать девять секунд. Действия и звук привязаны к таймкодам: пустыня, находка бутылки, нарастание, финал с брендом.

Солдат в окопе смотрит на фотографию. Крупный план держится всю сцену, лицо не разъезжается - традиционно слабое место видеомоделей.

В рекламе напитка выше всё расписано по секундам: тут пустыня, тут находим бутылку, тут нарастает, тут финал с логотипом. Это уже не «нейросеть что-то нафантазировала», это раскадровка. А ролик с солдатом - проверка на другое: крупный план человеческого лица держится всю сцену и не превращается в кашу. Ещё год назад это было главной болью всех видеогенераторов.

Что бесит

Честно, косяков хватает.

Персонажи плывут в экшене. В быстрых сценах модель может начать разъезжаться: геометрия дрожит, лицо превращается непонятно во что. Причём не весь ролик, а кусками. Апскейлер это не чинит никак, проверено. Правда, у прошлой версии было ровно то же самое, и потом починили патчами, так что есть надежда.

Голоса модель придумывает сама. Если вы дали фотку персонажа и не сказали, как он говорит, модель посмотрит на лицо и решит за вас. У одного тестера герой без всяких указаний заговорил с британским акцентом. Написал в промпте «American» - исправилось. Написал «American English» - опять британец, потому что слово English тянет её обратно. Вот такая логика.

Старые промпты не работают. То, что отлично генерилось на 2.0, на 2.5 может выдать кашу. И ещё модель не любит, когда в тридцать секунд запихивают монтаж из односекундных нарезок. Ей надо дать сцене подышать.

Ещё она говорит на восьми языках

Липсинк заявлен для восьми с лишним языков. В официальном демо вокалист на пляже здоровается на разных языках подряд, и губы попадают в звук. Не идеально, но попадают.

А вот ролик посложнее по картинке: там не про речь, а про то, сколько всего творится в кадре одновременно и как оно держится все тридцать секунд.

Кухня ресторана: открытый огонь, движение на заднем плане, шеф собирает блюдо. Сложная сцена с несколькими людьми в кадре.

И да, там же есть бета-режим на сто восемьдесят секунд. Три минуты одной генерацией. Пока сырой, но существует.

Как попробовать, не воюя с китайскими сайтами

Официально Seedance 2.5 живёт на китайских площадках и в международном приложении CapCut. Регистрация, свои правила, доступ не отовсюду - в общем, приключение.

Проще через агрегатор Cyber AI: это бот, где генеративные модели собраны в одном месте и всё на русском. Заходите, выбираете модель, пишете, что хотите. Никаких отдельных аккаунтов на каждый сервис. И генерация там сейчас дешевле, чем в любом другом доступном у нас варианте.

Потыкать: Telegram | MAX

Если лень придумывать промпт - готовые лежат на promptstudio.tools, берёте и подставляете своё.

Короче

Тридцать секунд одним дублем - это правда и это реально круто. Пятьдесят референсов - правда и это круче, чем длина. Правка по таймкоду - правда. 4K - нет, это от соседней модели. Стабильность в экшене - пока лотерея.

Стадия сейчас такая: «очень интересно и очень сыро». Самое время потрогать руками, пока все спорят в комментариях.

Показать полностью 6
9

Самое актуальное противостояние на сегодняшний день:


Автор видео: neurodad_neurobatya

Подобное видео можно сделать с помощью seedance 2.0, Kling 3.0 или Veo 3.1

➡️ Все лучшие нейросети тут: TG | MAX

➡️ Обучение и Промты: TG | MAX

Показать полностью
1796

Парень попросил поменять ему костюм на что-то попроще, и ему предложили идеальный вариант

Подобную обработку можно сделать с помощью Nana Banana Pro меньше чем за минуту!

➡️ Все лучшие нейросети тут: TG | MAX

➡️ Обучение и Промты: TG | MAX

Показать полностью 2
0

Где брать готовые промпты для нейросетей и как научиться писать свои

Типичный первый заход в нейросеть выглядит так: человек пишет «нарисуй красивую девушку», получает пластиковое нечто с шестью пальцами и делает вывод, что нейросети переоценены. Проблема не в модели, а в задании. И начинать надо не с курсов по промпт-инжинирингу, а с чужих рабочих промптов - берёшь готовый, меняешь под себя и попутно понимаешь, как он устроен.

Ниже разбираю, где эти промпты искать и как пользоваться галереей promptstudio.tools, которую мы для этого и собрали.

Четыре места, где новички берут промпты

Телеграм-каналы и соцсети. Промптов много, качество скачет, а через неделю нужный пост уже не найти в ленте. Как основной источник неудобно.

Статьи-подборки «20 лучших промптов». Читать приятно, повторить сложно: примеров результата обычно нет, а половина промптов написана под модель, которой уже год как нет.

Попросить нейросеть написать промпт за вас. Работает, но у новичка нет насмотренности - он не может оценить, хороший промпт ему выдали или пустой. Приём полезный, но вторым шагом, а не первым.

Галереи промптов. Главное отличие: сначала вы видите результат, а потом забираете текст, которым он сделан. Не нравится картинка - не тратите время. Ниже как раз про такой каталог.

Что внутри галереи

Сайт устроен как лента работ: у каждой карточки есть картинка или видео, полный промпт и указание, в какой нейросети это сделано. Слева панель фильтров, сверху поиск по промптам, тегам и авторам.

Разделы, которые пригодятся сразу:

• Тип работы - фото или видео;

• Модель - выбор нейросети;

• Категории - реклама и товары, портреты, арт, мода, еда, интерьер, дети, открытки и другие;

• Теги - реализм, кинематографичный, минимализм, постер, логотип и ещё несколько сотен;

• Сортировка - рекомендуемые, новые, по просмотрам, за 30 дней или за всё время;

• Избранное и История - куда складывать понравившееся, чтобы не искать заново.

Шаг 1. Отфильтруйте под свою нейросеть

Частая ошибка новичка: взять промпт с приписками вроде --ar 16:9 --stylize 1000 и вставить в другую нейросеть. Это команды Midjourney, в остальных моделях они просто мусор в тексте. Поэтому первым делом откройте фильтр «Модель» и выберите ту, которой пользуетесь.

Фото и видео разделены: сверху модели для картинок, ниже для роликов. Дальше сужайте категорией - например, «Реклама и товары», если делаете карточку для маркетплейса.

Шаг 2. Заберите промпт из карточки

Клик по работе открывает карточку. Здесь всё, что нужно: сама работа, автор, блок «Промпты» с пометкой для фото или для видео, название нейросети и полный текст задания.

Две кнопки рядом с промптом решают всё. «Скопировать» кладёт текст в буфер целиком, «Перевести» показывает русскую версию, если промпт написан по-английски. Ниже теги - по ним удобно проваливаться в похожие работы, и блок «Похожие работы» под карточкой.

Обратите внимание на квадратные скобки в промпте, вроде [SUBJECT] или [СТРАНА]. Это заглушка: автор оставил место, куда подставляют своё слово. С неё и стоит начинать - понимать весь текст для первого результата не обязательно.

Шаг 3. Поменяйте под себя

Дальше начинается собственно обучение. Любой рабочий промпт - конструктор из нескольких блоков:

• объект - кто или что в кадре;

• стиль - фотореализм, 3D, плакат, инфографика;

• свет - мягкий, контровой, один луч, неон;

• камера - объектив, ракурс, глубина резкости;

• формат - пропорции, требования к надписям в кадре.

Меняйте по одному блоку за раз, иначе не поймёте, что дало результат. Три примера ниже - это промпты, взятые из галереи и переделанные мной под русскую задачу.

Промпт 3D-путеводителя написан с заглушкой [СТРАНА]. Я подставил Италию и дописал требование делать надписи кириллицей - получился постер с русскими названиями городов. Тот же текст выдаст путеводитель по Японии или по Алтаю, меняется одно слово.

Второй промпт - техническая инфографика с заглушкой [ОБЪЕКТ]. Взял смартфон, подписи перевёл на русский. Автор промпта заранее задал систему цветов: красная стрелка про питание, синяя про связь, оранжевая про процессор, зелёная про датчики. Такие правила и есть самое ценное в чужих промптах - их переносят в свои задачи целиком.

Третий пример написан как анкета: тип изображения, блюдо, список парящих ингредиентов, фон, композиция. Нейросети такую структуру читают отлично. Заменил индонезийское блюдо на пельмени, перечислил свои ингредиенты - остальное сработало без правок.

Видео устроено так же, только длиннее

Видео-промпты выглядят страшнее, но логика та же: хронометраж, стиль картинки, референсы героев, чтобы лица не менялись между сценами, и раскадровка по секундам. Самая просматриваемая работа галереи собрала 368 тысяч просмотров, и её промпт - это, по сути, техзадание на съёмку. Новичку удобно брать такой скелет и менять только сюжет.

Пять ошибок, на которых спотыкаются все

Просят русские надписи, но не пишут «кириллицей». Модель по умолчанию тянется к латинице - требование нужно проговорить прямо.

Не перечисляют точные надписи. Если написать «списки достопримечательностей», нейросеть насочиняет несуществующие слова. У меня в первой попытке на карте Италии появились города «Пуббрга» и «Жазя». Помогает список ровно тех слов, которые должны быть в кадре.

Оставляют в промпте служебные слова. Я написал названия цветов для стрелок - и модель вынесла слова RED, BLUE, GREEN прямо в картинку отдельной легендой. Всё, что похоже на надпись, может оказаться в кадре.

Меняют десять параметров разом. Результат другой, а почему - непонятно.

Не проверяют мелочи. На инфографике с пельменями нейросеть перепутала две выноски местами. Такое ловится только глазами, поэтому смотрите итог внимательно.

Что делать прямо сейчас

Откройте promptstudio.tools, поставьте фильтр по своей нейросети и типу работы, найдите картинку в нужном вам стиле и скопируйте промпт. Поменяйте в нём одно слово и запустите. Дальше - ещё одно. После десятка таких заходов вопрос «как написать промпт» отпадает сам: вы уже видите, из чего он собран.

А вы как начинали - разбирались сами или брали чужие промпты? Расскажите в комментариях, что помогло больше.

Показать полностью 6 1
0

Нейросетевая машина времени


Сделали сайт где можно выбрать любую точку на Земле, вбить нужный год и посмотреть на панораму этой локации.

Работает через подключение своего API.

https://gl4ss.ai/

➡️ Все лучшие нейросети тут: TG | MAX

➡️ Обучение и Промты: TG | MAX

Показать полностью
Отличная работа, все прочитано!

Темы

Политика

Теги

Популярные авторы

Сообщества

18+

Теги

Популярные авторы

Сообщества

Игры

Теги

Популярные авторы

Сообщества

Юмор

Теги

Популярные авторы

Сообщества

Отношения

Теги

Популярные авторы

Сообщества

Здоровье

Теги

Популярные авторы

Сообщества

Путешествия

Теги

Популярные авторы

Сообщества

Спорт

Теги

Популярные авторы

Сообщества

Хобби

Теги

Популярные авторы

Сообщества

Сервис

Теги

Популярные авторы

Сообщества

Природа

Теги

Популярные авторы

Сообщества

Бизнес

Теги

Популярные авторы

Сообщества

Транспорт

Теги

Популярные авторы

Сообщества

Общение

Теги

Популярные авторы

Сообщества

Юриспруденция

Теги

Популярные авторы

Сообщества

Наука

Теги

Популярные авторы

Сообщества

IT

Теги

Популярные авторы

Сообщества

Животные

Теги

Популярные авторы

Сообщества

Кино и сериалы

Теги

Популярные авторы

Сообщества

Экономика

Теги

Популярные авторы

Сообщества

Кулинария

Теги

Популярные авторы

Сообщества

История

Теги

Популярные авторы

Сообщества

Недвижимость и ремонт

Теги

Популярные авторы

Сообщества