Sora: как получить доступ из России и сделать первое видео
Sora — видеомодель OpenAI, которая делает ролики по текстовому описанию или из картинки. Прямого доступа из России нет, и это решаемо. Сложнее другое — получить то, что задумали.
В поисковых запросах вокруг нейросетей Sora держится в первой тройке уже который месяц. Люди ищут её чаще, чем модели, которые доступны без всяких обходных путей.
Причина простая: ролики, которые расходятся по лентам, чаще всего сделаны именно в ней. Причина, по которой половина потом бросает, тоже простая: с первого раза почти ни у кого не получается.
Что Sora делает лучше других
Сильная сторона — связность сцены. Предметы не расползаются между кадрами, свет держится, движение выглядит снятым, а не собранным. На сложных сценах с несколькими объектами это заметно.
Вторая сильная сторона — понимание описания. Длинный промт с деталями модель разбирает аккуратнее конкурентов: если вы просите конкретную камеру, время суток и настроение, она это учтёт.
Слабое место — люди крупным планом и руки. Тут Kling обычно аккуратнее. Ещё одно слабое место — текст в кадре: буквы разваливаются у всех видеомоделей, Sora не исключение.
Доступ из России
Регистрация в сервисе OpenAI с российским номером и картой не проходит, оплата не принимается. Варианты те же, что и для остальных зарубежных нейросетей.
Зарубежная карта плюс VPN — рабочий, но хлопотный путь: продление подписки каждый месяц превращается в отдельное занятие.
Агрегатор с оплатой в рублях — путь, которым идёт большинство. Sora там доступна наравне с Kling, Veo, Runway и Luma, баланс общий, никаких отдельных подписок и танцев с картами.
Бесплатные обвязки, которые обещают Sora без регистрации, чаще всего дают либо очередь на несколько часов, либо чужую модель под её именем.
Первое видео: с чего начать
Не с текста, а с картинки. Режим, когда вы даёте модели готовое изображение и описываете движение, даёт предсказуемый результат гораздо чаще, чем генерация ролика с нуля.
Логика простая. В режиме «текст в видео» модель придумывает и сцену, и движение. В режиме «картинка в видео» половина работы уже сделана вами, и ошибаться ей негде.
Промт для оживления картинки описывает движение и камеру.
Static camera. The subject turns slightly toward the light, fabric moves in the wind, dust particles float in the sunbeam. Subtle realistic motion, cinematic lighting.
Промт для генерации с нуля описывает сцену целиком. Порядок такой: кто, где, что делает, как снято.
A fisherman pulls a net onto a wooden boat at sunrise, calm sea, seagulls in the distance, handheld camera, warm morning light, realistic, 35 mm
Дальше меняется по одной детали за раз. Поменяли сразу три — и непонятно, что дало эффект.
Почему первая генерация обычно разочаровывает
Ожидание не совпадает с механикой. Человек описывает историю, а модель делает сцену. Просьба «мужчина заходит в дом, находит письмо и плачет» — это три сцены, и в пяти секундах они превращаются в кашу.
Работает обратное: одна сцена, одно действие, минимум движения. Сюжет собирается монтажом из нескольких генераций, а не заказывается одной фразой.
Второе разочарование — непредсказуемость. Одинаковый промт дважды даёт разный результат, и это не сбой, а устройство модели. Три-четыре генерации на кадр — нормальный рабочий расход.
Границы: где Sora не поможет
Точное повторение реального человека. Модель не сделает ваше лицо стабильно похожим на протяжении нескольких роликов. Для этого существуют отдельные инструменты с аватарами.
Длинные сцены. Чем дальше от начала, тем выше шанс, что модель потеряет логику. Пять-десять секунд — рабочий отрезок, всё остальное собирается склейкой.
Текст, логотипы, документы в кадре. Всё, что требует читаемых букв, придётся добавлять потом в редакторе.
И деньги. Видео — самая тяжёлая операция у нейросетей: секунды ролика считаются дольше, чем сотня картинок. Поэтому в сервисах действуют внутренние токены, и перебор вариантов стоит заметно дороже, чем кажется на старте. Дешевле потратить десять минут на промт, чем десять генераций на угадывание.
Все эти нейросети — в одном сервисе
Kling, Veo, Runway, Luma, Sora, Topaz и ещё сотня моделей: один баланс, оплата в рублях, работает в браузере и в Telegram. По ссылке с сайта — 15 стартовых токенов вместо 5.
Сборник промтов — бесплатно. Формулы для картинок и видео с разбором, какая часть за что отвечает. Забрать в телеграм-боте.
Забрать в боте