Veo 3.1 в 2026: генерация видео от Google DeepMind (промпты, цены, доступ)
Veo 3 — генерация видео от Google в 2026: полный разбор
Заголовок раздела «Veo 3 — генерация видео от Google в 2026: полный разбор»Автор: Silvana · Дата: 31.07.2026 · Verified: 01.09.2026 · Reading time: 18 минут · Prerequisite: —
Veo 3.1 — актуальная видеомодель Google DeepMind в 2026, главное отличие от Sora и Runway — нативная генерация аудио вместе с картинкой: диалоги, шумы окружения, музыка синхронно с изображением. В линейке — Veo 3.1 Standard, Fast и Lite, разрешения 720p, 1080p и 4K, длительность одного клипа 8 секунд с video extension до 148 секунд, режимы text-to-video и image-to-video. Доступ через Gemini App, Google Flow и Gemini API. Ниже — что модель умеет, сколько стоит секунда, как строить промпт и как получить доступ из РФ.
Google DeepMind выпустила линейку Veo — семейство моделей для генерации видео с нативным аудио. На июль 2026 года актуальная модель — Veo 3.1 Preview, включая варианты Standard, Fast и Lite. Разберём, что модель умеет, сколько стоит, где её взять и почему нативная генерация аудио — главное отличие от конкурентов.
Что такое Veo
Заголовок раздела «Что такое Veo»Veo — семейство моделей для генерации видео от Google DeepMind, лаборатории Google по фундаментальным исследованиям в области ИИ. Модель работает по принципу text-to-video (текст в видео) и image-to-video (изображение в видео), а с версии Veo 3 генерирует и звук — диалоги, шумы окружения, звуковые эффекты, музыку — синхронно с изображением.
Согласно официальной странице Google DeepMind, Veo позиционируется как «leading video generation model, designed to empower filmmakers and storytellers» — модель для кинематографистов и рассказчиков. Это отличает Veo от, например, Gemini Omni Flash, который тоже умеет генерировать видео, но фокусируется на быстром редактировании и диалоге.
Актуальная модель на сегодня — Veo 3.1. Она пришла на смену Veo 3 (deprecated с июня 2026) и приняла все улучшения линейки: нативное аудио, продвинутый контроль над сценой, работу с референсами, продление роликов.
История линейки Veo
Заголовок раздела «История линейки Veo»Google выпустила первую версию модели весной 2024 года. С тех пор линейка прошла через несколько крупных обновлений:
- Veo 2 — модель с генерацией видео до 8 секунд, без нативного аудио. По данным официальной страницы pricing Google, Veo 2 (
veo-2.0-generate-001) сейчас находится в статусе deprecated и будет отключена 30 июня 2026. - Veo 3 — первое поколение с нативной генерацией аудио. Появилась летом 2025 года. Также deprecated с июня 2026, миграция на Veo 3.1.
- Veo 3.1 — актуальная модель на 2026 год. Три варианта: Standard, Fast, Lite. Работает с разрешениями 720p, 1080p и 4k, добавлены новые возможности: portrait-видео 9:16, продление видео, генерация по первому и последнему кадру, работа с референсными изображениями (до трёх).
Ниже — таблица с версиями по состоянию на дату верификации.
| Модель | ID в API | Статус | Дата отключения |
|---|---|---|---|
| Veo 3.1 Standard | veo-3.1-generate-preview | Preview | — |
| Veo 3.1 Fast | veo-3.1-fast-generate-preview | Preview | — |
| Veo 3.1 Lite | veo-3.1-lite-generate-preview | Preview | — |
| Veo 3 Standard | veo-3.0-generate-001 | Deprecated | 30 июня 2026 |
| Veo 3 Fast | veo-3.0-fast-generate-001 | Deprecated | 30 июня 2026 |
| Veo 2 | veo-2.0-generate-001 | Deprecated | 30 июня 2026 |
Данные — из официальной таблицы pricing на ai.google.dev/gemini-api/docs/pricing.
Технические характеристики Veo 3.1
Заголовок раздела «Технические характеристики Veo 3.1»По документации ai.google.dev/gemini-api/docs/veo, Veo 3.1 — модель для генерации восьмисекундных видео (720p, 1080p или 4k) с нативно сгенерированным аудио.
Ключевые параметры:
- Длина одного видео: 8 секунд (Veo 3 First and Last Frame — 6 секунд по данным deepmind.google/models/veo).
- Разрешение: 720p, 1080p, 4k. Формат Veo 3.1 Lite не поддерживает 4k.
- Соотношение сторон: landscape 16:9 (по умолчанию) или portrait 9:16. Управляется параметром
aspect_ratio. - Нативное аудио: диалоги, звуковые эффекты, ambient noise, музыка — генерируются одновременно с изображением, без отдельного шага.
- Video Extension: ролик можно продлить на 7 секунд до 20 раз, максимум 148 секунд суммарной длины. Продлевать можно ролики, сгенерированные за последние 48 часов.
- First and Last Frame: можно задать стартовый и финальный кадры — модель сгенерирует переход между ними.
- Image-based direction: до трёх референсных изображений одновременно (сцена, персонаж, объект).
- Ingredients to Video: генерация видео из «ингредиентов» — набора референсных картинок.
По данным раздела Performance на deepmind.google/models/veo, Veo 3.1 «has achieved leading results in head-to-head comparisons of outputs by human raters on internal benchmarks» — то есть в слепых внутренних тестах Google рецензенты чаще выбирали Veo, чем модели-конкуренты. Публичных цифр в открытых материалах Google на дату верификации нет.
Что генерирует Veo 3.1
Заголовок раздела «Что генерирует Veo 3.1»Модель поддерживает три основных режима:
Text-to-video. Из текстового промпта — сразу видео с аудио. Можно указать сцену, персонажей, диалог, освещение, движение камеры, стиль.
Image-to-video. Стартовое изображение анимируется по текстовому описанию. Работает и с фотореалистичными кадрами, и с иллюстрациями.
First and Last Frame. Два кадра — начало и конец — модель дорисовывает промежуточные, генерируя связный переход.
Video extension. Готовое видео продолжается новым 7-секундным блоком под управлением нового промпта.
Reference-based generation. До трёх картинок передаются как визуальные референсы — сохраняется стиль, персонажи, объекты.
Ingredients to Video. Google DeepMind так называет режим, когда пользователь загружает несколько картинок-«ингредиентов», модель компонует из них связную сцену.
Object Insertion. Возможность вставить в готовую сцену новый объект по текстовому запросу.
Scene Extension. Расширение сцены за пределы исходного кадра — модель дорисовывает окружение.
Полный список возможностей и техническая документация — на ai.google.dev/gemini-api/docs/veo.
Нативная генерация аудио — главная фича
Заголовок раздела «Нативная генерация аудио — главная фича»Ключевое отличие Veo 3 и Veo 3.1 от Veo 2 и от большинства конкурентов — модель генерирует звук одновременно с изображением, без отдельного шага постобработки. Это не «саундтрек, подобранный по видео», а именно синхронно рождённый аудиоряд.
По формулировке официальной страницы deepmind.google/models/veo:
Veo 3 lets you add sound effects, ambient noise, and even dialogue to your creations — generating all audio natively.
На практике это означает:
- Диалоги. Персонажи произносят реплики, которые указаны в промпте. Липсинк совпадает с губами.
- Звуковые эффекты. Шаги, взрывы, звон посуды, шум мотора — модель генерирует по описанию.
- Ambient noise. Городские шумы, ветер, дождь, шум океана — всё, что задаёт атмосферу.
- Музыка. Инструментальный фон, гармонирующий со сценой.
В документации ai.google.dev/gemini-api/docs/veo прямо указано, что параметр prompt поддерживает audio cues — специальные подсказки для звука. Пример из официального гайда:
Prompt: A follow shot of a wise old owl high in the air.Audio: wings flapping, birdsong, loud and pleasant wind rustling.Google предупреждает: иногда генерация видео блокируется из-за проблем с обработкой аудио — safety-фильтр или технический сбой. В таком случае пользователь не оплачивает генерацию.
Как использовать Veo 3.1
Заголовок раздела «Как использовать Veo 3.1»Google предлагает четыре пути доступа к модели.
1. Gemini App (gemini.google.com/veo). Простой веб-интерфейс. Пишете промпт, получаете видео. Доступ для подписчиков Google AI Plus и Ultra — конкретный лимит генераций зависит от тарифа. Ссылка — прямо со страницы deepmind.google/models/veo, кнопка «Try in Gemini».
2. Google Flow (labs.google/fx/tools/flow). Творческая студия от Google Labs. Позиционируется как «AI creative studio built with Google’s advanced generative models». Позволяет собирать целые сцены и монтировать их из отдельных клипов Veo. По официальному описанию Flow «collaborates with creatives at every stage, from idea to execution». Есть отдельный режим Flow Sessions с расширенными возможностями.
3. Gemini API (ai.google.dev/gemini-api/docs/veo). Прямой API для разработчиков. Работа через SDK на Python, JavaScript, Go, curl. Требует API-ключ из aistudio.google.com/apikey. Модель работает через асинхронный метод generateVideos — операция запускается, статус опрашивается, готовое видео скачивается по временной ссылке. Пример вызова:
from google import genaiclient = genai.Client()operation = client.models.generate_videos( model="veo-3.1-generate-preview", prompt="A close up of two people staring at a cryptic drawing on a wall, torchlight flickering.",)Ждать нужно от нескольких десятков секунд до нескольких минут — зависит от сложности сцены и загрузки серверов.
4. Gemini Enterprise Agent Platform. Enterprise-канал для корпоративных клиентов. Именно здесь, по Google, доступны GA-модели Veo (General Availability, стабильный релиз). Preview-модели через Gemini API имеют более строгие rate limits и могут меняться без предупреждения.
Стоимость Veo 3.1
Заголовок раздела «Стоимость Veo 3.1»Все цены — из официальной таблицы pricing на ai.google.dev/gemini-api/docs/pricing, проверенной 31.07.2026. Free tier для Veo не предусмотрен: работа только на платном тарифе. Цены указаны за одну секунду сгенерированного видео с аудио.
Veo 3.1 Standard (веса лучшего качества, режим по умолчанию):
- 720p и 1080p — $0.40 за секунду;
- 4k — $0.60 за секунду.
Veo 3.1 Fast (баланс скорости и качества):
- 720p — $0.10 за секунду;
- 1080p — $0.12 за секунду;
- 4k — $0.30 за секунду.
Veo 3.1 Lite (максимально дешёвая генерация для тестов и высоких объёмов):
- 720p — $0.05 за секунду;
- 1080p — $0.08 за секунду;
- 4k — не поддерживается.
Что это значит на практике? Одно 8-секундное видео Standard 1080p стоит $3.20. Тот же ролик в Fast 1080p — $0.96. В Lite 720p — $0.40. Разница в цене между Standard и Lite — восьмикратная.
Продление через Video Extension оплачивается как обычная генерация: каждый добавочный семисекундный блок — по тарифу выбранной модели и разрешения. Максимальная длина в 148 секунд у Veo 3.1 Standard в 1080p обойдётся примерно в $59.20 (148 × $0.40).
Отдельно Google оговаривает: если видео не сгенерировалось из-за safety-фильтра или проблем обработки аудио — пользователь не оплачивает попытку. Списание идёт только за успешную генерацию.
SynthID — водяной знак на всех видео Veo
Заголовок раздела «SynthID — водяной знак на всех видео Veo»Каждое видео, сгенерированное Veo, содержит невидимый водяной знак SynthID — технологию Google DeepMind для отметки контента, созданного ИИ. По формулировке из документации ai.google.dev/gemini-api/docs/veo:
Videos generated by Veo are watermarked using SynthID, our tool for watermarking and identifying AI-generated content. Videos can be verified using the SynthID verification platform.
SynthID встраивается в файл на пиксельном уровне так, что человеческий глаз изменений не видит, но специальный детектор Google может проверить, был ли ролик создан их моделью. Знак сохраняется при сжатии, скриншотах кадров, лёгком редактировании.
Проверить конкретный файл можно через официальную SynthID Verification Platform от Google DeepMind. Это важная деталь для профессионального использования: например, при подаче ролика на конкурс или в СМИ можно официально пометить его как AI-generated и избежать претензий.
Safety-фильтры и ограничения
Заголовок раздела «Safety-фильтры и ограничения»По документации Google, все видео проходят через safety-фильтры и процессы проверки на «memorization» (запоминание тренировочных данных):
Generated videos are passed through safety filters and memorization checking processes that help mitigate privacy, copyright and bias risks.
Что это значит на практике:
- Публичные лица. Модель отказывается генерировать распознаваемые лица публичных персон, актёров, политиков. Промпт с именем известного человека будет либо заблокирован, либо интерпретирован обобщённо.
- Насилие, оружие, сцены-триггеры. Стандартный safety-фильтр Google — запрет на графическое насилие, откровенно сексуальный контент, инструкции по оружию.
- Копирайт. Модель не пытается воспроизвести кадры из известных фильмов, персонажей защищённых франшиз, брендовые сцены.
- Bias и приватность. Проверка на нежелательные стереотипы и на возможное разглашение чувствительных данных.
По формулировке из документации, «Audio error: Veo 3.1 will sometimes block a video from generating because of safety filters or other processing issues with the audio.» То есть иногда именно аудиокомпонент триггерит фильтр — например, при явной попытке вставить оскорбления, крики боли, узнаваемые голоса.
Плата за такие заблокированные генерации не берётся.
Prompt-техники для Veo
Заголовок раздела «Prompt-техники для Veo»Google опубликовала официальный prompt-гайд на deepmind.google/models/veo/prompt-guide/. Основные элементы промпта:
Subject. Кто в кадре. Не просто «женщина», а «woman in her twenties with wavy brown hair and light freckles». Чем детальнее описание персонажа, тем стабильнее модель держит его между кадрами.
Action. Что персонажи делают. «Dashing across rocky outcrops», «singing an uplifting melody», «doing a backflip».
Location. Где происходит сцена. Не «city», а «rain-slicked street in downtown Tokyo at 3am under neon signs».
Camera positioning and motion. Как снимать. Термины: aerial view, eye-level, top-down shot, dolly shot, worms eye view, follow shot, medium shot, close-up.
Composition. Как кадрируется. wide shot, close-up, single-shot, two-shot.
Focus and lens effects. Оптика. shallow focus, deep focus, soft focus, macro lens, wide-angle lens, 35mm film look.
Lighting. Освещение. «Warm lighting even across the frame», «spotlight in one area», «cold blue moonlight», «golden hour».
Style. Общий стиль. «Cartoon», «claymation», «film noir shot on 35mm», «slightly worn-out VHS tape», «watercolor animation».
Ambience. Атмосфера через свет и цвет. «Contemplative and grounded», «chaotic and vibrant».
Dialogue. Реплики персонажей — прямо в промпте, в кавычках.
Audio cues. Явные подсказки для звука в отдельной строке: Audio: wings flapping, birdsong, distant thunder.
Пример комплексного промпта из официальной документации:
A medium shot opens on a seasoned, grey-bearded man in sunglasses and apaisley shirt, his gaze fixed off-camera with a contemplative expression.Beside him, a younger man in a tank top. The camera slowly pushes in.In the background, a vibrant mural. Faint city murmurs and distant chatter,accompanied by a mellow, soulful hip-hop beat."The city always got a story," the older man murmurs."Just gotta listen."Совет из гайда: экспериментировать. Модель одинаково хорошо работает и с короткими промптами (3-5 предложений), и с длинными кинематографическими описаниями (30+ строк).
Veo 3.1 vs конкуренты
Заголовок раздела «Veo 3.1 vs конкуренты»На рынке text-to-video в 2026 году основные модели — Veo от Google, Sora от OpenAI, Gen-4 от Runway, Kling от Kuaishou. Прямое сравнение по метрикам затруднено — вендоры используют разные внутренние бенчмарки. Ограничимся сравнением по официально задокументированным характеристикам каждого производителя.
Veo 3.1 (Google DeepMind). 8 секунд, 720p/1080p/4k, нативное аудио, продление до 148 секунд, три референсных изображения, portrait и landscape. Цена $0.05-$0.60 за секунду через Gemini API. Watermark SynthID. Работает через Gemini App, Google Flow, Gemini API, Gemini Enterprise Agent Platform.
Материалы по конкурентам — Sora, Gen-4, Kling — доступны только на официальных сайтах OpenAI, Runway и Kuaishou. Технические подробности лучше сверять напрямую в их документации: openai.com/sora, runwayml.com, klingai.com. Каждая компания меняет спецификации и цены часто, приводить их здесь без верификации на момент чтения статьи — риск подать устаревшую информацию.
Что можно сказать с уверенностью, глядя на официальные материалы Google: Veo 3.1 — единственная из массово доступных моделей 2026 года, где нативное синхронное аудио заявлено как встроенная функциональность самой модели, а не отдельная постобработка через TTS или music-generator. Это ключевое стратегическое отличие, важное для сценариев с диалогами и звукоактивными сценами.
Для чего Veo 3.1 подходит лучше всего
Заголовок раздела «Для чего Veo 3.1 подходит лучше всего»По совокупности возможностей и заявленной специализации от Google, модель наиболее эффективна в задачах:
Короткие рекламные ролики. 8 секунд — типичный формат Reels, TikTok, YouTube Shorts, Instagram Stories. Нативное аудио позволяет сразу получить готовый ролик без монтажа.
Storytelling и pre-vis для кино. Кинематографисты используют Veo для быстрых визуализаций сцен на этапе сценария. Термины камеры, композиции, освещения понимаются моделью буквально.
Explainer-видео. Короткие ролики, где нужно показать процесс с закадровым голосом. Veo 3.1 сам сгенерирует речь.
UGC-контент для брендов. Стилизация под аутентичный любительский ролик — модель понимает эстетику «shaky camera», «found footage», «TikTok-style».
Анимация иллюстраций. Через режим image-to-video — статичный арт превращается в короткий анимированный клип.
Плохо подходит: сложные многосценовые сюжеты, точная синхронизация с готовой музыкой, воспроизведение узнаваемых лиц или брендовых элементов, ролики длиннее 148 секунд, задачи с высокой предсказуемостью между дублями.
Google Vids — куда встраивается Veo
Заголовок раздела «Google Vids — куда встраивается Veo»Google Vids — приложение из пакета Google Workspace для создания видео-презентаций. Не путать с Google Flow: Flow ориентирован на творческую генерацию с нуля, Vids — на офисные презентации. По данным официальной документации Google, Vids использует Gemini и Veo для генерации отдельных вставок, титров, коротких пояснительных сцен внутри презентации. Полноценная кинематографическая работа с Veo идёт через Flow или API, Vids — для встраивания сгенерированного контента в корпоративные видеоматериалы.
RU-специфика: доступ и оплата
Заголовок раздела «RU-специфика: доступ и оплата»На дату верификации (31.07.2026) с российских IP есть особенности при работе с сервисами Google AI:
Gemini App. Регистрация и подписка на Google AI Plus/Ultra требует зарубежной платёжной карты и, часто, зарубежного аккаунта Google.
Google Flow. Доступен через labs.google/fx/tools/flow. Подписки Flow Sessions также требуют зарубежной оплаты.
Gemini API. API-ключ выпускается на aistudio.google.com/apikey. Регистрация требует Google-аккаунта, оплата — карта, работающая с сервисами Google Cloud или Google Payments.
Российские альтернативы для видео с ИИ. Yandex Cloud AI Studio на дату верификации не предлагает публичного text-to-video аналога уровня Veo 3.1. Из локальных решений доступны Kandinsky Video и другие модели через сервисы Sber. Прямого аналога нативной генерации аудио в связке с видео на российском рынке нет.
Open-source вариант. Для энтузиастов существуют open-source модели вроде HunyuanVideo, Mochi, CogVideoX, доступные на Hugging Face. Они уступают Veo 3.1 в качестве, но работают локально без ограничений по доступу и без ежесекундной оплаты.
Практические советы
Заголовок раздела «Практические советы»Начинайте с Veo 3.1 Fast. Разница в качестве между Standard и Fast для большинства задач невелика, а цена в четыре раза ниже. Standard имеет смысл для финальных версий и сложных сцен.
Используйте Lite для итераций. Пока ищете подходящий промпт — работайте на Lite 720p ($0.05/сек). Финальный дубль — на Fast или Standard в целевом разрешении.
Тестируйте портретный формат. Veo 3.1 умеет 9:16 нативно — не нужно кропить landscape-видео. Портретный ролик сразу готов для Reels и TikTok.
Прописывайте аудио явно. Пишите отдельной строкой Audio: [описание]. Модель лучше отделяет визуальную составляющую от звуковой, если они синтаксически разделены.
Используйте First and Last Frame для контроля. Если нужен строго определённый конец сцены — задайте финальный кадр как изображение. Модель дорисует переход.
Не забывайте про Video Extension. Одно 8-секундное видео можно продлить до 148 секунд. Пять качественных 8-секундных сцен склеиваются в связный полутораминутный ролик через video параметр в API.
Проверяйте водяной знак. Если готовите видео к публикации в СМИ или на площадке с anti-AI-policy — прогоните файл через SynthID Verification Platform, чтобы понимать, распознается ли контент как AI-generated.
Какая версия Veo актуальна на 2026 год?
Заголовок раздела «Какая версия Veo актуальна на 2026 год?»Veo 3.1 Preview в трёх вариантах: Standard, Fast, Lite. Veo 3 и Veo 2 объявлены deprecated и будут отключены 30 июня 2026. Данные из официальной pricing на ai.google.dev/gemini-api/docs/pricing.
Сколько длится одно видео Veo 3.1?
Заголовок раздела «Сколько длится одно видео Veo 3.1?»Восемь секунд по умолчанию. Через режим Video Extension каждый ролик можно продлить на 7 секунд до 20 раз — итого до 148 секунд общей длины. Продление доступно для видео, сгенерированных за последние 48 часов.
Поддерживает ли Veo разрешение 4K?
Заголовок раздела «Поддерживает ли Veo разрешение 4K?»Да, Veo 3.1 Standard и Fast поддерживают 4K. Veo 3.1 Lite — только 720p и 1080p. Цена 4K значительно выше: $0.60/сек у Standard против $0.40/сек за 1080p.
Что генерирует Veo 3.1 из аудио?
Заголовок раздела «Что генерирует Veo 3.1 из аудио?»Диалоги персонажей, звуковые эффекты (шаги, взрывы, посуда), ambient noise (город, ветер, дождь) и музыкальный фон. Всё синхронизировано с визуальной частью, генерируется одновременно с видео, а не накладывается сверху.
Сколько стоит 8-секундное видео?
Заголовок раздела «Сколько стоит 8-секундное видео?»Standard 1080p — $3.20. Fast 1080p — $0.96. Lite 720p — $0.40. Standard 4K — $4.80. Цены за секунду умножаются на длительность.
Есть ли бесплатный тариф для Veo?
Заголовок раздела «Есть ли бесплатный тариф для Veo?»Нет. Все три варианта Veo 3.1 доступны только на платном тарифе Gemini API. Пробную генерацию можно сделать бесплатно в Gemini App с подпиской Google AI Plus/Ultra.
Что такое SynthID и обязателен ли он?
Заголовок раздела «Что такое SynthID и обязателен ли он?»SynthID — невидимый водяной знак от Google DeepMind, встраиваемый во все AI-generated видео. Отключить нельзя. Знак сохраняется при сжатии и скриншотах, проверяется через SynthID Verification Platform. Это защита от неотличимого deepfake-контента и требование от Google.
Можно ли сгенерировать видео с известным человеком?
Заголовок раздела «Можно ли сгенерировать видео с известным человеком?»Нет. Safety-фильтр блокирует запросы с именами публичных персон, известных актёров, политиков. Модель либо откажется, либо интерпретирует имя как обобщённое описание.
Какие форматы соотношения сторон поддерживает Veo 3.1?
Заголовок раздела «Какие форматы соотношения сторон поддерживает Veo 3.1?»Landscape 16:9 (по умолчанию) и portrait 9:16. Управляется параметром aspect_ratio в API-запросе.
Что происходит, если видео не сгенерировалось из-за фильтра?
Заголовок раздела «Что происходит, если видео не сгенерировалось из-за фильтра?»Плата не списывается. Google явно указывает: «You will not be charged if your video is blocked from generating».
Как получить API-ключ Veo 3.1?
Заголовок раздела «Как получить API-ключ Veo 3.1?»Через aistudio.google.com/apikey. Требуется Google-аккаунт и настроенный биллинг Gemini API. Модель — veo-3.1-generate-preview, veo-3.1-fast-generate-preview или veo-3.1-lite-generate-preview в вызове generateVideos.
В чём разница между Google Flow и Gemini App?
Заголовок раздела «В чём разница между Google Flow и Gemini App?»Gemini App (gemini.google.com/veo) — простой веб-интерфейс для одиночных промптов. Google Flow (labs.google/fx/tools/flow) — творческая студия для комплексной работы над сериями клипов, монтажа сцен, использования референсов. Flow подходит для больших проектов, Gemini App — для быстрых экспериментов.
Насколько сильно Veo 3.1 удерживает персонажа между сценами?
Заголовок раздела «Насколько сильно Veo 3.1 удерживает персонажа между сценами?»По документации Google, работа с референсными изображениями (до трёх штук) обеспечивает consistency персонажа между генерациями. Точных цифр по стабильности внешности между несвязанными генерациями Google не публикует.
Как работает продление видео?
Заголовок раздела «Как работает продление видео?»Через API-параметр video в новом запросе. Модель берёт последний сгенерированный ролик и добавляет к нему семисекундный блок по новому промпту. Продлевать можно только ролики за последние 48 часов.
Какие языки поддерживает диалог в Veo 3.1?
Заголовок раздела «Какие языки поддерживает диалог в Veo 3.1?»Google не публикует явный список языков в основной документации. По опыту пользователей и примерам на deepmind.google/models/veo, английский работает надёжно. Другие языки — с переменным успехом.
Есть ли аналог Veo 3.1 с открытыми весами?
Заголовок раздела «Есть ли аналог Veo 3.1 с открытыми весами?»Нет, Veo — проприетарная модель. Open-source альтернативы уровня 720p+ с нативным аудио: HunyuanVideo (без аудио), Mochi 1, CogVideoX. Все — на Hugging Face. По совокупности качества и функций уступают Veo 3.1.
Можно ли использовать Veo 3.1 в коммерческом проекте?
Заголовок раздела «Можно ли использовать Veo 3.1 в коммерческом проекте?»Да, по данным Google Cloud Terms и Gemini API Additional Terms — коммерческое использование разрешено на платном тарифе. Ограничения касаются контента: нельзя генерировать deepfake публичных персон, копировать защищённые бренды, обходить safety-фильтры.
Как проверить, что видео сгенерировано Veo?
Заголовок раздела «Как проверить, что видео сгенерировано Veo?»Через SynthID Verification Platform от Google DeepMind. Загружаете файл — платформа возвращает вердикт, обнаружен ли водяной знак SynthID.
Актуальность и первоисточники
Заголовок раздела «Актуальность и первоисточники»Актуально на 31.07.2026. Модели, цены и условия доступа Google DeepMind меняются часто — от отключения устаревших версий (как Veo 2 и Veo 3, deprecated с июня 2026) до появления новых Preview-моделей. Перед бизнес-решением всегда сверяйся с первоисточником — все ссылки в разделе Sources ниже.
Sources
Заголовок раздела «Sources»- deepmind.google/models/veo/ — главная страница модели Veo от Google DeepMind (verified 31.07.2026)
- deepmind.google/models/veo/prompt-guide/ — официальный prompt-гайд Veo 3 (verified 31.07.2026)
- ai.google.dev/gemini-api/docs/veo — техническая документация API Veo 3.1 в Gemini API (verified 31.07.2026)
- ai.google.dev/gemini-api/docs/pricing — актуальные цены Gemini API включая Veo 3.1 Standard/Fast/Lite (verified 31.07.2026)
- ai.google.dev/gemini-api/docs/models — список всех моделей Gemini API с ID (verified 31.07.2026)
- labs.google/fx/tools/flow — Google Flow, творческая студия для работы с Veo (verified 31.07.2026)
- aistudio.google.com/apikey — получение API-ключа Gemini для доступа к Veo 3.1
- gemini.google.com/veo — Gemini App, простой web-доступ к Veo 3.1