Справочник по каталогу шлюза на 2026-10-06: 22 видео-моделей, 26 генераторов изображений, 13 моделей звука. Рядом — наши замеры и примеры из снятого материала фильма 01 (61 клип).
bytedance/seedance-2-mini в 720p с готовым кадром: 6,75 ₽ за секунду. Ближайшие альтернативы дороже в 1,4–5,5 раза, а Google Omni — в 14 раз за клип с кадром. Самая дорогая модель не значит лучшая: для нашей задачи выигрывает дешёвая.| Модель | ₽/с | Режим | Вывод |
|---|---|---|---|
grok/imagine | 1.62 | оживление плиты, 480p | самый дешёвый, но качество эскизное |
bytedance/seedance-2-mini | 5.54 | оживление плиты, 720p | наш рабочий конь: дешевле всех из рабочих |
kling/v2.6 | 9.00 | оживление плиты | предыдущая версия линейки |
google/veo3_fast | 9.00 | оживление плиты, со звуком | звук из коробки |
minimax/hailuo-3-max | 9.36 | оживление плиты | хорошая физика воды |
kling/v3 | 10.00 | оживление плиты, std, без звука | наш текущий генератор по канону |
bytedance/seedance-2-fast | 10.46 | оживление плиты, 720p | быстрее, дороже mini |
bytedance/seedance-2 | 12.82 | оживление плиты | старшая модель линейки |
alibaba/wan-3.0 | 23.40 | оживление плиты | дорого, брали для пробы |
google/veo3 | 37.50 | оживление плиты, качество | дорого: только геройские кадры |
Раскадровки снятых клипов фильма 01 (первые 6 кадров из каждой группы). Это наши настоящие плиты, а не чужие демо.
P1-13_1.mp4P1-01_1.mp4P1-16_1.mp4P1-18_1.mp4P1-11_1.mp4P1-07_1.mp4P2-01_1.mp4P3-09_1.mp4P1-19_1.mp4P2-14_1.mp4Цена считается по замеренной ставке: `kling/v3` — 10 ₽/с, `seedance-2-mini` — 5,54 ₽/с (720p без звука). Разрешение и длину скрипт берёт из файлов, а не из памяти.
| Кадр | Файл | Разрешение | Длина | Дублей | Модель (по решению съёмки) | Оценка, ₽ |
|---|---|---|---|---|---|---|
| P1-01 | P1-01_1.mp4 | 1344×768 | 10.1 с | 1 | kling/v3 | 101 |
| P1-02 | P1-02_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-03 | P1-03_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-04 | P1-04_1.mp4 | 1280×720 | 10.0 с | 2 | kling/v3 | 100 |
| P1-05 | P1-05_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-06 | P1-06_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-07 | P1-07_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-08 | P1-08_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-09 | P1-09_1.mp4 | 1344×768 | 10.1 с | 1 | kling/v3 | 101 |
| P1-10 | P1-10_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-11 | P1-11_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-12 | P1-12_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-13 | P1-13_1.mp4 | 860×1068 | 5.0 с | 2 | kling/v3 | 50 |
| P1-14 | P1-14_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-15 | P1-15_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-16 | P1-16_1.mp4 | 1280×720 | 10.0 с | 2 | kling/v3 | 100 |
| P1-17 | P1-17_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-18 | P1-18_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-19 | P1-19_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P1-20 | P1-20_1.mp4 | 1344×768 | 10.1 с | 1 | kling/v3 | 101 |
| P1-21 | P1-21_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-01 | P2-01_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-02 | P2-02_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-03 | P2-03_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-04 | P2-04_1.mp4 | 1344×768 | 10.1 с | 1 | kling/v3 | 101 |
| P2-05 | P2-05_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-06 | P2-06_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-07 | P2-07_1.mp4 | 1344×768 | 10.1 с | 1 | kling/v3 | 101 |
| P2-08 | P2-08_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-09 | P2-09_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-10 | P2-10_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-11 | P2-11_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-12 | P2-12_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-13 | P2-13_1.mp4 | 1344×768 | 10.1 с | 1 | kling/v3 | 101 |
| P2-14 | P2-14_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-15 | P2-15_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-16 | P2-16_1.mp4 | 1344×768 | 10.1 с | 1 | kling/v3 | 101 |
| P2-17 | P2-17_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P2-18 | P2-18_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-01 | P3-01_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-02 | P3-02_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-03 | P3-03_1.mp4 | 1344×768 | 10.1 с | 1 | kling/v3 | 101 |
| P3-04 | P3-04_1.mp4 | 1344×768 | 10.1 с | 1 | kling/v3 | 101 |
| P3-05 | P3-05_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-06 | P3-06_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-07 | P3-07_1.mp4 | 1280×720 | 8.0 с | 1 | kling/v3 | 80 |
| P3-08 | P3-08_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-09 | P3-09_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-10 | P3-10_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-11 | P3-11_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-12 | P3-12_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-13 | P3-13_1.mp4 | 1344×768 | 10.1 с | 1 | kling/v3 | 101 |
| P3-14 | P3-14_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-15 | P3-15_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-16 | P3-16_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-17 | P3-17_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-18 | P3-18_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P3-19 | P3-19_1.mp4 | 1280×720 | 10.0 с | 1 | kling/v3 | 100 |
| P4-01 | P4-01_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-02 | P4-02_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-03 | P4-03_1.mp4 | 1280×720 | 5.0 с | 3 | kling/v3 | 50 |
| P4-04 | P4-04_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-05 | P4-05_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-06 | P4-06_1.mp4 | 1280×720 | 5.0 с | 3 | kling/v3 | 50 |
| P4-07 | P4-07_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-08 | P4-08_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-09 | P4-09_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-10 | P4-10_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-11 | P4-11_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-12 | P4-12_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-13 | P4-13_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-14 | P4-14_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-15 | P4-15_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-16 | P4-16_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-17 | P4-17_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| P4-18 | P4-18_1.mp4 | 1280×720 | 5.0 с | 1 | kling/v3 | 50 |
| итого оценка по замеренным ставкам | 6640 | |||||
Строки отсортированы по минимальной цене. Режим «с кадром» (`has_video=true`) — это наше оживление готовой плиты: в нём цена обычно выше.
| Модель | Что умеет | Тарифы (₽) |
|---|---|---|
grok-imagine-video-1-5Grok Imagine Video 1.5 Preview | Модель для генерации видео с акцентом на связное движение и правдоподобную физику. Подходит для создания коротких визуальных сцен и творческих материалов. | 1.62 (resolution=480p) · 3.04 · 3.04 (resolution=720p) |
bytedance/seedance-2-miniSeedance 2 Mini | Создаёт видео по текстовым запросам и референсам, поддерживает редактирование, продолжение роликов и генерацию синхронного звука. | 2.56 (resolution=480p, has_video=false) · 3.24 (resolution=480p, has_video=true) · 5.54 (resolution=720p, has_video=false) · 6.75 · 6.75 (resolution=720p, has_video=true) |
bytedance/seedance-1.5-proSeedance 1.5 Pro | Создаёт видео со встроенными голосами, диалогами и звуковыми эффектами, синхронизируя их с движением и сценой для историй и рекламных роликов. | 5.25 (resolution=480p, duration=4, sound=false) · 10.50 (resolution=480p, duration=4, sound=true) · 10.50 (resolution=480p, duration=8, sound=false) · 10.50 (resolution=720p, duration=4, sound=false) · 14.25 (resolution=480p, duration=12, sound=false) · 21.00 (resolution=480p, duration=8, sound=true) · 21.00 (resolution=720p, duration=4, sound=true) · 21.00 (resolution=720p, duration=8, sound=false) |
topaz/video-upscaleTopaz Video Upscale | Повышает разрешение и улучшает визуальное качество видеозаписей, помогая подготовить низкокачественный или сжатый материал для просмотра и повторного использования. | 6.00 · 6.00 (upscale_factor=1) · 6.00 (upscale_factor=2) · 10.50 (upscale_factor=4) |
kling/v2.6-motion-controlKling 2.6 Motion Control | Переносит движения и выразительность из референсного видео на персонажа с исходного изображения, помогая создавать управляемые анимационные ролики. | 8.25 (mode=720p) · 13.50 · 13.50 (mode=1080p) |
kling/v3Kling 3.0 | Создаёт видео с несколькими планами, синхронизированной речью и звуком; подходит для коротких сюжетов, рекламных роликов и демонстраций продуктов. | 10.00 (mode=std, sound=false) · 12.00 (mode=pro, sound=false) · 14.00 (mode=std, sound=true) · 18.00 (mode=pro, sound=true) · 45.00 · 45.00 (mode=4K, sound=false) · 45.00 (mode=4K, sound=true) |
bytedance/seedance-2-fastSeedance 2 Fast | Модель предназначена для генерации видео; вариант Fast относится к линейке Seedance 2.0, где заявлены мультимодальные ориентиры и редактирование видео. | 10.46 (resolution=480p) · 22.27 · 22.27 (resolution=720p) |
bytedance/seedance-2Seedance 2 | Создаёт видео по текстовым и мультимодальным референсам, может добавлять синхронный звук, редактировать ролики и продолжать их. | 12.82 (resolution=480p, has_video=false) · 15.39 (resolution=480p, has_video=true) · 27.68 (resolution=720p, has_video=false) · 33.75 (resolution=720p, has_video=true) · 68.85 (resolution=1080p, has_video=false) · 83.70 · 83.70 (resolution=1080p, has_video=true) |
kling/v3-motion-controlKling 3.0 Motion Control | Переносит движения и мимику из референсного видео на выбранного персонажа, помогая создавать управляемые анимации из статичного изображения. | 14.00 (mode=720p) · 19.00 · 19.00 (mode=1080p) |
bytedance/seedance-2-5Seedance 2.5 | Создаёт видеоролики с синхронным аудио, развивает сюжет и помогает управлять сценами с помощью референсов и точечных правок. | 18.90 (resolution=480p, has_video=false) · 22.95 (resolution=480p, has_video=true) · 42.52 (resolution=720p, has_video=false) · 51.30 · 51.30 (resolution=720p, has_video=true) |
gemini-omni-videoGemini Omni Video | Создаёт и редактирует видео по текстовым указаниям: помогает менять стиль, действия и детали сцены, сохраняя связность результата. | 35.00 · 35.00 (duration=4, has_video=false) · 35.00 (resolution=720p, duration=4, has_video=false) · 35.00 (resolution=1080p, duration=4, has_video=false) · 45.00 (duration=6, has_video=false) · 45.00 (resolution=720p, duration=6, has_video=false) · 45.00 (resolution=1080p, duration=6, has_video=false) · 50.00 (duration=8, has_video=false) |
kling/v2.6Kling 2.6 | Генерирует видео со встроенной речью, диалогами, музыкой и звуковыми эффектами; подходит для коротких роликов, где важна связь изображения и звука. | 42.00 · 42.00 (duration=5, sound=false) · 82.50 (duration=10, sound=false) · 82.50 (duration=5, sound=true) · 165.00 (duration=10, sound=true) |
wan/2.5Wan 2.5 | Создаёт видео по текстовому описанию или изображению и синхронизирует звук с визуальным рядом — для роликов, рекламы и творческих концепций. | 45.00 · 45.00 (resolution=720p, duration=5) · 75.00 (resolution=1080p, duration=5) · 90.00 (resolution=720p, duration=10) · 150.00 (resolution=1080p, duration=10) |
google/gemini-omni-1.1-flashGemini Omni 1.1 Flash | Создаёт и редактирует видео по текстовым инструкциям и референсам, продолжает сцены и управляет переходами — для творческих и прикладных видеопроцессов. | 48.00 (duration=4, has_video=false) · 63.00 (duration=6, has_video=false) · 79.00 (duration=8, has_video=false) · 95.00 (duration=10, has_video=false) · 111.00 (resolution=4k, duration=4, has_video=false) · 126.00 (resolution=4k, duration=6, has_video=false) · 126.00 (has_video=true) · 142.00 (resolution=4k, duration=8, has_video=false) |
wan/2.6Wan 2.6 | Создаёт видео с последовательностью связанных планов, помогает сохранять визуальную цельность сцен и сочетает изображение со звуком для коротких историй. | 52.50 · 52.50 (resolution=720p, duration=5) · 78.38 (resolution=1080p, duration=5) · 105.00 (resolution=720p, duration=10) · 157.13 (resolution=720p, duration=15) · 157.13 (resolution=1080p, duration=10) · 236.25 (resolution=1080p, duration=15) |
minimax/hailuo-3-maxMiniMax: H3 Max | Создаёт короткие видео по текстовому описанию или изображению. Подходит для визуализации идей и оживления исходных кадров. | цена не указана |
alibaba/wan-3.0-primeAlibaba: Wan 3.0 Prime | Генерирует видео по текстовому описанию или первому кадру. Быстрый режим подходит для создания роликов из промптов и анимации изображений. | цена не указана |
alibaba/wan-3.0Alibaba: Wan 3.0 | Создаёт видео по текстовому описанию или исходному изображению. Подходит для визуализации сцен, творческих идей и рекламных концепций. | цена не указана |
alibaba/happyhorse-1.1Alibaba: HappyHorse 1.1 | Создаёт видео по текстовому описанию или визуальным референсам; подходит для рекламных, товарных и социальных роликов с заданной сценой и движением. | цена не указана |
alibaba/happyhorse-1.0Alibaba: HappyHorse 1.0 | Создаёт короткие видеоролики по текстовому запросу или изображению; подходит для кинематографичных сцен, рекламы и контента для соцсетей. | цена не указана |
google/veo3_fastVeo 3.1 Fast | Создаёт видеоролики по описанию и подходит для быстрого получения черновиков, коротких визуальных сцен и материалов для дальнейшей доработки. | цена не указана |
google/veo3Veo 3.1 Quality | Создаёт кинематографичные видео по описанию, включая синхронизированные речь, музыку и звуковую среду; подходит для разработки сцен и историй. | цена не указана |
| Модель | Что умеет | Тарифы (₽) |
|---|---|---|
black-forest-labs/flux.2-flexFlux-2 Flex | Генерирует и редактирует изображения по текстовому описанию, уделяя внимание надписям и мелким деталям; подходит для макетов, рекламы и визуальных материалов. | 14.00 · 14.00 (image_resolution=1K) · 24.00 (image_resolution=2K) |
black-forest-labs/flux.2-proFlux-2 Pro | Генерирует изображения по текстовым запросам и помогает редактировать визуалы с опорой на референсы. Подходит для фотореализма, дизайна и рекламы. | 5.00 · 5.00 (image_resolution=1K) · 7.00 (image_resolution=2K) |
bytedance/seedream-4Seedream 4.0 | Создаёт изображения по описанию и поддерживает редактирование: замену объектов, правки текста и света, а также подготовку постеров и схем. | цена не указана |
bytedance/seedream-4.5Seedream 4.5 | Создаёт и редактирует изображения, сохраняя ключевые детали референсов; подходит для постеров, брендовых материалов и рекламных визуалов. | цена не указана |
bytedance/seedream-5-liteSeedream 5.0 Lite | Создаёт изображения по творческим задачам и помогает с визуализацией идей, схем и материалов для работы, учёбы и дизайна. | цена не указана |
google/gemini-2.5-flash-imageGoogle: Gemini 2.5 Flash Image (Nano Banana) | Создаёт изображения по текстовому описанию и редактирует загруженные визуалы в диалоге; подходит для быстрых творческих задач и массовой генерации. | цена не указана |
google/gemini-3-pro-image-previewGoogle: Nano Banana Pro (Gemini 3 Pro Image Preview) | Создаёт и редактирует изображения по текстовым запросам и входным изображениям; подходит для макетов, инфографики и визуализации идей с текстом. | 13.50 · 13.50 (image_resolution=1K) · 13.50 (image_resolution=2K) · 18.00 (image_resolution=4K) |
google/gemini-3.1-flash-imageGoogle: Nano Banana 2 (Gemini 3.1 Flash Image) | Создаёт и редактирует изображения по текстовым запросам и входным картинкам; подходит для визуальных концепций, инфографики и локализации надписей. | цена не указана |
google/gemini-3.1-flash-image-previewGoogle: Nano Banana 2 (Gemini 3.1 Flash Image Preview) | Создаёт и редактирует изображения по текстовым и визуальным запросам, а также возвращает текст; подходит для быстрых итераций, инфографики и визуальных концепций. | 4.80 · 4.80 (image_resolution=1K) · 7.20 (image_resolution=2K) · 10.80 (image_resolution=4K) |
google/gemini-3.1-flash-lite-imageGoogle: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) | Модель создаёт изображения по тексту и редактирует их по инструкциям, включая локальные правки. Подходит для быстрых интерактивных визуальных задач. | цена не указана |
google/gemini-nano-banana-2.1Google: Nano Banana 2.1 | Мультимодальная модель Google для создания и редактирования изображений по текстовым запросам и визуальным примерам; подходит для дизайна и быстрых итераций. | 3.00 (image_resolution=1K) · 4.50 (image_resolution=2K) · 6.75 · 6.75 (image_resolution=4K) |
grok-imagine-image-2-0/text-to-imageGrok Image 2.0 | Создаёт изображения по текстовому запросу и редактирует готовые картинки, помогая прорабатывать иллюстрации, дизайн-макеты и визуальные концепции. | цена не указана |
openai/gpt-5-imageOpenAI: GPT-5 Image | Генерирует и редактирует изображения по текстовым запросам, учитывает контекст и работает с надписями; подходит для визуальных концепций и правок. | цена не указана |
openai/gpt-5-image-miniOpenAI: GPT-5 Image Mini | Создаёт изображения по текстовым инструкциям и помогает редактировать визуальный материал, сочетая генерацию с пониманием текста и изображений. | цена не указана |
openai/gpt-5.4-image-2OpenAI: GPT-5.4 Image 2 | Создаёт и редактирует изображения по тексту и визуальным референсам, а также принимает изображения и файлы для мультимодальных задач. | 4.00 · 4.00 (image_resolution=1K) · 7.00 (image_resolution=2K) · 11.00 (image_resolution=4K) |
openai/gpt-image-1.5GPT Image 1.5 | Создаёт изображения по текстовым инструкциям и помогает редактировать готовые: менять отдельные элементы, сохраняя важные детали исходной сцены. | 3.00 · 3.00 (quality=medium) · 16.50 (quality=high) |
openai/gpt-image-2.5-flareGPT Image 2.5 Flare | Генерирует изображения и помогает редактировать их по текстовым и визуальным входным данным; подходит для контента, прототипов и продуктовых сценариев. | 4.00 (image_resolution=1K) · 7.00 (image_resolution=2K) · 11.00 · 11.00 (image_resolution=4K) |
openai/gpt-image-2.5-sunburstGPT Image 2.5 Sunburst | Генерирует изображения по тексту и помогает точно править готовые визуалы — для рекламных материалов, продуктовых изображений и творческих задач. | 4.00 (image_resolution=1K) · 7.00 (image_resolution=2K) · 11.00 · 11.00 (image_resolution=4K) |
qwen/imageQwen Image | Создаёт изображения по текстовому описанию, в том числе с надписями и сложной композицией; подходит для иллюстраций, постеров и визуальных концепций. | 2.25 (aspect_ratio=9:16) · 2.25 (aspect_ratio=16:9) · 2.50 (aspect_ratio=3:4) · 2.50 (aspect_ratio=4:3) · 3.00 · 3.00 (aspect_ratio=1:1) |
qwen/image-2Qwen Image 2 | Создаёт изображения по текстовым запросам и редактирует загруженные картинки; подходит для визуальных материалов с заметными деталями и текстом. | цена не указана |
qwen/image-2.1Qwen Image 2.1 | Создаёт изображения по текстовому описанию и редактирует готовые картинки: подходит для иллюстраций, предметных изображений и работы с прозрачным фоном. | 3.00 (image_resolution=1K) · 6.00 · 6.00 (image_resolution=2K) |
seedream/5-pro-text-to-imageSeedream 5.0 Pro | Генерирует и редактирует изображения по описанию и визуальным указаниям; подходит для инфографики, макетов, реалистичных сцен и локальных правок. | 5.00 · 5.00 (quality=basic) · 5.00 (input_images_count=1) · 5.00 (quality=basic, input_images_count=1) · 5.30 (input_images_count=2) · 5.30 (quality=basic, input_images_count=2) |
tongyi-mai/z-imageZ-Image | Создаёт изображения по текстовым запросам; подходит для проработки композиций, фотореалистичных сцен, цифрового арта и иллюстраций с negative prompt. | цена не указана |
topaz/image-upscaleTopaz Upscale | Увеличивает разрешение изображения с помощью ИИ, стараясь восстановить мелкие детали и повысить чёткость для печати и крупного цифрового отображения. | 7.50 · 7.50 (upscale_factor=1) · 7.50 (upscale_factor=2) · 15.00 (upscale_factor=4) · 30.00 (upscale_factor=8) |
x-ai/grok-imagine-imageGrok Image | Создаёт изображения по текстовым запросам — для иллюстраций, концепт-артов и визуальных сцен с реалистичной или художественной подачей. | цена не указана |
yandex/yandex-artYandexArt | Создаёт изображения по текстовым запросам — от иллюстраций и портретов до рекламных материалов; подходит для визуальных идей и контента. | 2.91 |
| Задача | Модель | Почему |
|---|---|---|
| Черновая раскадровка движения (проверить, «живёт» ли кадр) | `grok-imagine-video-1-5` (3,04 ₽/с) или `bytedance/seedance-2-mini` в 480p (3,24 ₽/с) | Дёшево, качество эскизное — смотрим только на движение и композицию, платить за пиксели рано. |
| Рабочая съёмка частей (основной объём) | `bytedance/seedance-2-mini`, 720p, оживление плиты (6,75 ₽/с) | Лучшее соотношение цена/качество. Часть 4 — 18 кадров по 5 с ≈ 608 ₽. |
| Статика, которая должна дышать (замерший мир, стена воды, бабочка) | `seedance-2-mini` 5 с + наплыв кадра в монтаже | Плавный наплыв из 5-секундного ролика читается как 10 секунд и не стоит второго клипа. |
| Кадры с лицом и мимикой | `kling/v3-motion-control` (14 ₽/с, 720p) — переносит мимику с референсного видео | Дороже, но именно для мимики сделан. Брать точечно: 2–3 кадра на фильм. |
| Геройские кадры (ключевой образ, обложка) | `google/veo3` (Quality, 187,50 ₽ за клип 8 с) или `wan/3.0` (23,80 ₽/с, до 30 с) | Один-два кадра на фильм, не больше. Разница в цене с mini — в 4–30 раз. |
| Вода, океан, разрушение | `google/veo3` Quality или `wan/3.0` — не `seedance-2-mini` | Дешёвые модели на сложной физике воды уходят в брак первыми, и деньги тратятся дважды. |
| Переделать уже снятый кадр словами | `wan/3.0` (правка видео, смена света, убрать объект) или `gemini-omni-flash` | Дешевле пересъёмки. Сначала пробуем поправить, только потом снимаем заново. |
| Плита с лицом, длинная сцена, много референсов | `gemini-omni-1.1-flash` (до 7 референсов, до 4K, 10 с) | Когда персонаж идёт через много шотов: 95 ₽ за 10 с против 45 ₽ за 8 с у Veo Fast. |
| Видео со звуком из коробки | `google/veo3_fast` (45 ₽ за клип) или `kling/v3` mode=std sound=true (14 ₽/с) | Наш путь дешевле: немое видео + синтез шумов ffmpeg + музыка Suno (0 ₽ за шум). |
| Картинка-плита: эскиз, 1K | `google/gemini-3.1-flash-lite-image` (2,90 ₽) или `qwen/image` (2,25 ₽) | Для проб и композиции. GPT Image 16:9 не умеет — только 1:1, 2:3, 3:2. |
| Картинка-плита: в кадре люди (лица, руки) | `google/gemini-3.1-flash-image` (7,88 ₽) — тот же Nano Banana 2 | Лучше всех держит лица и референсы. Экономить здесь — потом переснимать видео. |
| Картинка-плита: финал, нужен большой размер | `bytedance/seedream-4.5` (5,00 ₽, 2848×1600) или `seedream/5-pro-text-to-image` (5,00 ₽) | Ширина ≥1920 — требование 1080p-финиша; такие плиты апскейлятся чисто. |
| Апскейл готового кадра | `topaz/image-upscale` (7,50 ₽) — но лучше это делает Антон в Topaz | Инструмент аварийный: наша задача — снять идею, а не пиксели. |
| Модель | Что даёт | Цена на шлюзе |
|---|---|---|
gemini-omni-1.1-flash | Omni Flash 1.1: 3–10 с, до 4K, 24 к/с, до 7 референсов, правка видео разговором | 48 ₽ / 4 с · 95 ₽ / 10 с |
gemini-omni-video | Omni Video: 4–10 с, до 4K, правка сцены словами | 35 ₽ / 4 с · 60 ₽ / 10 с |
wan/3.0 | 30 с, 30 к/с, нативные диалоги, музыка и шумы, до 20 референсов, монтаж видео, продление | 23,80 ₽/с |
minimax/hailuo-3-max | до 15 с, first/last frame, звук | 9,52 ₽/с |
kling/v3-motion-control | перенос мимики и движения с референсного видео на персонажа | 14 ₽/с (720p) |
openai/gpt-image-2.5-sunburst | прямой апгрейд нашего GPT Image: 1K / 2K / 4K | 4 / 7 / 11 ₽ |
seedream/5-pro-text-to-image | Seedream 5.0 Pro — вместо 4.5 | 5 ₽ базовый · 10 ₽ высокий |
black-forest-labs/flux.2-pro | Flux.2 Pro — другой вкус картинки, полезно для сравнения | 5 / 7 ₽ |
Разбор с ссылками на первоисточники — в отчёте [`2026-10-06_VIDEO_I_IMAGE_MODELS_2026.md`](2026-10-06_VIDEO_I_IMAGE_MODELS_2026.md): там таблицы по вендорам, что подтверждено официальной докой, а что нет, и раздел «что не подтвердилось».
python tools/scan_generators_full.py — забирает каталог с ценами; python tools/generators_prices.py seedance — печатает сетки по выбранным моделям; python tools/build_generators_html.py — пересобирает эту страницу. Перед съёмкой сверяться: каталог шлюза меняется.