Нейросеть Z-Image — кадр за один кредит
Разбираю самую дешёвую модель фото-студии: один кредит за кадр. Беру обещания разработчиков с официальной страницы и проверяю каждое руками. Урок 36 бесплатного видеокурса по нейросетям Genosai: 7:54 минут записи в живом кабинете, с ценами на кнопке и результатом в кадре.
Обновлено: 3 августа 2026 г.
- Видеоурок целиком на странице — Полная запись урока на 7:54 минут — смотреть можно прямо здесь, без регистрации и перехода на другой сайт.
- Съёмка в живом кабинете — Все кнопки, настройки и цены на экране — настоящие. Результаты получены во время записи, а не подставлены заранее.
- Честная цена в токенах — В конце урока посчитано, во сколько обошлась вся работа и из чего сложилась эта сумма.
- Тайм-коды по шагам — Можно не смотреть целиком, а открыть нужный момент: каждый шаг подписан и вынесен в список.
- Разбор сильных и слабых сторон — Показано не только то, что модель умеет, но и то, где она ошибается, — с примером прямо в кадре.
Содержание
- Видеоурок целиком
- Обзор урока
- Возможности и что вы научитесь делать
- Как это выглядит по шагам
- Пример запроса
- Сколько это стоит
- Сравнение студий и агентов
- Кому пригодится
- Ограничения и советы новичку
- Как повторить у себя
- Тайм-коды урока
- Что смотреть дальше
Видеоурок целиком
Урок 36. Нейросеть Z-Image — кадр за один кредит — 7:54
Смотреть урок во ВКонтакте · весь плейлист курса
Урок открыт без регистрации. Ниже — то же самое текстом: что разбирается, какие настройки нажимаются и сколько стоит каждый шаг.
Обзор урока
Нужна картинка, но с первого раза она почти никогда не получается такой, как задумал. Надо перебирать: поменять свет, поменять ракурс, поменять настроение. А каждая проба стоит кредитов, и рука сама тормозит: жалко. В итоге берёшь первый кривой вариант просто потому, что жалко пробовать дальше.
Тогда вам нужна Z-Image. Это самая дешёвая модель во всей фото-студии: один кредит за кадр. Сегодня разберём, что говорят о ней разработчики, а потом я проверю каждое обещание руками.
Урок снят в живом кабинете Genosai: на экране те же кнопки и те же цены, которые вы увидите у себя после входа. Ничего не смонтировано задним числом — все результаты в кадре получены прямо во время записи.
Возможности и что вы научитесь делать
- Открытая модель Tongyi MAI (Alibaba): 6 млрд параметров, 16 ГБ видеопамяти
- Фотореализм — проверяю на портрете крупным планом
- Русская афиша тем же промптом, что у Seedream: одна ошибка вместо четырёх
- Знание реального мира: конкретные здания, а не «похожее»
- Главный минус: свои фотографии она не принимает — только текст в картинку
Как это выглядит по шагам
Начнём с первоисточника. Вот официальная страница модели. Сделала её команда Tongyi MAI, это подразделение Alibaba — те же люди, что делают нейросеть Qwen. Модель выложена открыто: код, веса и научная статья лежат в свободном доступе, ссылки на них прямо здесь, на главной.
Формулировка авторов: эффективная модель на шесть миллиардов параметров. И дальше — самое интересное. Они прямо пишут, что топовое качество не требует гигантского размера, и что по фотореализму и по тексту на картинке модель сопоставима с ведущими коммерческими нейросетями. Заявка сильная. Проверим.
Здесь их же список сильных сторон, одним экраном. Фотореализм. Одна секунда на кадр. Шесть миллиардов параметров. Точная отрисовка текста. Шестнадцать гигабайт видеопамяти — то есть модель влезает в обычную домашнюю видеокарту. Мировые знания. И редактирование картинок. Обратите внимание на текст: авторы говорят про два языка — китайский и английский. Про русский не сказано ни слова, и это мы отдельно проверим.
Ещё важная деталь. Z-Image — это не одна модель, а три. Базовая — для дообучения под себя. Turbo — быстрая, рисует картинку всего за восемь шагов, и именно она работает в нашей студии. И Edit — версия для правки готовых фотографий. Запомните это: в Genosai подключена генерация, а не правка.
Первое обещание — фотореализм. Разработчики пишут, что модель тонко управляет деталями, светом и текстурами, и что картинки получаются не только реалистичными, но и красивыми. Вот их примеры: портрет в машине и театральный грим крупным планом.
Второе обещание — текст. Модель, по словам авторов, точно рисует китайские и английские надписи, держит вёрстку и справляется даже с мелким кеглем. Вот их постеры: обложка журнала, афиша и рекламная раскладка — текст на них действительно ровный и читаемый.
И третье — знание реального мира. Модель знает конкретные места, людей и предметы, а не только «красивый абстрактный храм». В их же примерах — собор святого Павла, мост Золотые Ворота и, кстати, собор Василия Блаженного.
Переходим к практике. Открываем вкладку «Фото» и разворачиваем список моделей. Z-Image стоит седьмой, между Seedream и Grok. Выбираем её.
И сразу смотрим на кнопку «Создать»: там стоит единица. Один кредит. Для сравнения: Нано-банана — четыре, Seedream — пять с половиной, ChatGPT Image 2 — от шести. То есть проба на Z-Image дешевле в четыре-шесть раз. И ещё заметьте: окна для загрузки своих фотографий здесь нет вообще. Почему — скажу в конце.
Проверка первая. Прошу портрет пожилого рыбака на причале в тумане: обветренная кожа с порами и морщинами, седая щетина, вязаная шапка, мягкий холодный свет. И вот результат. Кожа живая, туман настоящий, за спиной лодки в дымке. Сорок две секунды и один кредит. Фотореализм разработчики не наврали.
Проверка вторая — английский текст, который они заявляют как сильную сторону. Прошу постер кофейни: крупная надпись «MORNING COFFEE», ниже часы работы, внизу «FRESHLY ROASTED». Вёрстка вышла отличная — но читаем внимательно. В слове COFFEE лишняя буква «E». Это ровно та причина, по которой любую надпись после генерации нужно перечитывать глазами.
А теперь самое интересное — русский. Беру ровно тот же промпт, что в прошлом уроке давал Seedream: афиша, крупно «ДЖАЗ В САДУ», ниже «12 сентября, 19:00», внизу «вход свободный». Обратите внимание: что вышло. «ДЖАЗ В САДУ» — правильно. «Вход свободный» — правильно. Ошибка одна: «12 сентеря», потерялась буква «б». Напомню, Seedream на этом же промпте сделал четыре ошибки в трёх строчках и стоил пять с половиной кредитов. Здесь — одна ошибка за один кредит. И это при том, что русский разработчики вообще не обещали.
Проверка четвёртая — то самое знание реального мира. Прошу собор Василия Блаженного на Красной площади зимним вечером, падает снег, тёплая подсветка куполов. И собор действительно узнаваемый: пропорции, разные купола, каждый со своим узором. Модель знает конкретное здание, а не просто «церковь с луковками».
И пятая, самая рабочая проверка — предметная съёмка. Кружка изумрудного цвета на бетонном столе, ветка эвкалипта рядом, мягкий свет из окна слева. Свет, тени и глазурь выглядят достоверно, кадр готов в карточку товара или в пост. Один кредит.
Подведём. Плюсы: цена в один кредит, честный фотореализм, знание реальных мест и предметов, приличный текст на картинке — и русский заметно лучше, чем у моделей дороже. Минус главный и его надо знать заранее: Z-Image не принимает ваши фотографии. Ни своё лицо вставить, ни одежду примерить, ни товар перекрасить — версия Edit в студию не подключена. Для этого берите Нано-банану или Seedream. И второе: текст она пишет хорошо, но не идеально — если на макете ошибок быть не должно, берите ChatGPT Image 2.
Пример запроса
Самая частая ошибка — описание из двух слов. Сравните. Так делать не стоит:
красивая картинка
А так модель понимает задачу и повторяет её из раза в раз:
Портрет пожилого рыбака на причале в тумане: обветренная кожа с порами и морщинами, седая щетина, вязаная шапка, мягкий холодный свет
Порядок слов внутри описания почти не влияет, а вот конкретика влияет сильно: объект, обстановка, время суток, свет, ракурс и стиль. Удачное описание стоит сохранить кнопкой рядом с полем ввода — потом его можно подставить одним кликом и поменять только детали.
Сколько это стоит
И честная арифметика. Пять готовых кадров — пять кредитов и три с половиной минуты. Те же пять кадров на Нано-банане стоили бы двадцать, на Seedream — почти двадцать восемь. Запомните, когда её брать: перебирать идеи, делать фоны, предметку, пейзажи и сцены без ваших личных фотографий. И когда не брать: когда нужно ваше лицо или ваш товар с фото — там нужны другие модели.
В уроке валюта названа кредитами — это то же самое, что токены в кабинете. Один токен равен одному рублю. Цена конкретной работы всегда написана прямо на кнопке запуска, до того как вы её нажали, а неизрасходованный баланс не сгорает.
Сравнение студий и агентов
Разница между студией и агентом — ключевая мысль всего курса. Студия даёт инструмент: вы сами придумываете идею, сами пишете описание и сами собираете куски в целое. Это дешевле и полностью под вашим контролем. Агент даёт готовый продукт: описываете задачу словами, он задаёт вопросы, показывает план и смету, а потом выполняет всю цепочку сам.
Практическое правило простое. Нужен один элемент — идите в студию. Нужен готовый материал под задачу — идите к агенту. Разница в цене есть, но она заметно меньше разницы в сэкономленном времени.
Кому пригодится
Урок для тех, кто выбирает модель под задачу и не хочет платить за перебор. После него понятно, чем эта нейросеть отличается от соседних в списке, на чём она сильна и где её брать не стоит. Это экономит больше всего токенов: самая частая трата новичка — не дорогая генерация, а десять дешёвых, запущенных не на той модели.
Отдельно урок полезен тем, кто делает картинки на поток: карточки товара, обложки, иллюстрации к постам и статьям. Там разница в цене между моделями складывается в заметные суммы за месяц, а качество на однотипных задачах отличается меньше, чем кажется по обзорам.
Ограничения и советы новичку
Описание из двух слов. Нейросеть не угадывает контекст: чем конкретнее задача, тем ближе результат. Работающая формула для картинки — что в кадре, где и когда происходит, какой свет, какой стиль, какие детали. Слова «качественно» и «красиво» можно смело выбрасывать, они не добавляют ничего.
Проверка текста на глаз. Любые надписи, которые нейросеть рисует внутри картинки, нужно перечитывать: даже сильные модели путают буквы в русских словах. Это разобрано в уроке 34 про ChatGPT Image 2 — пока это единственная модель, которой можно доверить точный текст на макете.
Дорогой первый заход. Черновик всегда дешевле гонять на облегчённой модели и в невысоком разрешении, а хорошее качество включать, когда composition уже устраивает.
Как повторить у себя
Порядок для первого раза такой. Зарегистрируйтесь по почте или войдите одной кнопкой через Яндекс либо ВКонтакте — второй способ быстрее, пароль придумывать не нужно. Стартовые токены начислятся автоматически, их хватает, чтобы попробовать несколько генераций и ничего не платить.
Откройте нужную вкладку и повторяйте за уроком шаг в шаг, не меняя настроек. Когда результат совпадёт с тем, что в видео, начинайте подставлять свою задачу — так сразу видно, какая именно правка на что влияет. Готовые файлы никуда не денутся: всё, что вы создали, лежит в истории генераций с поиском по описанию и стоимостью каждой работы.
Ждать у экрана не нужно. Всё считается на сервере: вкладку можно закрыть и заняться другими делами, готовый файл придёт в историю и в уведомления.
Тайм-коды урока
- 0:00 — а с первого раза почти никогда не выходит
- 0:23 — Урок 36. Кадр за один кредит
- 0:41 — Кто её сделал
- 1:02 — Что обещают разработчики
- 1:25 — Шесть заявленных сторон
- 1:57 — Три версии модели
- 2:20 — Обещание 1. Фотореализм
- 2:39 — Обещание 2. Текст на картинке
- 2:59 — Обещание 3. Знание мира
- 3:20 — Практика. Где она в студии
- 3:33 — Один кредит за кадр
- 3:59 — Проверка 1. Фотореализм
- 4:27 — Проверка 2. Английский текст
- 4:54 — Проверка 3. Русский текст
Что смотреть дальше
Курс собран по порядку, от простого к сложному, но каждый урок самодостаточен.
- Урок 35. Нейросеть Seedream 5 Lite — единственная, которая ходит в интернет
- Урок 37. Нейросеть Grok Imagine — проверяем, что о ней пишут
Полное оглавление всех уроков — на странице бесплатного курса по нейросетям. Там же текстовая инструкция по кабинету и разбор того, чем студии отличаются от ИИ-агентов.
FAQ
Сколько стоит урок?
Нисколько. Весь курс бесплатный: уроки открыты во ВКонтакте и продублированы текстом на сайте, смотреть можно без регистрации. Платить нужно только за собственные генерации в сервисе, и то после того, как закончатся стартовые токены.
Нужен ли опыт работы с нейросетями?
Нет. Уроки рассчитаны на человека, который открывает сервис впервые: показано, куда нажимать, что писать в описании и где смотреть цену до запуска.
Обязательно ли смотреть курс по порядку?
Не обязательно. Каждый урок самодостаточен, но первые уроки объясняют устройство кабинета и токены — с ними дальше проще.
Сколько идёт этот урок?
7:54 минут. Если повторять за ним в своём кабинете, закладывайте вдвое больше: генерации считаются на сервере от нескольких секунд до минуты.
Нужен ли VPN или зарубежная карта?
Нет. Genosai работает из России напрямую, интерфейс на русском, оплата обычной российской картой, отдельная подписка на каждую нейросеть не нужна.
Урок не устареет после обновления сервиса?
Интерфейс меняется постепенно, а логика остаётся: выбрать модель, описать задачу, проверить цену на кнопке, запустить. Когда изменения заметные, урок переснимается.