Создавайте фото и видео генерации в одном месте

Здесь собраны лучшие нейросети в одном месте. Выбирайте любую модель - от самых быстрых и дешёвых до топовых по качеству.

Назад в блог

Как создать многостраничный комикс с помощью нейросети ChatGPT и GPT Image 2

Время чтения - 12 мин
Автор статьи Пётр Васильев

Автор - Пётр Васильев

Разработчик ИИ-сервиса

Как создать многостраничный комикс с помощью нейросети

Один красивый кадр сгенерировать легко. Настоящая проблема начинается на пятой странице - герой внезапно меняет лицо, комната становится другой, пальто превращается в куртку, а речевой пузырь съезжает в угол. Многостраничный комикс требует не одного удачного промта, а системы - библии проекта, листов персонажей, листов локаций, лога промтов и понятного порядка сборки.

ChatGPT и GPT Image 2 работают в связке - первый держит нарративную логику и генерирует промты, второй переводит их в визуал. Ниже - как выстроить этот процесс в нейросети от первой главы до последней страницы.

Чек-лист: что должно быть готово до первой генерации

Прежде чем запустить нейросеть, проверьте:

  • описание мира и сеттинга
  • ДНК каждого персонажа (черты лица, прическа, одежда, телосложение)
  • единый визуальный стиль и цветовая палитра
  • листы персонажей (три ракурса каждого героя)
  • листы локаций (несколько ракурсов каждого места)
  • размер страницы и количество панелей на ней
  • решение про текст: генерировать в нейросети или добавлять вручную
  • папка для сохранения удачных промтов и панелей

Если что-то из этого отсутствует, лучше заполнить до начала работы, чем переделывать на 15-й странице.

Структура папок проекта

Удобная организация файлов экономит время на длинном проекте:

comic_project/

01_bible/

02_characters/

03_locations/

04_prompts/

05_generated_panels/

06_selected_panels/

07_layouts/

08_final_export/

В 04_prompts храните промты, которые сработали хорошо - с пометкой, для какой сцены и персонажа. Это единственный способ воспроизвести результат через три главы.

Фундамент: библия комикса

Прежде чем генерировать хоть одно изображение в нейросети, нужен документ, который работает как единый источник правды на весь проект. В комикс-индустрии это называется "библия" - описание вселенной, персонажей и визуального языка истории.

Без библии многостраничный комикс разваливается: на 10-й странице персонаж выглядит иначе, чем на 1-й, фоны не согласованы, стиль плывёт. С библией у вас есть документ, который копируется в каждый промт и держит всё вместе.

Что входит в библию

Сеттинг. Где происходит действие, в какое время, какая атмосфера. Это потом переводится в описание фонов и освещения для каждой сцены.

Персонажи. На каждого - отдельный блок с полным визуальным описанием: черты лица, причёска, одежда, телосложение, характерные детали. Это "ДНК персонажа" - текст, который вставляется дословно в каждый промт с этим героем.

Визуальный стиль. Один стиль на весь комикс. Описывайте его через признаки: тип линий, цветовую палитру, плотность теней, композицию, настроение. Это даёт управляемый визуальный язык - flat illustration с толстыми контурами и ограниченной палитрой, manga с динамичными линиями движения, noir с высококонтрастными тенями. Плюс конкретная цветовая палитра и принцип работы с тенями.

Структура. Сколько глав, сколько страниц в главе, сколько панелей на странице.

Как сгенерировать библию через ChatGPT

Опишите историю в свободной форме и попросите ChatGPT оформить её в структуру:

"Я делаю комикс. Вот краткое описание сюжета: [текст]. Составь библию проекта: сеттинг, список персонажей с детальным визуальным описанием каждого, визуальный стиль, структура по главам. Визуальные описания персонажей пиши так, чтобы их можно было напрямую вставить в промт для генератора изображений."

На выходе получаете готовый документ. Сохраните его в папку 01_bible - он будет использоваться на протяжении всей работы.

Сценарий комикса: от главы к панелям

Структура по главам

Многостраничный комикс удобно делать поглавно. Сначала - план всей истории (что происходит, чем заканчивается каждая глава), потом - детализация одной главы за раз.

Попросите ChatGPT составить поглавный план:

"На основе библии составь план комикса по главам. Для каждой главы: краткое содержание, ключевые события, эмоциональная дуга, финальная сцена."

Сценарий главы с промтами

Когда план готов, берёте одну главу и разбиваете её на страницы и панели.

Попросите нейросеть составить сценарий в таком формате:

Страница [номер], Панель [номер] Реплика: [текст в речевом пузыре или нарративная подпись] Комментарий к кадру: [действие, настроение, ракурс] Промт для генерации: [готовый текст на английском для GPT Image 2]

Промты лучше пишите на английском - описания визуального стиля, ракурсов и освещения работают точнее на английском.

Пример одной панели:

Страница 4, Панель 2

Реплика: "Ты не должен был сюда приходить."

Комментарий к кадру: Средний план. Антагонист стоит в дверях, лицо в тени,

угрожающая поза. Напряжение, холодный свет из коридора.

Промт для генерации: Medium shot. Tall man in black coat, sharp jawline, dark short hair, standing in doorway, face half in shadow, arms crossed. Cold blue corridor light from behind. Noir comic style, black ink outlines, high contrast shadows. Speech bubble bottom left: "You shouldn't have come here."

Как вставить ДНК персонажа в процесс

Вставьте описания персонажей из библии в системный промт нейросети - тогда он будет автоматически включать правильное описание в каждый сгенерированный промт, без ручной правки.

Попробовать Sovetnik AI

Генерация комикса: страница за страницей

Лист персонажа - первым делом

Прежде чем рисовать панели, сгенерируйте в нейросети лист каждого персонажа: три ракурса (фронт, профиль, три четверти) с одинаковым описанием. Это визуальный стандарт для всего проекта. Сохраните лучшие варианты в папку 02_characters - к ним придётся возвращаться.

Консистентность на длинной дистанции

Главная сложность многостраничного комикса - удержать персонажа похожим на себя через десятки страниц. Несколько работающих приёмов:

ДНК в каждый промт. Описание персонажа копируется целиком в каждый запрос. Дословно. Даже небольшие отличия - "зелёные глаза" здесь и "светло-зелёные" там - дают разные результаты.

Референсный файл. Папка с 5-7 лучшими панелями персонажа, которые загружаются как референс в GPT Image 2. Модель держит визуальный образ точнее, когда видит его, а не только читает описание.

Генерация 8 в 1. Для серии последовательных панелей одной сцены попросите GPT Image 2 сгенерировать сетку 8 кадров за один запрос. Консистентность внутри одного запроса выше, чем при генерации по одной.

Сетка 3×3 для сцены. Для ключевых сцен запрашивайте 9 панелей одним изображением. Поскольку все кадры на одном холсте, модель держит персонажа одинаковым. Учтите: при такой генерации детализация отдельных кадров может быть ниже, чем при генерации каждой панели отдельно - это нормальный компромисс.

Консистентность фонов и локаций

Персонажи - не единственное, что должно быть консистентным. Если действие в одной локации занимает несколько страниц, фоны тоже должны выглядеть как одно место.

Создайте лист локации - несколько ракурсов одного места с описанием ключевых деталей: мебель, свет, цвета, фактуры. Сохраните в папку 03_locations. Это описание вставляется в промты всех сцен в этой локации.

В промтах для нейросети прописывайте конкретные постоянные детали: "красная кружка на левом углу стола", "неоновая вывеска за окном", "трещина на стене справа". Повторяющиеся детали создают у читателя ощущение непрерывного пространства.

Текст в пузырях

Короткие реплики и крупные звуковые эффекты (БАБАХ, ХРЯСЬ) можно генерировать прямо в GPT Image 2 - для этого оберните текст в двойные кавычки в промте и укажите позицию и вид пузыря:

speech bubble top right: "Ты не должен был сюда приходить.", black outline, white fill.

Для страниц с длинными диалогами лучше генерировать панели без текста, а пузыри добавлять вручную при сборке. Так проще менять реплики, контролировать вёрстку и готовить страницу к публикации.

Точечное редактирование

Когда панель почти готова, но один элемент не так - не перегенерируйте в нейросети с нуля. Загрузите изображение в нейросеть и опишите правку:

"Оставь всё как есть, только измени выражение лица на испуганное и добавь тень под глазами."

В большинстве случаев это помогает сохранить основу кадра. Но результат всё равно нужно проверять, иногда модель затрагивает соседние элементы - фон, свет, одежду. Если это произошло, проще сохранить исходник и попробовать правку снова с другой формулировкой.

Сборка страниц комикса

Раскладка панелей

  • Быстро собрать веб-комикс. Инструмент: Canva. Когда выбирать: Новичку, простые сетки. Минусы: Слабый контроль сетки.
  • Нестандартная типографика. Инструмент: Adobe Express. Когда выбирать: Соцсети, нестандартные сетки. Минусы: Не лучший для сложных страниц.
  • Профессиональный комикс. Инструмент: Clip Studio Paint. Когда выбирать: Печать, манга, леттеринг. Минусы: Сложнее освоить.

Типография и леттеринг

Если добавляете текст вручную в Canva или Clip Studio Paint - выбирайте один шрифт на весь комикс и не меняйте его. Для кириллицы подходят комикс-шрифты с поддержкой кириллицы: их можно найти на Google Fonts по запросу "comic cyrillic".

Если текст генерирует нейросеть - шрифт выбирает она сама, исходя из стиля изображения. Управлять конкретной гарнитурой через промт не получится, но можно описать характер шрифта: "bold hand-lettered style", "clean sans-serif", "rough brush lettering".

Пузыри разных персонажей можно визуально различать: форма, толщина контура, цвет фона. Это помогает читателю мгновенно понимать, кто говорит.

Текст не ставьте ближе 3-5 мм к краю панели - при верстке и печати он рискует попасть под обрез или выглядеть стиснутым.

Экспорт

Для цифровой публикации: PNG или JPEG, 72-150 dpi, ширина от 1000 до 1500 пикселей на страницу. PNG сохраняет качество лучше, JPEG весит меньше - для веб-публикации обычно достаточно JPEG с качеством 85-90%.

Для печати: PDF, 300 dpi, цветовой профиль CMYK, поля безопасности 3-5 мм, вылеты под обрез 3 мм. Исходники панелей храните отдельно в высоком разрешении - требования разных типографий могут отличаться, и переделывать экспорт гораздо проще, когда исходники под рукой.

Работа над несколькими главами комикса

Документация процесса

Заведите рабочий лог в папке 04_prompts: для каждой важной панели записывайте промт, который сработал, с пометкой сцены и персонажа. Когда нужно будет генерировать похожую сцену в следующей главе, у вас есть проверенная отправная точка.

Обновление библии

Если персонаж изменился - сменил одежду, получил шрам, постарел - обновите его ДНК в библии. Старую версию не удаляйте, а помечайте с указанием главы, где произошло изменение. Это единственный способ не запутаться на 5-й главе.

Контекст между сессиями

Языковые модели у ai работают в рамках одного диалога - если начинаете новый разговор, контекст предыдущего теряется. Поэтому библию удобно держать под рукой и вставлять в начало каждого нового диалога. Это занимает 30 секунд и сохраняет весь контекст проекта.

Что не получится в нейросети с первого раза

Нейросеть хорошо помогает с визуалами, но плохо держит длинную производственную дисциплину. Автору всё равно нужно быть редактором, арт-директором и верстальщиком одновременно.

Типичные проблемы, с которыми сталкивается почти каждый:

Персонаж меняется. Герой стал моложе или старше, изменились черты лица, пропала характерная деталь. Решение - загружать референсное изображение вместе с промтом, а не только текстовое описание.

Одежда плывёт. Куртка становится пальто, цвет меняется, исчезают детали. Чем подробнее описание одежды в ДНК, тем стабильнее результат.

Фон меняется между панелями. Даже в одной локации фон может выглядеть по-разному. Лист локации и прописанные постоянные детали снижают этот риск, но не устраняют полностью.

Текст в пузырях искажается. Особенно на кириллице при сложной композиции. Если это критично - генерируйте панели без текста.

Точечное редактирование ломает соседние элементы. Попросили изменить выражение лица - изменился свет, фон или одежда. В таких случаях проще работать с исходным промтом, а не с правкой готового изображения.

Сетка панелей получается кривой. При генерации нескольких панелей одним запросом края могут быть неровными, размер панелей - неодинаковым. Это правится на этапе сборки вручную.

Всё это не повод отказываться от инструмента - но повод не ожидать идеального результата с первого запроса.

Частые ошибки

Начинать без библии. Первые страницы выглядят нормально, но к 10-й персонаж уже другой человек, стиль поплыл, а исправить это задним числом - значит перегенерировать половину работы.

Описывать персонажа по-разному в разных промтах. "Зелёные глаза" и "изумрудные глаза" - это разные персонажи для модели. Один документ с ДНК, одно описание, копируется дословно.

Генерировать пузыри расплывчато. "Добавь текст" - не промт. Нужны: позиция пузыря, форма, цвет фона, точная фраза в кавычках.

Не делать лист локации. Персонажи консистентны, а комната каждый раз другая - история теряет пространственную логику.

Не сохранять удачные промты. Сгенерировали хорошую панель и не записали промт - воспроизвести точно такой же результат будет невозможно.

Пример: первая страница комикса о рыцаре и некроманте

Разберём процесс на конкретном примере - от библии до промтов для первой страницы.

Шаг 1. Запрос к ChatGPT: библия проекта

Запрос:

"Я делаю многостраничный комикс. Сюжет: рыцарь приходит мстить некроманту, который сжёг его деревню. Составь библию проекта: сеттинг, визуальный стиль, ДНК двух главных персонажей - рыцаря и некроманта. Описания персонажей пиши так, чтобы их можно было напрямую вставить в промт для GPT Image 2."

Результат (фрагмент библии):

СЕТТИНГ

Тёмное фэнтези, средневековье. Выжженные поля, руины деревень,

мёртвые леса. Постоянная облачность, приглушённый свет.

Атмосфера: тяжёлая, безнадёжная, с редкими проблесками воли главного героя.

ВИЗУАЛЬНЫЙ СТИЛЬ

Western comic, тёмная палитра (серый, чёрный, приглушённый красный как акцент),

толстые чёрные контуры, высококонтрастные тени, минимум ярких цветов.

Стиль напоминает европейский графический роман - детализированный,

без упрощений манги.

ДНК: РЫЦАРЬ (Адар)

Male warrior, late 30s, scarred face with a diagonal scar across the left cheek,

short dark hair, grey eyes, heavy dented plate armor with a red cape (torn at edges),

broadsword on the back, tall and broad-shouldered. Expression: grim determination.

ДНК: НЕКРОМАНТ (Малус)

Male sorcerer, 50s, pale gaunt face, sunken dark eyes with purple shadows,

long silver hair, black hooded robe with bone ornaments on the belt,

long thin fingers. Expression: cold amusement.

Шаг 2. Лист персонажа - промт для GPT Image 2

Перед первой страницей генерируем лист Адара в трёх ракурсах:

Character reference sheet. Three views: front, side profile, three-quarter. Male warrior, late 30s, scarred face with a diagonal scar across the left cheek, short dark hair, grey eyes, heavy dented plate armor with a red cape torn at edges, broadsword on the back, tall and broad-shouldered. Dark fantasy western comic style, thick black outlines, high contrast shadows, muted color palette (grey, black, dark red accents). White background. No speech bubbles. No background.

Лист персонажа для комикса в GPT Image 2
Лист персонажа для комикса в GPT Image 2

Шаг 3. Сценарий первой страницы - запрос к ChatGPT

На основе библии напиши сценарий первой страницы комикса (4 панели). Страница открывает историю: Адар приближается к башне некроманта через выжженное поле - там, где была его деревня. Для каждой панели дай: реплику, комментарий к кадру и промт для GPT Image 2 на английском языке. В промтах используй ДНК персонажа полностью.

Шаг 4. Результат - промты для четырёх панелей

Панель 1

Реплика: (нет - немая панель, только пейзаж)

Комментарий: Широкий план. Выжженное поле до горизонта, вдали - одинокая

тёмная башня. Пепел, обугленные брёвна, тишина.

Промт для генерации:

Wide establishing shot. Burned field stretching to the horizon, scorched earth, ash and charred wooden ruins of a village. A dark stone tower in the far distance. Overcast sky, no sun. Dark fantasy western comic style, thick black outlines, high contrast shadows, muted palette: grey, black, dark red accents. No characters. Cinematic composition, low angle.

Панель 1 комикса о рыцаре и некроманте
Панель 1 комикса о рыцаре и некроманте

Панель 2

Реплика: (нет - немая панель)

Комментарий: Средний план сзади. Адар идёт через пепелище,

силуэт на фоне серого неба. Видна спина, броня, красный плащ.

Промт для генерации:

Medium shot from behind. Male warrior, late 30s, heavy dented plate armor with a red cape torn at edges, broadsword on the back, tall and broad-shouldered. Walking through burned field, ash swirling around boots. Dark stone tower visible in the distance. Overcast sky. Dark fantasy western comic style, thick black outlines, high contrast shadows, muted palette: grey, black, dark red accents.

Панель 2 комикса о рыцаре и некроманте
Панель 2 комикса о рыцаре и некроманте

Панель 3

Реплика: "Я обещал вернуться."

Комментарий: Крупный план лица Адара. Он смотрит вперёд, взгляд тяжёлый,

скула в шраме. Пепел летит мимо.

Промт для генерации:

Close-up shot. Male warrior, late 30s, scarred face with a diagonal scar across the left cheek, short dark hair, grey eyes. Looking forward, expression of grim determination. Ash particles floating in the air. Dark fantasy western comic style, thick black outlines, high contrast shadows, muted palette. Speech bubble bottom left: "Я обещал вернуться."

Панель 3 комикса о рыцаре и некроманте
Панель 3 комикса о рыцаре и некроманте

Панель 4

Реплика: "Малус."

Комментарий: Широкий план снизу вверх. Башня некроманта крупным планом -

мрачная, высокая, окна горят слабым фиолетовым светом. Адар стоит у основания,

маленький на фоне башни.

Промт для генерации:

Low angle wide shot. Tall dark stone necromancer's tower, imposing and crumbling, narrow windows glowing with faint purple light. Male warrior at the base of the tower — small figure, heavy dented plate armor, red torn cape, broadsword on back. Looking up at the tower. Dark overcast sky. Dark fantasy western comic style, thick black outlines, high contrast shadows, muted palette: grey, black, purple accent on tower windows. Speech bubble coming from the armored warrior figure at the bottom of the image, bubble tail pointing toward the warrior, positioned bottom-left corner, white fill, black outline, small text: "Малус."

Панель 4 комикса о рыцаре и некроманте
Панель 4 комикса о рыцаре и некроманте

Нейросеть не делает многостраничный комикс за автора. Она ускоряет производство кадров, но не заменяет систему. Если нет библии, референсов, логов и контроля вёрстки - получится не комикс, а набор похожих картинок. Если всё это есть, ChatGPT и GPT Image 2 становятся рабочей связкой: один помогает держать сценарий и промты, второй собирает визуальный материал.

Вопросы и ответы

Можно ли создать комикс с нейросетью без навыков рисования?+

Да. ChatGPT помогает написать сценарий и сгенерировать промты, GPT Image 2 - нарисовать панели. Для сборки страниц достаточно Canva. Художественные навыки не нужны, но потребуется освоить составление промтов и выстроить систему документов: библию, листы персонажей и лог промтов.

Как сохранить одинаковый внешний вид персонажа на всех страницах комикса?+

Главный инструмент - «ДНК персонажа»: подробное текстовое описание внешности, которое вставляется дословно в каждый промт. Дополнительно помогают: лист персонажа (три ракурса), загрузка референсного изображения вместе с промтом и генерация нескольких панелей одним запросом.

GPT Image 2 умеет рендерить текст в речевых пузырях?+

Да, в том числе кириллицу. Для коротких реплик это работает достаточно надёжно: нужно обернуть текст в двойные кавычки и указать позицию пузыря в промте. Для длинных диалогов надёжнее генерировать панели без текста и добавлять пузыри вручную в Canva или Clip Studio Paint.

Сколько времени занимает создание одной страницы комикса?+

При готовой библии и листах персонажей - от 30 минут до 2 часов на страницу в зависимости от количества панелей и количества итераций генерации. Первая страница занимает дольше: нужно выстроить систему и отладить промты.

Почему персонаж меняет внешность от панели к панели?+

Это типичная проблема при работе с генеративными моделями. Решение — жёсткая система: единое текстовое описание персонажа («ДНК»), которое копируется дословно в каждый промт, плюс загрузка референсного изображения вместе с запросом. Даже небольшие изменения в формулировке - «зелёные глаза» vs «светло-зелёные» - дают разный результат.