Дали больше материала — комикс стал хуже
Когда глава заканчивается, из неё можно собрать комикс: несколько страниц с кадрами, репликами в облачках и подписями, всё это скачивается одним PDF.
Устроено это так. Модель получает пересказ главы и список действующих лиц и возвращает раскадровку: страницы, кадры, для каждого кадра — план, ракурс, кто в кадре и что происходит. Дальше каждый кадр рисуется отдельно. Реплики и звуки в картинку не попадают вообще — их наносит поверх готового изображения Pillow. Это не выбор стиля, а необходимость: генератор изображений не умеет писать буквы, и всё, что он пытается написать, оказывается похожим на текст узором.
Рисование стоит настоящих денег, поэтому раскадровка идёт первой и отдельно. Она дешёвая, и на ней всё останавливается: показывается смета, и ни один кадр не рисуется, пока вы её не подтвердите.
Очевидная идея
Пересказ короткий — абзац. Комикс из него выходит на одну страницу, и для главы, в которой было три-четыре разных места, это мало.
При этом в базе лежит полный лог партии: каждое действие игрока, каждый ответ Мастера. Там в разы больше материала. Логика простая — возьми лог вместо пересказа, получишь длиннее и подробнее.
23 июля мы так и сделали. На реальной сыгранной главе: пересказ — 1154 знака, одна страница. Лог — около 5700 знаков, две страницы и восемь кадров.
Страниц стало вдвое больше. Комикс стал хуже.
Что именно сломалось
В общих планах появились люди, которых в сцене не было. В логе кузнец упоминался соседней репликой — и модель ставила его в кадр. Персонажи оказывались не там, где их описали двумя строками выше. А описания кадров стали заметно плотнее, и на этом спотыкался уже генератор изображений: чем больше деталей ему дать, тем охотнее он дублирует предметы и дорисовывает то, чего никто не просил.
Мы вернули пересказ.
Почему так вышло
Мы считали пересказ потерей: длинный текст ужали до абзаца, часть подробностей выкинули. Оказалось, что выкидывание — это и есть работа.
Пересказ отдаёт раскадровке несколько понятных сцен. Лог отдаёт хронику ходов, в которой сцены не размечены, и разбирать её на кадры модель вынуждена сама — по ходу дела решая, что было отдельным моментом, а что продолжением предыдущего. Она это делает, но плохо, и ошибается ровно там, где ошиблись бы вы, если бы вам дали стенограмму вместо сценария.
Больше входных данных — не то же самое, что больше полезных входных данных. Мы это знали в общем виде и всё равно потратили день, чтобы убедиться на своём.
Что дальше
Правильный способ получить подробность лога без его шума — не подменять источник, а работать в два прохода: сначала вытащить из пересказа скелет сцен (какие сцены, кто в них, где происходит), потом по каждой сцене дочитать соответствующий кусок лога и уточнить детали. Тогда чистое разбиение на сцены остаётся, а подробности добавляются внутрь уже размеченных кадров.
Это пока не сделано — записано как направление, не как план на неделю.
И честности ради — из известного и незакрытого. Кадры рисуют персонажей в неправильном снаряжении: в описание внешности идёт свободный текст, а надетые вещи из инвентаря туда не попадают вовсе. Так что герой может выйти в кадр без меча, который вы ему только что купили.