Текст на карточке: набранный шрифтом против нарисованного нейросетью
Спросите у сервиса генерации карточек, откуда на картинке текст. Если его рисует нейросеть — вы получите красивую обложку, в которой «1,7 л» однажды станет «1,7 п», а поправить это можно будет только перерисовав всё. Разбираем, чем набранный текст отличается от нарисованного и почему это важнее выбора модели.
Филимонов Иван2 мин чтения

Два способа положить текст
Первый — нарисовать. Модели попросили: «карточка чайника с заголовком „Чайник электрический“ и плашкой „1,7 л“». Она рисует картинку целиком, и текст в ней — такие же пиксели, как блик на стали. Второй — набрать. Нейросеть рисует сцену без единой буквы, а заголовок и плашки верстаются шрифтом поверх, как обычная веб-страница, и результат рендерится в картинку.
Внешне результат может быть похож. По устройству это противоположные вещи: в первом случае текст — часть изображения, во втором — отдельный слой с настоящими буквами.
Что не так с нарисованным
- Ошибки. Модели рисуют буквы как формы, а не как символы: лишний штрих, перевёрнутая «и», пропавшая точка в «1,7». На кириллице это случается чаще, чем на латинице, — её в обучении меньше.
- Мелкий кегль. Чем меньше текст, тем хуже: некоторые сервисы генерации прямо пишут в документации, что мелкий шрифт модели даётся тяжело, и советуют добавлять его в редакторе поверх. То есть признают, что рисовать текст не стоит.
- Правка. Опечатку в нарисованном тексте нельзя исправить — можно только сгенерировать заново, и сцена при этом тоже изменится. Серия из шести слайдов с одинаковым заголовком у нарисованного текста будет шестью разными заголовками.
- Шрифт. Вы не выбираете гарнитуру, кегль и цвет — вы получаете то, что модель решила похожим на «современный шрифт». Единого стиля у бренда при этом не будет.
- Стоп-слова. Нарисованную «скидку 20 %» модерация снимет вместе с карточкой, а стереть её нельзя — она часть картинки.
Как устроен набранный текст
У нас карточка — это HTML-макет: слоты под заголовок, буллиты, плашки и позицию товара, стили — CSS-переменные. Данные товара подставляются в макет, и headless-браузер рендерит страницу в PNG нужного разрешения. Тот же макет открывается в редакторе кабинета — поэтому превью и результат физически не могут разойтись: это одна и та же вёрстка.
Что из этого следует. Текст всегда точный — это те символы, которые вы ввели. Правится за секунду без перегенерации сцены. Шрифт один на всю серию, кегль подстраивается под длину строки, перенос кириллицы правильный. Стоп-слова ловятся до вёрстки: строка с ценой или контактом просто не попадает в макет. И для Ozon это ещё и единственный способ гарантировать, что на главном фото текста нет — его там не рисует никто.
Когда нарисованный текст всё же уместен
Есть жанр, где текст — часть художественного образа: постер, рекламный креатив, обложка «в стиле журнала». Там неточность допустима, а вёрстка поверх выглядела бы чужеродно. В конвейере для этого есть «Креативная обложка» — свободный сценарий, где модель рисует всё, включая надписи. Он доступен только на слайдах, где площадка разрешает текст, и в него не попадают стоп-слова: строки с ценой и контактами вычищаются до того, как уйти в задание модели.
Для всего остального — инфографики, характеристик, заголовков — текст набирается. Это не вопрос вкуса, а вопрос того, останется ли «1,7 л» на месте.
Вопросы по теме статьи
Как понять, набран текст на карточке или нарисован?
Увеличьте картинку: у нарисованного текста буквы разной толщины, неровные края, случаются лишние штрихи. У набранного — ровные символы одной гарнитуры. И спросите у сервиса, можно ли поправить опечатку без перегенерации.
Нейросети уже умеют писать без ошибок?
Лучше, чем раньше, но не гарантированно — особенно кириллицу и мелкий кегль. Для карточки, где «1,7 л» должно быть ровно «1,7 л», гарантия нужна.
Что происходит с текстом при пересборке серии?
У набранного текста заголовок один на все слайды и меняется в одном месте. У нарисованного каждый слайд — новая генерация с новым вариантом надписи.
Услуга
Фото и карточка с инфографикой
Всё, о чём написано выше, конвейер SnapShelf делает сам: одно фото на входе, карточка по правилам площадки на выходе. При регистрации начисляются кредиты на пробу, карту вводить не нужно.
Читайте дальше

Почему нейросеть перерисовывает товар
Любая модель генерации дрейфует в геометрии и этикетках. Что это значит для возвратов, чем строгий режим отличается от свободного и как проверяется, что товар на карточке — тот же, что на фото.

Фото на модели без фотосессии
Как получить одежду на человеке из фото на манекене или в раскладке, зачем нужна библиотека референсов и почему одна и та же модель на всей серии важнее «красивого лица».

Сколько слайдов нужно карточке
Зачем карточке шесть–восемь слайдов, в каком порядке они работают, что показывает каждый и почему серия должна собираться одним стилем, а не по одному кадру.
