SnapShelf
Фото и инфографика

Текст на карточке: набранный шрифтом против нарисованного нейросетью

Спросите у сервиса генерации карточек, откуда на картинке текст. Если его рисует нейросеть — вы получите красивую обложку, в которой «1,7 л» однажды станет «1,7 п», а поправить это можно будет только перерисовав всё. Разбираем, чем набранный текст отличается от нарисованного и почему это важнее выбора модели.

Филимонов Иван2 мин чтения

Карточка с заголовком и плашками, набранными шрифтом, и карточка с размерной сеткой

Два способа положить текст

Первый — нарисовать. Модели попросили: «карточка чайника с заголовком „Чайник электрический“ и плашкой „1,7 л“». Она рисует картинку целиком, и текст в ней — такие же пиксели, как блик на стали. Второй — набрать. Нейросеть рисует сцену без единой буквы, а заголовок и плашки верстаются шрифтом поверх, как обычная веб-страница, и результат рендерится в картинку.

Внешне результат может быть похож. По устройству это противоположные вещи: в первом случае текст — часть изображения, во втором — отдельный слой с настоящими буквами.

Что не так с нарисованным

  • Ошибки. Модели рисуют буквы как формы, а не как символы: лишний штрих, перевёрнутая «и», пропавшая точка в «1,7». На кириллице это случается чаще, чем на латинице, — её в обучении меньше.
  • Мелкий кегль. Чем меньше текст, тем хуже: некоторые сервисы генерации прямо пишут в документации, что мелкий шрифт модели даётся тяжело, и советуют добавлять его в редакторе поверх. То есть признают, что рисовать текст не стоит.
  • Правка. Опечатку в нарисованном тексте нельзя исправить — можно только сгенерировать заново, и сцена при этом тоже изменится. Серия из шести слайдов с одинаковым заголовком у нарисованного текста будет шестью разными заголовками.
  • Шрифт. Вы не выбираете гарнитуру, кегль и цвет — вы получаете то, что модель решила похожим на «современный шрифт». Единого стиля у бренда при этом не будет.
  • Стоп-слова. Нарисованную «скидку 20 %» модерация снимет вместе с карточкой, а стереть её нельзя — она часть картинки.

Как устроен набранный текст

У нас карточка — это HTML-макет: слоты под заголовок, буллиты, плашки и позицию товара, стили — CSS-переменные. Данные товара подставляются в макет, и headless-браузер рендерит страницу в PNG нужного разрешения. Тот же макет открывается в редакторе кабинета — поэтому превью и результат физически не могут разойтись: это одна и та же вёрстка.

Что из этого следует. Текст всегда точный — это те символы, которые вы ввели. Правится за секунду без перегенерации сцены. Шрифт один на всю серию, кегль подстраивается под длину строки, перенос кириллицы правильный. Стоп-слова ловятся до вёрстки: строка с ценой или контактом просто не попадает в макет. И для Ozon это ещё и единственный способ гарантировать, что на главном фото текста нет — его там не рисует никто.

Когда нарисованный текст всё же уместен

Есть жанр, где текст — часть художественного образа: постер, рекламный креатив, обложка «в стиле журнала». Там неточность допустима, а вёрстка поверх выглядела бы чужеродно. В конвейере для этого есть «Креативная обложка» — свободный сценарий, где модель рисует всё, включая надписи. Он доступен только на слайдах, где площадка разрешает текст, и в него не попадают стоп-слова: строки с ценой и контактами вычищаются до того, как уйти в задание модели.

Для всего остального — инфографики, характеристик, заголовков — текст набирается. Это не вопрос вкуса, а вопрос того, останется ли «1,7 л» на месте.

Вопросы по теме статьи

Как понять, набран текст на карточке или нарисован?
Нейросети уже умеют писать без ошибок?
Что происходит с текстом при пересборке серии?

Услуга

Фото и карточка с инфографикой

Всё, о чём написано выше, конвейер SnapShelf делает сам: одно фото на входе, карточка по правилам площадки на выходе. При регистрации начисляются кредиты на пробу, карту вводить не нужно.