Каталог на десять тысяч позиций, половина карточек — с пустым описанием или строкой из прайса. Написать вручную нереально: копирайтер закроет по тридцать карточек в день, и это займёт год. Нейросеть кажется спасением — «сгенерируем всё за ночь». Но наивная массовая генерация приносит не меньше проблем, чем пустые карточки: выдуманные характеристики, одинаковая вода, возвраты из-за неточностей. Разница между провалом и результатом — в пайплайне и контроле качества.
Эта статья — о том, как выстроить генерацию описаний товаров нейросетью не как разовый трюк, а как управляемый процесс: подготовка данных, промпты по категориям, запрет выдумок, модерация, борьба с дублями и запись в каталог 1С-Битрикс без рассинхрона. Речь про систему, которую можно доверить каталогу, а не про «поиграться». Построение таких процессов — часть автоматизации на 1С и работы с товарными данными.
Коротко
- Генерация описаний — это пайплайн, а не «сгенерировать и опубликовать»: обязателен этап модерации.
- Качество текста определяется входными данными: чистые структурированные свойства товара на входе — точный текст на выходе.
- Запрещайте нейросети выдумывать характеристики; она пишет только по переданным фактам.
- Определите источник правды для описаний (1С или сайт), чтобы генерация не перезаписывала контент.
Зачем генерировать описания и где риск
Мотив понятен: тысячи карточек без описаний плохо продают и плохо ранжируются, а ручной копирайтинг дорог и медленен. Нейросеть закрывает объём, недостижимый вручную, и делает это за часы. Для среднего и крупного каталога это реальный рычаг.
Но у медали есть обратная сторона. Языковая модель уверенно пишет правдоподобный текст, даже когда фактов у неё нет, — и тогда она их придумывает: приписывает товару функции, путает материалы, добавляет несуществующие характеристики. В описании товара это не безобидно: покупатель принимает решение по тексту, а расхождение с реальностью оборачивается возвратами и претензиями. Поэтому генерацию нельзя пускать без контроля — риск переносится с «нет описания» на «есть, но неверное».
Пайплайн целиком: от данных до публикации
Рабочая генерация — это конвейер из нескольких этапов, каждый из которых важен.
- Подготовка данных. Собрать и нормализовать свойства товаров: название, характеристики, категория, бренд.
- Формирование промпта. Собрать запрос к нейросети с реальными данными товара и правилами написания.
- Генерация. Пакетный вызов ИИ-сервиса для каждого товара с ограничением скорости и логированием.
- Проверки. Автоматический контроль: факты, длина, дубли, запрещённые формулировки.
- Модерация. Ручная проверка — сплошная для сложных товаров, выборочная для типовых.
- Публикация. Запись одобренного текста в поле товара с учётом источника правды.
Пропуск любого этапа снижает качество. Чаще всего экономят на подготовке данных и модерации — и именно это даёт худший результат.
Подготовка и нормализация данных
Нейросеть не знает ваш товар — она пишет по тому, что вы ей передали. Поэтому качество описания определяется на входе, ещё до всякой генерации. Если свойства товара пустые, противоречивые или лежат в свободном тексте вместо структурированных полей, текст будет водянистым.
Что входит в подготовку:
- Заполненные свойства. Ключевые характеристики должны быть в структурированных полях инфоблока, а не только в названии.
- Нормализация значений. Единые единицы измерения, форматы, справочники брендов и категорий без дублей.
- Чистка мусора. Удаление артефактов из прайсов, служебных кодов, обрезанных строк.
- Отбор товаров. Определить, каким товарам генерируем в первую очередь — например, тем, что без описаний и с трафиком.
Часто товарные данные ведутся в 1С и приходят на сайт обменом. Тогда наведение порядка в свойствах — это работа и на стороне учётной системы. Аудит и приведение данных в порядок — область аудита и оптимизации 1С: чистые данные в источнике улучшают не только генерацию, но и весь каталог.
Промпты и шаблоны по категориям
Если всем товарам скормить один и тот же общий промпт, получится однообразная вода. Хороший подход — шаблоны промптов под категории. Описание смартфона строится вокруг одних характеристик (экран, память, камера), описание дивана — вокруг других (материал, размеры, механизм). Промпт под категорию задаёт структуру и подсказывает, какие свойства важны.
В промпт передают конкретные данные товара и правила: тон, длину, что упоминать обязательно, а что запрещено. Чем конкретнее данные и чётче правила, тем меньше «фантазии» и воды. Управление промптами и шаблонами — по сути отдельная логика, которую удобно оформить как модуль или сервис. Принципы построения таких расширений мы разбирали в статье про разработку своего модуля для 1С-Битрикс.
Фактическая точность и запрет выдумок
Главная опасность генерации — уверенная выдумка. Модель заполняет пробелы правдоподобными, но ложными фактами. Бороться с этим нужно на двух уровнях.
Первый — промпт. В нём явно запрещают добавлять характеристики, которых нет во входных данных: «пиши только по переданным фактам, не придумывай свойства». Это резко снижает количество вымысла, хотя и не убирает его полностью.
Второй — автоматические проверки. Сгенерированный текст сверяют с реальными полями товара: если в описании упомянут материал или функция, которых нет в свойствах, это флаг на модерацию. Такие проверки не ловят всё, но отсеивают грубые расхождения до публикации.
Модерация и контроль качества
Модерация — этап, на котором чаще всего экономят и зря. Даже с хорошими промптами часть текстов будет неточной или неудачной, и публиковать всё вслепую нельзя. Разумная модель — дифференцированный контроль:
| Тип товара | Уровень контроля | Почему так |
|---|---|---|
| Дорогие и технически сложные | Сплошная ручная модерация | Цена ошибки высока: возвраты, претензии, репутация |
| Типовые массовые | Выборочная проверка + автопроверки | Объём велик, риск отдельной ошибки умеренный |
| Простые аксессуары | Автопроверки, спот-контроль | Короткие описания, низкая цена ошибки |
Модерацию удобно организовать как очередь: сгенерированные тексты попадают в список на проверку, модератор одобряет, правит или отклоняет. Одобренное уходит в публикацию, отклонённое — на перегенерацию с уточнённым промптом. Так контроль качества встроен в процесс, а не остаётся на словах.
Борьба с дублями и однообразием
Массовая генерация склонна к повторам: похожие товары получают почти одинаковые тексты, а по каталогу расползаются шаблонные фразы. Это плохо и для покупателя, и для SEO. Меры против однообразия:
- Индивидуальные данные в промпте. Тексты опираются на конкретные отличия товаров, а не на общие слова.
- Проверка на близкие дубли. Сгенерированные описания сравнивают между собой; слишком похожие отправляют на доработку.
- Вариативность структуры. Разные шаблоны и порядок подачи для разных категорий и подкатегорий.
- Контроль повторяющихся фраз. Отслеживание «любимых» оборотов модели, которые кочуют из текста в текст.
Проверка на дубли — это работа с текстовыми данными в базе, где важна производительность на больших объёмах. Эффективные выборки и сравнение удобно строить на современном API доступа к данным — про него мы писали в статье про D7 и ORM в 1С-Битрикс.
Запись в каталог и источник правды
Готовый одобренный текст нужно записать в каталог. Описание — это поле или свойство товара в инфоблоке (например, детальное описание). Запись идёт через API Битрикса или при импорте. Но здесь возникает ключевой вопрос: где «источник правды» для описаний?
Возможны два сценария. Если описания ведутся в 1С и приходят обменом, генерацию встраивают до выгрузки, чтобы обмен не перезатирал сайтовый текст. Если контент живёт на сайте, запись идёт прямо в инфоблок, а обмен настраивают так, чтобы он не трогал поле описания. Смешивать оба источника без чёткого правила нельзя — иначе очередной обмен молча сотрёт сгенерированные тексты. Настройка правил обмена, что и откуда перезаписывается, — типовая задача при автоматизации продаж и склада на 1С.
Инфраструктура генерации на большом каталоге
Генерация тысяч описаний — это фоновый пакетный процесс, а не операция «на лету». Строить его нужно так, чтобы он не мешал боевому сайту и был устойчив к сбоям:
- Очередь и агенты. Товары обрабатываются пакетами в фоне, а не при открытии карточки покупателем.
- Ограничение скорости. Обращения к ИИ-сервису лимитируются, чтобы не упереться в лимиты и стоимость.
- Логирование и повторы. Каждый вызов логируется; сбойные повторяются, а не теряются.
- Изоляция от боевого сайта. Тяжёлый процесс не нагружает витрину, генерация идёт отдельно.
Отдельный вопрос — где всё это крутится и как выдерживает нагрузку. Про требования к инфраструктуре 1С-Битрикс и масштабирование мы писали в статье про хостинг и инфраструктуру BitrixVM.
SEO и уникальность текстов
Есть опасение, что массовая генерация навредит SEO. Она навредит, если публиковать шаблонную воду ради объёма. Но грамотный пайплайн, наоборот, помогает: он закрывает тысячи пустых карточек осмысленным текстом на основе реальных характеристик, а именно этого не хватает большинству каталогов.
Ключ — не факт использования нейросети, а качество результата: уникальность, фактическая точность, польза для покупателя. Тексты, которые отвечают на вопросы о товаре и отличаются друг от друга, работают на ранжирование. Тексты-клоны без фактов — против. Поэтому контроль дублей и модерация — это не только про покупателя, но и про SEO.
Экономика и что мерить
Чтобы понять, оправдана ли генерация, её считают в деньгах и метриках. Основная экономия — на ручном копирайтинге: вместо оплаты за каждое описание вы платите за токены и за модерацию, которая быстрее написания с нуля. Для каталога в тысячи позиций это обычно окупается кратно.
Но экономику нужно смотреть целиком. Что отслеживать:
- Стоимость описания. Токены плюс время модерации против стоимости ручного копирайтинга.
- Долю карточек с описанием. Как быстро закрываются пустые карточки.
- Конверсию и отказы. Меняется ли поведение на карточках с новыми описаниями.
- Возвраты и претензии. Не растут ли из-за неточностей — контрольная метрика качества.
Сэкономленные на копирайтере деньги не должны утечь в возвраты из-за неверных текстов — поэтому экономия и контроль качества считаются вместе.
Частые ошибки
- Генерация без подготовки данных. Мусор на входе — вода на выходе.
- Публикация без модерации. Выдуманные характеристики попадают в каталог и дают возвраты.
- Один промпт на всё. Однообразные шаблонные тексты по всему каталогу.
- Нет запрета на выдумки. Модель дописывает несуществующие свойства.
- Не определён источник правды. Обмен с 1С затирает сгенерированные описания.
- Генерация нагружает боевой сайт. Тяжёлый процесс тормозит витрину.
- Не считают возвраты. Экономия на копирайтинге теряется на неточностях.
Чек-лист внедрения
- Данные приведены в порядок. Свойства заполнены и нормализованы, мусор вычищен, отобраны приоритетные товары.
- Промпты по категориям. Шаблоны учитывают важные свойства и задают тон, длину и правила.
- Запрет выдумок. В промпте — только по фактам; автопроверки сверяют текст со свойствами.
- Модерация встроена. Очередь на проверку, дифференцированный контроль по типам товаров.
- Дубли под контролем. Проверка на близкие тексты, вариативность структуры.
- Источник правды определён. Правила записи и обмена исключают перезатирание описаний.
- Инфраструктура готова. Фоновая очередь, лимиты, логи, изоляция от боевого сайта.
- Метрики считаются. Стоимость, покрытие, конверсия и возвраты отслеживаются.
Вывод
Генерация описаний нейросетью работает не как волшебная кнопка, а как управляемый пайплайн: чистые данные на входе, промпты по категориям, жёсткий запрет выдумок, модерация и контроль дублей, аккуратная запись в каталог с чётким источником правды. Пропуск любого из этих этапов превращает экономию в источник возвратов и претензий.
Построенный правильно, такой процесс закрывает тысячи пустых карточек полезным и точным текстом за долю стоимости ручного копирайтинга, помогает SEO и не нагружает боевой сайт. Начинается всё с порядка в товарных данных и связки с 1С — именно фундамент, а не сама нейросеть, определяет результат.