Прайс-лист в PDF можно превратить в готовые к продаже карточки товаров
Назад в блог
Team Katapic
09.09.2026
11 min

Прайс-лист в PDF можно превратить в готовые к продаже карточки товаров

Узнайте, как прайс-лист в PDF читается блоками, сопоставляется с полями товаров и синхронизируется с WooCommerce по SKU без дублей и выдуманных GTIN.

Из PDF — в карточки товаров, которые магазин действительно может продавать

A Прайс-лист в PDF превращается в карточки товаров, когда каждая строка сопоставляется с полями магазина: названием, SKU, ценой, валютой, GTIN и изображением. Файл читается блоками, а не как скриншот. Колонки, которые на бумаге выглядят выровненными, при извлечении могут объединиться, единицы измерения могут быть указаны только в заголовках, а сноски не попадут в описание, если не перенести их специально. Полнота карточки зависит от сохранённых ячеек, проверенных кодов и прикреплённых фотографий.

Когда краулер или программа чтения товарного фида обращается к товару WooCommerce, она ищет именованные поля: id, title, description, link, image_link, price, availability, brand и gtin либо identifier_exists, если кода производителя нет. PDF, лежащий во входящих сообщениях, эти поля не предоставляет. В Merchant Center › Товары › Фиды нечего загружать, пока строка не станет товарной записью. Практическое изменение носит механический характер: таблица перестаёт быть изображением цен и становится данными, которые может прочитать магазин, фид и ассистент. Поэтому Google читает данные о товарах раньше текста на публичной странице.

Колонки прайс-листа в PDF сопоставлены с полями товара WooCommerce
Страница прайс-листа — это сетка ячеек. Карточка товара — набор именованных полей, которые может прочитать фид.

Почему прайс-лист в PDF сам по себе не обновляет каталог

PDF не передаёт названия, цены или остатки в WooCommerce; каждая строка должна стать товарной записью, прежде чем магазин или фид сможет её использовать.

Поставщики по-прежнему отправляют сезонные прайс-листы в файлах, подготовленных к печати, потому что PDF сохраняет макет, логотипы и юридические примечания. На бумаге это удобно, но как источник каталога такой файл малопригоден. WooCommerce › Товары › Все товары ожидает SKU, название, обычную цену и статус наличия. В PDF этих полей нет, пока программа чтения не отделит строки заголовка от строк таблицы и не назначит каждой колонке своё значение. Пока такое сопоставление не подтверждено, онлайн-каталог устаревает, а PDF на общем диске продолжают считать актуальным списком.

Тот же файл не работает и как товарный фид. Строке фида нужны id, title, description, link, image_link, price с валютой ISO, availability, brand и gtin. Если просто скопировать PDF в описание товара, вся таблица превратится в один текстовый блок. Краулер увидит абзац, а не цену. Если позже понадобится товарный фид WooCommerce для ChatGPT, этот блок всё равно не станет фидом. Начинайте с полей, а не со скриншота списка.

Кому не хватает времени на ежедневное обновление каталога

Тот, кто уже проводит утро, отвечая на вопросы о наличии, не сможет после каждого PDF поставщика заново перепечатывать сорок строк. Практичный подход — прочитать новый файл блоками, один раз подтвердить карту колонок и обновить товары по SKU, чтобы редактировать вчерашние карточки, а не создавать копии. Именно при ручной вставке между PDF, таблицей и WooCommerce чаще всего теряются единицы измерения, сноски и штрихкоды.

Мастерская, которая продаёт керамику и работает примерно с сорока SKU

Мастерская, которая продаёт керамику и работает примерно с сорока SKU, часто получает одностраничный список: код, название глазури, диаметр, упаковка, цена. Эти сорок строк выглядят небольшим объёмом, но скрывают те же проблемы, что и импорт на 400 строк: диаметр только в заголовке, количество в упаковке слито с ценой, сноска о возможности мытья в посудомоечной машине не попала в описание. Сорока карточек достаточно, чтобы неправильная валюта или дублирующийся SKU обнаружились в магазине в тот же день.

Кому нужно обновлять PDF поставщика каждый сезон

Тому, кто обновляет PDF поставщика каждый сезон, нужна повторяемая карта, а не героическая перепечатка. Цены меняются, цвета получают новый суффикс, а снятые с производства коды исчезают. Надёжным ключом остаётся SKU, который уже хранится в WooCommerce. Если применить новый PDF как отдельный импорт без этого ключа, в магазине появятся незаметные дубли, а старые URL продолжат показывать прежнюю цену.

Что на самом деле сохраняется и теряется при чтении PDF блок за блоком

Чтение блоками сохраняет ячейки, которым можно присвоить имя, и отбрасывает элементы макета, не являющиеся полями, включая объединённые колонки, единицы измерения только в заголовке и сноски.

Прайс-лист в PDF — это не одно изображение каталога. Это набор блоков страницы: повторяющиеся заголовки, тело таблицы, нижний колонтитул с юридическими строками и иногда группа фотографий. Программа, работающая блоками, сначала находит таблицу, затем строку заголовка и потом каждую строку данных. Если в файле есть настоящий текстовый слой, эти ячейки представлены символами. Если файл является сканом распечатки, программа использует OCR, поэтому вероятность объединения ячеек возрастает.

Фид ACP — это товарный фид, подготовленный так, чтобы ассистент мог использовать данные магазина — идентификатор, цену, наличие и ссылку, — а не извлекать их из абзаца. Ему по-прежнему нужны те же основные поля, что и любому другому товарному фиду. Извлечение из PDF — лишь первый этап создания такой записи. Типичные потери выглядят так:

  • Объединённые колонки: SKU и название попадают в одну ячейку, поэтому названием товара становится «CR-204 Bowl stoneware».
  • Единица измерения только в заголовке: «Цена / упаковка из 4 шт.» не переносится в строку, и цена карточки выглядит как цена за одну единицу.
  • Сноски: звёздочка возле цены указывает на «без НДС» или «не подходит для микроволновой печи» внизу страницы, но эта фраза не попадает в описание.
  • Повторяющиеся заголовки страниц принимаются за дополнительные товары, а названия колонок становятся SKU.
  • Многостраничные таблицы начинают нумерацию заново, поэтому страница 2 выглядит как новый каталог.
  • Встроенные фотографии расположены рядом с таблицей, но не связаны с SKU.
  • Номера штрихкодов разделены переносом строки, из-за чего контрольная цифра нарушается ещё до создания карточки.

Именно поэтому «импорт PDF», который просто помещает текст в редактор содержимого WooCommerce, не является каталогизацией. Это вставка текста. Именованные поля нужно подтвердить. Такой же принцип действует для спецификации товара без выдуманных характеристик: если PDF не указывает материал, карточка не должна его придумывать.

Строка каталога, которая существует только в PDF, ещё не является товаром. Это изображение таблицы, которое не может разобрать ни один читатель фида.

Как извлечённые ячейки сопоставляются с полями товара

Каждая полезная колонка PDF сопоставляется с одним полем магазина, а всё, чему нельзя дать имя, остаётся вне карточки до подтверждения.

После обнаружения таблицы начинается не переписывание, а составление карты колонок. Нужно посмотреть на заголовки, напечатанные поставщиком, и назначить их полям, понятным магазину и фиду. Практическая карта для прайс-листа может выглядеть так:

  • Code, art., ref. или SKU сопоставляются с id в фиде и SKU в WooCommerce.
  • Description или item name сопоставляются с title; дополнительные примечания идут в description, а не в название.
  • Price сопоставляется с price; символ валюты или код ISO записывается в currency, а не в число.
  • Stock или «available» сопоставляются с availability — in stock, out of stock, preorder, — если PDF действительно это указывает.
  • Brand сопоставляется с brand только тогда, когда в ячейке назван бренд, а не товарная линейка.
  • EAN, UPC, ISBN или GTIN сопоставляются с gtin только после проверки контрольной цифры; в противном случае честным флагом будет identifier_exists.
  • Цвет, размер или упаковка становятся атрибутами (WooCommerce › Товары › Атрибуты), а не второй частью названия.

Автоматически придумывать данные нельзя. Если PDF не указывает вес, карточка не получает вес. Если глазурь обозначена как «синяя», а не «кобальтовая подглазурная», название остаётся «синяя». Обработка с контролем фактов может привести заголовки к единому регистру, удалить оставшийся HTML и заполнить пустые поля характеристик данными из собственного файла продавца. Она не заменяет отсутствующий факт догадкой из интернета. Если два размера имеют одно название, объединять их в варианты с item_group_id можно только после подтверждения, а не незаметно.

Как сопоставить изображения из PDF с SKU

Фотографии, спрятанные в PDF, полезны только тогда, когда извлечены как файлы и связаны с тем же SKU, что и строка товара.

Многие каталоги поставщиков помещают миниатюру в первую колонку или крупное изображение над группой SKU. Программа чтения блоками может извлечь такие изображения из PDF и сохранить их как файлы товаров. Сопоставление — отдельный этап. Фотографию рядом с одной строкой можно связать по позиции. Но фотографию над тремя мисками нельзя присвоить всем трём без подтверждения, поскольку поле image_link, как правило, лучше связывать с одним основным изображением каждой карточки.

Если в PDF нет пригодной фотографии, карточке всё равно потребуется изображение, прежде чем торговые поверхности смогут считать её полной. По наблюдениям, Google и Meta с большей вероятностью принимают изображения товаров размером примерно от 500 × 500 пикселей, хотя точные пороги не опубликованы и могут меняться. Честные варианты: использовать достаточно чёткий фрагмент из PDF, загрузить принадлежащую вам фотографию упаковки, найти изображение в интернете и подтвердить права либо создать иллюстрацию с пометкой о генерации согласно статье 50 AI Act. Общие изображения для нескольких SKU стоит отмечать, поскольку пять мисок с одной миниатюрой выглядят одинаково в Merchant Center › Товары › Фиды.

Фотография товара из PDF сопоставлена с карточкой по соответствующему SKU
Встроенная фотография каталога становится image_link только после извлечения и подтверждения по тому же SKU, что указан в строке.

Как обрабатывать GTIN, цены и валюты

Штрихкоды и цены копируются из PDF продавца и проверяются как числовые значения; их никогда не следует искать в интернете.

GTIN — EAN-13, UPC-A, GTIN-14 или ISBN — это последовательность цифр с контрольной цифрой GS1 в конце. Контрольная цифра рассчитывается по предыдущим цифрам. Если последняя цифра не совпадает с результатом расчёта, код не является действительным GTIN и не должен попадать в карточку. Номер считывается из ячейки PDF, со штрихкода, напечатанного на странице, или с фотографии упаковки, которая уже есть у продавца. Искать его онлайн нельзя: такой поиск может привязать к вашему SKU чужой код.

С ценами нужно поступать так же. Ячейка «€ 12,50*» ещё не является ценой фида. Число — 12.50, валюта — EUR, а звёздочка относится к сноске, которая может означать «без НДС» или «за упаковку из 4 штук». В европейских списках часто используется запятая в качестве десятичного разделителя, а фиды ожидают точку. Не оставляйте символ внутри числа. Не конвертируйте валюту, если PDF не говорит, что список представлен в этой валюте. Поле наличия нужно оставить пустым, если файл его не указывает: старый сезонный PDF не доказывает, что товар есть на складе сегодня.

GTIN считывается из собственного PDF продавца, фотографии упаковки или колонки CSV и должен пройти проверку контрольной цифры GS1. Искать его в интернете нельзя.

Пошаговый путь от файла к товару WooCommerce

Надёжный путь выглядит так: извлечь данные блоками, сопоставить колонки, подтвердить изображения и коды, а затем синхронизировать по SKU, чтобы магазин обновлялся, а не создавал дубли.

Используйте эту последовательность для настоящего прайс-листа — как одностраничного списка керамики, так и многостраничного каталога поставщика. Цель — карточка, которую можно добавить в WooCommerce › Товары без второго раунда ручного расследования.

  1. Сохраняйте цифровой PDF с текстовым слоем, если поставщик может его предоставить. Фотография распечатки требует OCR и увеличивает вероятность объединения ячеек.
  2. Импортируйте PDF так, чтобы файл читался блоками: заголовки, тело таблицы, нижние колонтитулы и встроенные изображения.
  3. Отметьте строку заголовка. Если в ней указано «Price € / 4 pcs», сохраните pack = 4 и currency = EUR как смысл колонки, а не как часть названия товара.
  4. Сопоставьте колонки с id (SKU), title, description, price, availability, brand, gtin и атрибутами, например размером или цветом.
  5. Перенесите сноски в description, если они содержат факты о товаре: пригодность для посудомоечной машины, отсутствие НДС. Юридический шаблонный текст не помещайте в название.
  6. Проверьте контрольную цифру GS1 для каждого штрихкода. Ошибочные коды отклоните. Если у производителя нет GTIN, установите identifier_exists вместо выдуманного кода.
  7. Свяжите извлечённые изображения с SKU. Подтвердите групповые фотографии. Файлы заметно меньше 500 × 500 пикселей стоит заменить, поскольку изображения меньшего размера с меньшей вероятностью будут приняты торговыми поверхностями.
  8. Проверьте одну примерную строку как полноценную карточку — см. пример до и после — прежде чем принять пакет.
  9. Синхронизируйте с WooCommerce по SKU через официальный плагин, чтобы существующие товары обновлялись, а новые SKU создавались один раз. Не создавайте второй товар только потому, что изменилось название.
  10. Когда записи готовы, экспортируйте в Merchant Center › Товары › Фиды только готовые строки и используйте те же поля для товарного фида ChatGPT.

До обработки (одна строка PDF, как напечатано): CR-204 | Bowl, stoneware, Ø 18 cm, glazed blue* | 4 pcs | € 12,50. Сноска: * можно мыть в посудомоечной машине, нельзя использовать в микроволновой печи. Штрихкода в строке нет. В левом поле находится миниатюра синей миски.

После обработки (карточка, которую следует сохранить):

  • id / SKU: CR-204
  • title: Каменная миска, синяя глазурь, 18 см
  • description: Можно мыть в посудомоечной машине. Не подходит для микроволновой печи. Продаётся в упаковке из 4 штук.
  • price: 12.50 EUR (число и валюта разделены)
  • availability: оставить пустым, если PDF не указывает наличие
  • brand: только если в списке назван бренд
  • gtin: пусто; identifier_exists установлен, поскольку код производителя на странице отсутствует
  • image_link: извлечённая миниатюра, если она чёткая и достаточно крупная; иначе подтверждённая фотография упаковки
  • attribute pack: 4, attribute diameter: 18 см

Именно для этого нужно превращать PDF в карточки товаров: именованные поля, подтверждённые факты и отсутствие лишнего SKU.

Распространённые ошибки

Большинство неудачных импортов PDF — не «ошибки ИИ», а ячейки, в которых по-прежнему содержатся два факта, неверная контрольная цифра или SKU, уже принадлежащий магазину.

Недействительный или дублирующийся SKU

Магазин показывает сообщение «Invalid or duplicated SKU». Это происходит, когда такой SKU уже есть в WooCommerce, а импорт пытается создать второй товар вместо обновления первого. Ошибка часто возникает после сезонного PDF с теми же кодами и новыми ценами. Исправьте её, сопоставив записи по SKU, записав новую цену и название в существующий товар и оставив постоянную ссылку без изменений. Двунаправленная синхронизация по SKU — решение; пустое создание нового товара — нет.

Missing value [gtin]

Merchant Center сообщает «Missing value [gtin]», когда в строке фида нет ни GTIN, ни понятного флага identifier_exists. Это бывает, если штрихкод из PDF пропустили, разделили переносом строки или отклонили из-за контрольной цифры, а затем оставили поле пустым. Исправьте ситуацию: считайте цифры из PDF продавца или с фотографии упаковки, проверьте контрольную цифру GS1 и записывайте gtin только при успешной проверке. Если у производителя нет GTIN, укажите это отсутствие. Не ищите замену коду в интернете.

Price must be a number

Редактор или валидатор фида возвращает «Price must be a number» либо сообщает о несоответствии валюты, например о символе без кода ISO. Это происходит, когда в ячейке остаётся «€ 12,50*», «from 12» или «12,50 / 4 pcs». Исправьте ситуацию, разделив сумму, валюту, упаковку и сноску. Используйте в фиде десятичную точку, оставьте EUR кодом валюты, а «упаковку из 4 штук» внесите в атрибут или описание.

Could not detect a table on this page

Программа возвращает «Could not detect a table on this page», когда PDF является фотографией, каталог имеет сложный дизайн с ценами, оформленными как графика, или страница содержит только сноски и фотографии. Причина — отсутствие текстового слоя и сетки для разбора. Попросите поставщика цифровой список, приложите CSV к PDF или вручную отметьте товарные блоки, чтобы фотографии и расположенные рядом подписи всё же можно было связать. Не вводите фиктивную таблицу в описание, чтобы «заставить импорт работать».

Как Katapic превращает тот же PDF в карточки, которые вы подтверждаете

Katapic читает прайс-листы и каталоги блоками, извлекает встроенные изображения и синхронизирует WooCommerce по SKU, чтобы вы подтверждали факты, а не перепечатывали их.

Импорт из PDF создан для такого типа файлов: списки и каталоги читаются блоками, встроенные изображения извлекаются, а фотографии сопоставляются с товарами для вашего подтверждения. В это же рабочее пространство можно загрузить фотографию — одна фотография, одна карточка — и CSV. Ничего в каталоге не изменяется, пока вы не подтвердите действие. Первое сканирование публичного каталога WooCommerce можно запустить без аккаунта в режиме только чтения — до 100 товаров, с отдельными оценками готовности к классическому поиску и ассистентам, а также показателем полноты для отсутствующих или неправильных полей.

Для GTIN действует то же правило, что и для остальных данных в этой статье: код считывается из вашего PDF, фотографии упаковки или колонки CSV и должен пройти проверку контрольной цифры GS1. Искать его в интернете нельзя. Переписывание проходит проверку фактов: бренды, сертификаты и историю не выдумывают, а найденная в интернете величина, противоречащая вашему названию, не добавляется. Переписывание карточки стоит 1 кредит, изображение — 1 кредит. Подписки нет. Кредиты не сгорают. Для товаров без фотографии можно использовать фрагмент из PDF, загрузить файл вручную, взять изображение из интернета после подтверждения прав или создать иллюстрацию с пометкой согласно статье 50 AI Act.

Синхронизация с WooCommerce выполняется в обоих направлениях по SKU и не создаёт дубли. Официальный плагин доступен на WordPress.org. Готовность каналов включает Google Shopping, фид ChatGPT, Meta, PDF, магазин и ответы ассистентов. Если после создания карточек нужен печатный каталог, Catalogue Studio разместит их на страницах с помощью 30 шаблонов. Рабочий путь от файла поставщика — это импорт Katapic, подтверждённая карта и обновление SKU, которые вы уже продаёте. Для обратного направления можно создать многостраничный PDF-каталог из тех же записей.

FAQ

Как импортировать прайс-лист в PDF в WooCommerce?

Прочитайте PDF блоками таблицы, сопоставьте колонки с SKU, названием, описанием, ценой, валютой и атрибутами, затем синхронизируйте по SKU, чтобы существующие товары обновились. Не вставляйте всю страницу в редактор товара. Проверьте GTIN по контрольной цифре, свяжите встроенные изображения и только потом откройте WooCommerce › Товары для проверки примера. Такая последовательность помогает избежать дублирующихся SKU, когда поставщик присылает список нового сезона.

Какие данные о товарах можно извлечь из каталога в PDF?

Обычно можно извлечь SKU, название, дополнительные примечания, цену, валюту, упаковку или размер, бренд, если он назван, штрихкоды, прошедшие проверку контрольной цифры GS1, и встроенные фотографии. Единицы измерения только в заголовках, объединённые ячейки и сноски нельзя считать полями, пока вы не разделите их. Факты, которых файл не содержит, например вес или материал, остаются пустыми. Извлечение — это карта для id, title, description, price, availability, brand, gtin и image_link, а не полное переписывание каталога.

Можно ли автоматизировать каталогизацию PDF без выдумывания характеристик?

Обнаружение колонок и извлечение изображений можно автоматизировать. Нельзя записывать материал, сертификат или GTIN, которых нет в файле. Честный процесс автоматически заполняет пустые ячейки данными из PDF, отмечает ошибки контрольной цифры и ждёт подтверждения вариантов и категории Google. Если найденная в другом месте величина противоречит названию продавца, приоритет остаётся за данными продавца. Автоматизация, которая выдумывает характеристику, создаёт карточку, которую сложно обосновать при проверке фида.

Как импорт каталога PDF работает с существующими SKU WooCommerce?

SKU из PDF является ключом сопоставления. Если он совпадает с товаром в магазине, импорт должен обновить цену, название и изображения этого товара и сохранить URL. Если SKU новый, создаётся один товар. Сопоставление по названию вместо SKU приводит к незаметным дублям после переименования. Двунаправленная синхронизация по SKU служит защитой, в том числе при последующем экспорте товарного фида из тех же записей.

Что происходит со штрихкодами и GTIN, найденными в PDF?

Цифры, напечатанные в ячейке или представленные штрихкодом, копируются, а затем проверяются по контрольной цифре GS1. При успешной проверке записывается gtin. При ошибке поле остаётся пустым, и его не следует «исправлять» номером из поисковой системы. Если производитель никогда не выпускал GTIN, установите identifier_exists вместо догадок. Это не позволяет Merchant Center сохранить код, принадлежащий другому товару, и помогает фиду для ассистента соответствовать упаковке на вашем складе.

Почему единицы измерения и сноски исчезают при копировании прайс-листа?

Единицы измерения часто указаны только в заголовке — например, «цена за упаковку из 4 штук», — а сноски находятся внизу страницы. При копировании отдельной строки они не видны. В результате карточка показывает цену за единицу вместо цены за упаковку или теряет примечания «без НДС» и «не подходит для микроволновой печи». При сопоставлении сохраните единицу из заголовка как атрибут, а факты из сноски перенесите в описание. Если пропустить это разделение, ошибка повторится во всех последующих фидах.

Стоит ли создавать новый PDF-каталог после очистки карточек?

Когда SKU, цены и фотографии уже существуют как товарные записи, многостраничный PDF-каталог становится производным материалом, а не источником истины. Создавайте его из данных магазина, чтобы печатная и онлайн-версии не расходились. Полученный от поставщика PDF сохраняйте как подтверждение исходных фактов. Рабочий каталог, товарный фид и фид ассистента должны читать одни и те же поля, подтверждённые после импорта, а не макет прошлогоднего файла.

Дополнительные материалы

Часто задаваемые вопросы

Как импортировать прайс-лист в PDF в WooCommerce?
Прочитайте PDF блоками таблицы, сопоставьте колонки с SKU, названием, описанием, ценой, валютой и атрибутами, затем синхронизируйте по SKU, чтобы существующие товары обновились. Не вставляйте всю страницу в редактор товара. Проверьте GTIN по контрольной цифре, свяжите встроенные изображения и проверьте пример в WooCommerce › Товары перед принятием пакета.
Какие данные о товарах можно извлечь из каталога в PDF?
Обычно можно извлечь SKU, название, дополнительные примечания, цену, валюту, упаковку или размер, бренд, если он назван, штрихкоды, прошедшие проверку контрольной цифры GS1, и встроенные фотографии. Единицы измерения только в заголовках, объединённые ячейки и сноски становятся полями только после разделения. Факты, которых файл не содержит, остаются пустыми, а не выдумываются.
Можно ли автоматизировать каталогизацию PDF без выдумывания характеристик?
Обнаружение колонок и извлечение изображений можно автоматизировать. Нельзя записывать материал, сертификат или GTIN, которых нет в файле. Автоматически заполняйте данные из PDF, отклоняйте ошибки контрольной цифры и подтверждайте варианты. Если другой источник противоречит названию продавца, приоритет остаётся за данными продавца, а дополнительное утверждение не добавляется.
Как импорт каталога PDF работает с существующими SKU WooCommerce?
SKU из PDF является ключом сопоставления. Совпадение обновляет цену, название и изображения существующего товара и сохраняет URL. Новый SKU создаёт один товар. Сопоставление по названию вместо SKU приводит к дублям после переименования. Двунаправленная синхронизация по SKU защищает и последующие товарные фиды для магазинов и ассистентов.
Что происходит со штрихкодами и GTIN, найденными в PDF?
Цифры из ячейки или штрихкода копируются и проверяются по контрольной цифре GS1. При успешной проверке записывается gtin. При ошибке поле остаётся пустым. Не заменяйте код номером из поисковой системы. Если производитель не выпускал GTIN, установите identifier_exists вместо догадок о коде, который может принадлежать другому товару.
Почему единицы измерения и сноски исчезают при копировании прайс-листа?
Единицы измерения часто находятся только в заголовке, а сноски — только внизу страницы, поэтому копирование отдельной строки их не видит. Карточка показывает цену за упаковку как цену за единицу или теряет примечания по безопасности. Сохраните единицу из заголовка как атрибут, а факты из сноски перенесите в описание при сопоставлении.
Стоит ли создавать новый PDF-каталог после очистки карточек?
Когда SKU, цены и фотографии уже существуют как товарные записи, многостраничный PDF-каталог становится производным материалом, а не источником истины. Создавайте печатную версию из данных магазина, чтобы каналы не расходились. Сохраняйте PDF поставщика как подтверждение исходных фактов, а каталогу и фидам позволяйте читать поля, подтверждённые после импорта.