Восьмого вересня 2026 року ми прочитали 21 публічний YML-фід українських інтернет-магазинів — 89 718 товарів — і порахували в них одну річ: у скількох товарів опис дослівно збігається з описом іншого товару в тому самому фіді.
Відповідь: 19 674 товари, 22 % прочитаних. Такі збіги є у 17 фідах із 21. Ці самі фіди ми брали вже двічі: 5 вересня дивилися, що в них ламається під вимоги майданчика, 8 вересня — чи є в них українські мовні поля. Цього разу — тільки описи.
Що саме ми рахували
Метод простий, і його варто розуміти, бо від нього залежить, як читати цифру.
У межах одного фіда опис кожного товару нормалізується: знімаються HTML-теги й обгортка CDATA, кілька пробілів поспіль стискаються в один, регістр опускається. Від того, що лишилося, береться хеш. Товар потрапляє в «дублікатну групу», якщо його нормалізований опис збігається байт-у-байт з описом іншого товару того самого фіда. Порівняння — всередині фіда; магазин з магазином ми не звіряли.
Це не те саме, що дублі назв, які ми рахували 5 вересня (903 товари в 11 фідах). Там збігається назва, і майданчик бачить це сам: у довідці Rozetka є пряма вимога, а позиція відхиляється. Тут назви різні, а текст під ними той самий — і жоден валідатор фіда на це не поскаржиться.
Цифри
| Показник | Значення |
|---|---|
| Товарів з описом-копією | 19 674 (22 %) |
| Фідів, де такі групи є | 17 із 21 |
| Груп однакових описів | 6 230 |
| Товарів на групу в середньому | 3,2 |
| Найбільша одна група | 137 товарів |
| Товарів зовсім без опису | 5 779 (6 %) |
| Товарів з описом коротшим за 200 символів | 9 267 |
| Фідів без дублів і без порожніх описів | 2 із 21 |
Частка дублів по фідах розкидана широко: медіана 7,4 %, максимум 50,3 %. Тобто в типовому фіді вибірки копія трапляється приблизно в кожного чотирнадцятого товару, а в найгіршому — у половини каталогу.
Крайні випадки варто назвати окремо, бо середні числа їх ховають:
- Фід на 19 761 товар, у якому 9 931 позиція — у дублікатних групах. Половина каталогу.
- Prom-фід на 5 088 товарів: 3 843 з них не мають опису взагалі, ще 1 003 — копії. Власним текстом володіє 242 товари з п'яти тисяч.
- Найбільша одна група — 137 карток з дослівно однаковим текстом.
Два фіди з двадцяти одного не мають ні дублів, ні порожніх описів.
Як побачити це у своєму каталозі
Метод відтворюваний і не потребує жодних сервісів:
- Вивантажте фід і візьміть із кожного товару поле опису.
- Нормалізуйте текст: приберіть HTML-теги, розгорніть CDATA, стисніть пробіли, опустіть регістр. Без цього два однакові описи, що відрізняються одним
<br>, порахуються різними. - Порахуйте хеш кожного нормалізованого опису й згрупуйте товари за хешем.
- Групи, де більше одного товару, — це ваші дублі. Порожні описи рахуйте окремо: інша проблема й інше лікування.
Це десяток рядків будь-якою мовою або формула в таблиці, якщо каталог невеликий. Важливіший не інструмент, а результат: замість відчуття «здається, у нас багато однакового» ви отримуєте число.
Подивіться ще й на розподіл груп. Одна група на 137 товарів і 137 груп по два товари — різні задачі. Перша означає цілу категорію з описом-заглушкою, друга — варіанти одного товару, у яких відмінність не потрапила в текст.
Звідки беруться однакові описи
Причин небагато, і жодна з них не про недбалість.
Опис від постачальника. Прайс приходить із текстом, модуль імпорту кладе його в картку. Постачальник дав один опис на серію з двадцяти позицій — у каталозі з'явилося двадцять однакових карток.
Варіанти одного товару. Той самий чохол у восьми кольорах, та сама футболка в п'яти розмірах. Відмінність винесена в характеристики, а текст скопійований.
Опис категорії замість опису товару. Найчастіша причина великих груп: у поле опису підставили загальний текст про категорію або бренд. Формально поле заповнене.
Шаблон, у якому не спрацювала підстановка. Опис збирався за шаблоном, змінні не підставилися — і в усіх товарах лишився однаковий каркас.
Що це означає для пошуку
Тут потрібна точність, бо навколо теми багато перебільшень.
Однаковий опис у 137 товарів означає рівно одне: пошукова система бачить 137 сторінок з тим самим текстом. Далі працює звичайний механізм — серед сторінок з однаковим вмістом система обирає одну як основну й показує в результатах саме її, а решту вважає її варіантами. Яку саме обере — вирішує вона, не ви.
Ми не перевіряли, чи це сталося з товарами виміряних магазинів, і не міряли ні їхньої індексації, ні позицій. Замір показує стан фідів, і тільки його. Обіцяти, що після унікалізації описів щось виросте, ми не будемо: на видачу впливають десятки чинників — асортимент, ціни, умови доставки, посилання, поведінка покупців, конкуренція в категорії.
Чесна межа така: унікальний опис прибирає технічну втрату — те, що сторінка не додає нічого нового до вже наявного в індексі. Попиту він не створює й позицій сам по собі не піднімає.
Як виправити на тисячах товарів
Руками це не робиться. 19 674 товари з нашої вибірки — це роки роботи копірайтера, а в одному окремому каталозі з половиною копій це 9 931 текст.
Задача вирішується конвеєром: фід на вході, фід на виході. Сам конвеєр ми розбирали окремо — як переписати каталог на унікальні описи. Порядок дій, коли цифри вже на руках:
- Спершу порожні описи. 5 779 товарів без тексту — це не «неунікально», це «нічого немає».
- Далі найбільші групи. Одна група на 137 карток дає більше на одиницю зусиль, ніж сотня пар.
- Прев'ю на одному товарі до запуску всього каталогу: прочитати текст очима, поки не оброблено тисячі позицій.
- Імпорт одного товару назад на майданчик, перевірка картки — і лише потім весь каталог.
У Textory, нашому продукті, опис будується з характеристик самого товару, а не вигадується. Саме тому варіанти одного товару отримують різний текст, а не переставлені абзаци. Якщо потрібно, щоб опис ще й ліг у формат, зручний для цитування в AI-пошуку, це окремий режим і окрема логіка — про неї в матеріалі про GEO-оптимізацію описів.
Коли задача ширша за сам текст, AI-генерація описів товарів як послуга агенції означає, що ми беремо на себе й розбір фіда, і мапінг полів, і повернення файлу назад у платформу.
Чого цей замір не показує
Обмежень чотири, і кожне з них звужує цифру.
Порівняння між магазинами не робили. Однаковий опис від спільного постачальника, що стоїть у двох різних фідах, тут не видно взагалі. А це найпоширеніший вид збігу.
Схожі, але не ідентичні описи не рахуються. Переставили абзаци, змінили одне слово, додали крапку — за нашою методикою це вже різні тексти. Реальна частка неунікального тексту вища за 22 %.
Індексацію не перевіряли. Ми не знаємо, що сталося з цими сторінками в пошуку, і не робимо про це висновків.
Вибірка мала й не випадкова. 21 фід, знайдений пошуком типових шляхів модуля вивантаження для OpenCart. Це стан цих конкретних публічних фідів на 8 вересня 2026 року, а не зріз українського e-commerce.
Підсумок
У 21 виміряному фіді 22 % товарів мають опис, дослівно однаковий з описом сусіда по каталогу, а ще 6 % не мають опису зовсім. Перевірити те саме у себе — це нормалізувати описи, похешувати й згрупувати: півгодини роботи й одне число замість здогадок.
Подивитися, що вийде на вашому фіді, можна на textory.com.ua — модель оплати там за обсяг тексту, актуальні умови на сайті продукту. Решта наших продуктів — у розділі власних продуктів. Розбір задачі безкоштовний, відповідаємо протягом двох годин, працюємо за договором.




