E-commerce та БізнесAI та машинне навчання

Однакові описи в каталозі: скільки їх у 21 фіді українських магазинів

Замір 21 публічного фіда 8 вересня 2026 року, 89 718 товарів: 19 674 з них (22 %) мають опис, дослівно однаковий з описом іншого товару в тому самому фіді. Як перевірити це у себе.

8 вересня 2026 р.
7 хв читання

Восьмого вересня 2026 року ми прочитали 21 публічний YML-фід українських інтернет-магазинів — 89 718 товарів — і порахували в них одну річ: у скількох товарів опис дослівно збігається з описом іншого товару в тому самому фіді.

Відповідь: 19 674 товари, 22 % прочитаних. Такі збіги є у 17 фідах із 21. Ці самі фіди ми брали вже двічі: 5 вересня дивилися, що в них ламається під вимоги майданчика, 8 вересня — чи є в них українські мовні поля. Цього разу — тільки описи.

Що саме ми рахували

Метод простий, і його варто розуміти, бо від нього залежить, як читати цифру.

У межах одного фіда опис кожного товару нормалізується: знімаються HTML-теги й обгортка CDATA, кілька пробілів поспіль стискаються в один, регістр опускається. Від того, що лишилося, береться хеш. Товар потрапляє в «дублікатну групу», якщо його нормалізований опис збігається байт-у-байт з описом іншого товару того самого фіда. Порівняння — всередині фіда; магазин з магазином ми не звіряли.

Це не те саме, що дублі назв, які ми рахували 5 вересня (903 товари в 11 фідах). Там збігається назва, і майданчик бачить це сам: у довідці Rozetka є пряма вимога, а позиція відхиляється. Тут назви різні, а текст під ними той самий — і жоден валідатор фіда на це не поскаржиться.

Цифри

Показник Значення
Товарів з описом-копією 19 674 (22 %)
Фідів, де такі групи є 17 із 21
Груп однакових описів 6 230
Товарів на групу в середньому 3,2
Найбільша одна група 137 товарів
Товарів зовсім без опису 5 779 (6 %)
Товарів з описом коротшим за 200 символів 9 267
Фідів без дублів і без порожніх описів 2 із 21

Частка дублів по фідах розкидана широко: медіана 7,4 %, максимум 50,3 %. Тобто в типовому фіді вибірки копія трапляється приблизно в кожного чотирнадцятого товару, а в найгіршому — у половини каталогу.

Крайні випадки варто назвати окремо, бо середні числа їх ховають:

  • Фід на 19 761 товар, у якому 9 931 позиція — у дублікатних групах. Половина каталогу.
  • Prom-фід на 5 088 товарів: 3 843 з них не мають опису взагалі, ще 1 003 — копії. Власним текстом володіє 242 товари з п'яти тисяч.
  • Найбільша одна група — 137 карток з дослівно однаковим текстом.

Два фіди з двадцяти одного не мають ні дублів, ні порожніх описів.

Як побачити це у своєму каталозі

Метод відтворюваний і не потребує жодних сервісів:

  1. Вивантажте фід і візьміть із кожного товару поле опису.
  2. Нормалізуйте текст: приберіть HTML-теги, розгорніть CDATA, стисніть пробіли, опустіть регістр. Без цього два однакові описи, що відрізняються одним <br>, порахуються різними.
  3. Порахуйте хеш кожного нормалізованого опису й згрупуйте товари за хешем.
  4. Групи, де більше одного товару, — це ваші дублі. Порожні описи рахуйте окремо: інша проблема й інше лікування.

Це десяток рядків будь-якою мовою або формула в таблиці, якщо каталог невеликий. Важливіший не інструмент, а результат: замість відчуття «здається, у нас багато однакового» ви отримуєте число.

Подивіться ще й на розподіл груп. Одна група на 137 товарів і 137 груп по два товари — різні задачі. Перша означає цілу категорію з описом-заглушкою, друга — варіанти одного товару, у яких відмінність не потрапила в текст.

Звідки беруться однакові описи

Причин небагато, і жодна з них не про недбалість.

Опис від постачальника. Прайс приходить із текстом, модуль імпорту кладе його в картку. Постачальник дав один опис на серію з двадцяти позицій — у каталозі з'явилося двадцять однакових карток.

Варіанти одного товару. Той самий чохол у восьми кольорах, та сама футболка в п'яти розмірах. Відмінність винесена в характеристики, а текст скопійований.

Опис категорії замість опису товару. Найчастіша причина великих груп: у поле опису підставили загальний текст про категорію або бренд. Формально поле заповнене.

Шаблон, у якому не спрацювала підстановка. Опис збирався за шаблоном, змінні не підставилися — і в усіх товарах лишився однаковий каркас.

Що це означає для пошуку

Тут потрібна точність, бо навколо теми багато перебільшень.

Однаковий опис у 137 товарів означає рівно одне: пошукова система бачить 137 сторінок з тим самим текстом. Далі працює звичайний механізм — серед сторінок з однаковим вмістом система обирає одну як основну й показує в результатах саме її, а решту вважає її варіантами. Яку саме обере — вирішує вона, не ви.

Ми не перевіряли, чи це сталося з товарами виміряних магазинів, і не міряли ні їхньої індексації, ні позицій. Замір показує стан фідів, і тільки його. Обіцяти, що після унікалізації описів щось виросте, ми не будемо: на видачу впливають десятки чинників — асортимент, ціни, умови доставки, посилання, поведінка покупців, конкуренція в категорії.

Чесна межа така: унікальний опис прибирає технічну втрату — те, що сторінка не додає нічого нового до вже наявного в індексі. Попиту він не створює й позицій сам по собі не піднімає.

Як виправити на тисячах товарів

Руками це не робиться. 19 674 товари з нашої вибірки — це роки роботи копірайтера, а в одному окремому каталозі з половиною копій це 9 931 текст.

Задача вирішується конвеєром: фід на вході, фід на виході. Сам конвеєр ми розбирали окремо — як переписати каталог на унікальні описи. Порядок дій, коли цифри вже на руках:

  1. Спершу порожні описи. 5 779 товарів без тексту — це не «неунікально», це «нічого немає».
  2. Далі найбільші групи. Одна група на 137 карток дає більше на одиницю зусиль, ніж сотня пар.
  3. Прев'ю на одному товарі до запуску всього каталогу: прочитати текст очима, поки не оброблено тисячі позицій.
  4. Імпорт одного товару назад на майданчик, перевірка картки — і лише потім весь каталог.

У Textory, нашому продукті, опис будується з характеристик самого товару, а не вигадується. Саме тому варіанти одного товару отримують різний текст, а не переставлені абзаци. Якщо потрібно, щоб опис ще й ліг у формат, зручний для цитування в AI-пошуку, це окремий режим і окрема логіка — про неї в матеріалі про GEO-оптимізацію описів.

Коли задача ширша за сам текст, AI-генерація описів товарів як послуга агенції означає, що ми беремо на себе й розбір фіда, і мапінг полів, і повернення файлу назад у платформу.

Чого цей замір не показує

Обмежень чотири, і кожне з них звужує цифру.

Порівняння між магазинами не робили. Однаковий опис від спільного постачальника, що стоїть у двох різних фідах, тут не видно взагалі. А це найпоширеніший вид збігу.

Схожі, але не ідентичні описи не рахуються. Переставили абзаци, змінили одне слово, додали крапку — за нашою методикою це вже різні тексти. Реальна частка неунікального тексту вища за 22 %.

Індексацію не перевіряли. Ми не знаємо, що сталося з цими сторінками в пошуку, і не робимо про це висновків.

Вибірка мала й не випадкова. 21 фід, знайдений пошуком типових шляхів модуля вивантаження для OpenCart. Це стан цих конкретних публічних фідів на 8 вересня 2026 року, а не зріз українського e-commerce.

Підсумок

У 21 виміряному фіді 22 % товарів мають опис, дослівно однаковий з описом сусіда по каталогу, а ще 6 % не мають опису зовсім. Перевірити те саме у себе — це нормалізувати описи, похешувати й згрупувати: півгодини роботи й одне число замість здогадок.

Подивитися, що вийде на вашому фіді, можна на textory.com.ua — модель оплати там за обсяг тексту, актуальні умови на сайті продукту. Решта наших продуктів — у розділі власних продуктів. Розбір задачі безкоштовний, відповідаємо протягом двох годин, працюємо за договором.

Теги

E-commerceSEO

🤔Вам сподобалась стаття?

Ваша думка допомагає нам створювати кращий контент

Поділіться з друзями

Знайшли щось корисне? 🚀

Допоможіть іншим дізнатись про це — поділіться статтею в соціальних мережах

https://lionex.com.ua/blog/odnakovi-opysy-tovariv-u-fidah

💚 Дякуємо, що допомагаєте нам рости

Владислав Чистяков

Пише про те, що робить руками: інтернет-магазини на OpenCart, застосунки на Next.js, інтеграції та швидкість сайтів. У статтях — заміри й перевірки, які читач може повторити на своєму проєкті, а не загальні поради. Комерційна розробка з 2015 року.

Часті запитання

Відповіді на популярні питання по темі

Ми цього не міряли й такого не стверджуємо. Наш замір показує стан фідів, а не те, що сталося з їхніми сторінками в пошуку: індексацію та позиції цих магазинів ми не перевіряли. Відомо інше, і воно з механізму, а не з прогнозу: якщо 137 товарів мають дослівно однаковий текст, пошукова система бачить 137 сторінок з тим самим вмістом. Серед таких сторінок вона зазвичай обирає одну як основну й показує саме її, а решту вважає її варіантами. Яку саме обере — вирішує вона, не ви.

У виміряній вибірці 08.09.2026 — 19 674 товари з 89 718, тобто 22 %. Такі групи є у 17 фідах із 21. Розкид великий: медіана по фідах 7,4 %, максимум 50,3 %. Ще 5 779 товарів (6 %) не мають опису взагалі, а 9 267 мають опис коротший за 200 символів. Вибірка мала й не випадкова — це стан 21 конкретного публічного фіда на дату заміру, а не зріз ринку.

Вивантажте фід, візьміть поле опису кожного товару й нормалізуйте текст: приберіть HTML-теги, розгорніть CDATA, стисніть пробіли, опустіть регістр. Потім порахуйте хеш кожного опису й згрупуйте товари за хешем — групи з більш ніж одним товаром і є дублі. Нормалізація обов'язкова: без неї два однакові описи, що відрізняються одним тегом `<br>`, порахуються різними. Порожні описи рахуйте окремо.

Дублі назв майданчик бачить сам: у довідці Rozetka є пряма вимога не мати двох позицій з абсолютно однаковою назвою, і така позиція відхиляється. У замірі 05.09.2026 їх було 903 товари в 11 фідах із 21. Дублі описів — інша річ: назви різні, а текст під ними той самий, і жоден валідатор фіда на це не поскаржиться. Тому їх і не помічають, доки не порахують спеціально.

Він прибирає технічну втрату — те, що сторінка не додає нічого нового до вже наявного в індексі. Попиту унікальний опис не створює й позицій сам по собі не піднімає: на видачу впливають асортимент, ціни, умови доставки, посилання, поведінка покупців і конкуренція в категорії. Порядок роботи ми радимо такий: спершу товари зовсім без опису, далі найбільші групи копій, прев'ю на одному товарі до запуску всього каталогу й перевірка однієї картки на майданчику перед масовим імпортом.

Отримуйте найкращі статті на пошту

Підпишіться на нашу розсилку та отримуйте корисні поради, інсайти та новини про веб-розробку, маркетинг та бізнес.

Ми поважаємо вашу приватність. Відписатись можна в будь-який момент.

Схожі статті

Всі статті
Сертифікати продовжуються самі: TLS на 116 сайтах і один, що не продовжився
Веб-розробка

Сертифікати продовжуються самі: TLS на 116 сайтах і один, що не продовжився

22 вересня 2026 року ми перевірили HTTPS-сертифікати на 116 сайтах, які вже міряли для ринкових вимірів, і для 104 з них порівняли стан із серпневим. Усі 116 пройшли перевірку, 108 стоять на 89- і 90-денних безкоштовних сертифікатах, і лише в одного сайту сертифікат досі не продовжився, хоча за типових налаштувань уже мав би. Розбираємо заміри, межі методу й показуємо, як перевірити свій сайт однією командою.

9 хв
22 вер.
Читати далі
154 помилки типів, які викидала збірка: що в них знайшлось
Веб-розробка

154 помилки типів, які викидала збірка: що в них знайшлось

21 вересня 2026 року перевірка типів на нашому сайті показала 154 помилки, хоча збірка щоразу була зеленою: результат перевірки просто викидався. Усередині знайшлись нулі в статистиці посилань і в експорті аналітики, сортування, що не сортувало, і тести, які не запускались. Розповідаємо, як розбирали, що змінили і як перевірити свій проєкт.

9 хв
22 вер.
Читати далі
Healthcheck дав 60 % запитів застосунку: що побачили в першу добу метрик
Веб-розробка

Healthcheck дав 60 % запитів застосунку: що побачили в першу добу метрик

21 вересня 2026 року, у першу добу обліку запитів за маршрутами, службовий /api/health отримав 13 666 запитів — 60 % трафіку застосунку, і кожен ішов у спільну базу. Розповідаємо, які два налаштування це прибрали, яку ціну маємо за них і як перевірити свій healthcheck.

9 хв
22 вер.
Читати далі