Мы собрали базу на 112 тысяч составов продуктов — и полтора месяца не могли попасть в поиск
Полтора года назад я начал собирать базу составов продуктов. Идея была простая: человек в магазине берёт пачку, читает состав и ничего не понимает. Значит, нужен сканер — навёл камеру на штрих-код, получил понятный ответ.
Сейчас в базе 112 769 товаров, у 62 тысяч есть состав и вердикт, плюс справочник на 243 пищевые добавки. Приложение опубликовано, оно работает, рейтинг 5,0. А трафика из поиска нет.
Это текст про то, почему так вышло — с цифрами, а не с рассуждениями.
Ошибка первая: считать, что контент сам себя продвинет
62 тысячи страниц — казалось бы, огромный охват длинного хвоста. Человек ищет «хлорид кальция в сыре вредно ли это» — у нас есть страница ровно про это.
Реальность оказалась другой. Яндекс держал в поиске 10 страниц из 62 тысяч. Остальное — в статусе «Малоценная или маловостребованная страница»: 960 штук исключено явно, остальные просто не дошли до оценки.
Причина не техническая. Мы неделю искали блокеры: проверяли robots.txt, ответы сервера от имени робота, карты сайта. Всё оказалось в порядке — робот ходит, sitemap приняты, страницы отдают 200. Просто у домена не было ни одной внешней ссылки. Для поисковика сайт без входящих ссылок — сайт-невидимка, каким бы объёмным он ни был.
Ошибка вторая: смотреть не в ту панель
Мы неделю анализировали Яндекс.Вебмастер и делали выводы о качестве сайта. Когда наконец досчитался отчёт Google Search Console, выяснилось: Google проиндексировал 875 страниц против десяти у Яндекса. Один и тот же сайт, одни и те же карты, разница в 87 раз.
Вывод, который стоил недели: прежде чем чинить сайт, проверьте обе панели. Возможно, у вас уже есть работающий поисковик, просто вы на него не смотрели.
Ошибка третья: писать заголовки под себя, а не под запрос
Наши страницы добавок назывались «Е621 — глутамат натрия». Логично и аккуратно. А запросы в поиске выглядят иначе: «сукралоза разрешена в ес», «e501 вреден», «что такое e319», «безопасны ли соли аммония в лакрице». Люди ищут по химическому названию и с контекстом продукта, а не по коду.
Переписали заголовки под формулу запроса — и получили первый живой информационный клик ровно по той фразе, под которую переписывали. Семантика подтвердилась, объём — нет: без ссылок индекс всё равно не растёт.
Ошибка четвёртая, самая дорогая: отсутствие данных ≠ хорошие данные
Про эту стоит рассказать отдельно, потому что она из тех, что не ловятся тестами.
У воды в составе нет ничего. Ни сахара, ни жира, ни добавок. Алгоритм честно складывал штрафные баллы, получал ноль и выдавал зелёный с формулировкой «состав сбалансирован». То же самое происходило с солью: чистый хлорид натрия, добавок нет, штрафов нет — «сбалансирован».
Пользователи это заметили быстро и высмеяли: «цельнозерновая вода». Смешно, но по делу — алгоритм принимал отсутствие данных за хорошие данные.
Первое решение было неправильным: сделать для всех однокомпонентных продуктов отдельный серый статус «оценка неприменима». Это оказалось хуже исходного — крупа, мука, молоко, овощи вдруг переставали получать зелёный, хотя претензий к их составу действительно нет.
Правильное правило нашлось только с третьего захода, и оно не про алгоритм, а про здравый смысл: цвет определяется не тем, зависит ли вред от количества (зависит вообще у всего), а тем, превышает ли норму обычный человек на практике. Соль и сахар — жёлтый, с честной подписью «дело не в добавках, а в количестве». Вода, крупа, мука, молоко, масло, специи — зелёный, «претензий к составу нет». Нитриты — красный, и его мы не смягчаем.
Что делаем дальше
Единственный реальный рычаг сейчас — внешние ссылки. Не контент, не переобход, не заголовки: всё это мы уже сделали, и оно упёрлось в доверие к домену. Нужны 5–10 живых упоминаний с разных площадок, чтобы поисковик перестал считать сайт невидимкой.
Если вы делаете контентный проект — начинайте с этого, а не с контента. Мы сделали наоборот и потеряли месяц.
Сам справочник добавок открыт и бесплатен: etiketka.bossip.ru/dobavki/. Приложение — «Этикетка» в RuStore, тоже бесплатно и без рекламы.