Извлекать ключевые слова из отзывов конкурентов
Единственное место, куда не смотрит ни один инструмент: текст, который пользователи пишут своими словами. Как его извлекать и как фильтровать.
· Чтение 7 мин
Все пулы ключевых слов выходят из одного источника: подсказок магазина и метаданных конкурентов. Поэтому все инструменты в итоге предлагают примерно одни и те же фразы, и поэтому эти фразы переполнены.
Есть источник, который не изготавливает ни один инструмент, потому что изготовить его нельзя: текст, который пишут пользователи. Люди описывают продукт своими словами, и эти слова почти никогда не совпадают со словами построившей его команды.
Почему чужие отзывы ценнее ваших
Ваши собственные отзывы описывают то, что вы уже делаете, и эти слова обычно уже стоят в ваших метаданных. Чужие описывают две более полезные вещи: что делает приложение соперника и — в отзывах на одну и две звезды — чего оно не делает.
Вторая группа самая ценная. Когда одна и та же жалоба повторяется в нескольких приложениях категории, она перестаёт быть жалобой и становится описанием пробела. Там сразу и продуктовая идея, и слова, которыми её будут искать.
Извлечение: n-граммы и почему фильтр важнее
Разрезать текст на группы из одного, двух и трёх слов — лёгкая часть. Качество результата решает то, что отбрасывается потом.
Сильнее всего результат меняет фильтр местоимений. Люди пишут фразы вроде «помогло мне выучить» или «пользуюсь каждый день»: в извлекателе они выходят наверх, а ищут их ноль человек. Любая n-грамма с местоимением первого или второго лица отпадает.
Дальше отпадают повторы бренда — имя чужого приложения стоит почти в каждом его отзыве — и служебные слова. А свёртка регистра идёт по правилам страны, а не по глобальным, потому что фраза, свёрнутая двумя способами, это две фразы для системы.
Что делать с тем, что вышло
Фразы, пережившие фильтр, не идут прямо в метаданные. Сначала их измеряют: популярность и сложность в той стране, где вы собираетесь их применять. Многие оказываются шумом пола, и это тоже результат.
Прошедшие измерение попадают в пул и борются за место с остальными. Их преимущество в том, что они почти никогда не стоят в чужих метаданных: сложность низкая, и одной правки подзаголовка хватает, чтобы их взять.