Интересное · InstaParser

Как найти пересечение аудиторий нескольких конкурентов в Instagram

Пересечение аудиторий конкурентов находят по общему нормализованному username: данные каждого аккаунта собирают в отдельную выгрузку, внутри файлов удаляют технические повторы, затем объединяют таблицы и считают, в скольких источниках встречается каждый пользователь. Профили с двумя и более источниками образуют пересечение.

Пересечение аудиторий нескольких конкурентов в Instagram
Общие профили выделяются в центральном пересечении, а уникальные остаются привязанными к своим источникам.

Короткий ответ: как сравнить аудитории конкурентов Instagram

Для сравнения нужен один технический ключ и отдельная метка источника. Обычно ключом служит username, приведённый к нижнему регистру без внешних пробелов и символа `@`. Источник хранится в отдельном столбце и не удаляется после объединения.

Главный результат — таблица «один пользователь — список конкурентов». Она показывает пользователей только одного источника, пары пересечений и профили, встречающиеся у трёх и более конкурентов. Простого удаления дублей недостаточно: оно уничтожает информацию о повторной встречаемости.

СегментУсловиеЧто показывает
УникальныйОдин источникСпецифическая аудитория конкурента
Парное пересечениеДва источникаОбщий интерес к двум предложениям
Множественное пересечениеТри и более источникаУстойчивый интерес к категории
Повтор внутри источникаОдин источник, несколько действийАктивность, а не пересечение конкурентов

Какие аудитории можно сравнивать корректно

Сравнивать нужно одинаковые типы данных, собранные в сопоставимый период. Подписчиков одного аккаунта нельзя напрямую сопоставлять с авторами комментариев другого и называть разницу пересечением подписчиков. Тип действия меняет смысл результата.

Дата сбора должна быть записана для каждого файла. Аудитория меняется, поэтому выгрузки с разницей в несколько месяцев описывают разные состояния. Для разового анализа лучше запускать задачи в одном временном окне.

Как выбрать конкурентов для анализа пересечений

Конкурентов выбирают по одной задаче клиента, а не только по похожему названию продукта. Прямой конкурент, премиальный бренд и локальная альтернатива могут привлекать разные сегменты. Сравнение становится полезным, когда причина включения каждого аккаунта записана заранее.

Начните с трёх–пяти источников. Слишком большой список усложняет матрицу и увеличивает число слабых пересечений. Методика предварительной оценки раскрыта в статье о выборе аккаунтов-источников.

Что записать по каждому конкуренту

Как подготовить отдельные выгрузки

Каждый конкурент должен получить собственную задачу или однозначную метку в результате. Назовите файлы стабильно, например `followers_competitor_a_2026-08-30.csv`. Имя должно отвечать на три вопроса: что собрано, откуда и когда.

Минимальная схема включает username, source и collected_at. Для анализа активности добавьте тип действия и ссылку на публикацию. Открытые контакты не нужны для самого расчёта пересечений и не должны собираться «на всякий случай».

ПолеПримерНазначение
username_raw@example_userИсходное значение
username_keyexample_userКлюч сравнения
sourcecompetitor_aМетка конкурента
audience_typefollowersТип данных
collected_at2026-08-30Дата состояния

Как нормализовать username перед сравнением

Нормализация сводит технически одинаковые значения к одному ключу. Создайте рабочий столбец: удалите внешние пробелы, приведите символы к нижнему регистру и уберите ведущий `@`. Исходный username сохраните для проверки.

Полные ссылки нужно разобрать до имени профиля. Удалите домен, завершающий слеш и параметры после вопросительного знака. Не сравнивайте по отображаемому имени: оно не уникально и может меняться независимо от username.

Повторы внутри одного файла сворачивают до сравнения источников. При этом типы действий и публикации агрегируют в отдельные поля. Подробный процесс описан в инструкции по очистке базы от дублей.

Как собрать таблицу пересечений в CSV

Все нормализованные выгрузки объединяют вертикально в одну таблицу. Затем данные группируют по `username_key` и считают число уникальных значений `source`. Поле `source_count` показывает глубину пересечения.

  1. Добавьте одинаковые заголовки во все файлы.
  2. Создайте нормализованный ключ username.
  3. Удалите точные повторы внутри каждого источника.
  4. Объедините строки всех конкурентов.
  5. Сгруппируйте таблицу по username_key.
  6. Сохраните список уникальных источников пользователя.
  7. Посчитайте source_count.
  8. Отфильтруйте source_count ≥ 2.

Итоговую таблицу не нужно превращать только в список общих username. Оставьте столбцы `sources`, `source_count`, типы действий и дату. Они понадобятся для сегментации и повторной проверки.

Как найти пересечение двух аудиторий в Excel

Для двух небольших списков достаточно функции поиска совпадений. Разместите нормализованные username первого конкурента на листе A, второго — на листе B. На листе A добавьте признак наличия значения в столбце B, затем отфильтруйте совпадения.

Power Query удобнее для больших файлов и повторяемого процесса. Загрузите оба CSV, удалите дубли внутри запросов и выполните внутреннее объединение по `username_key`. Сохранённый запрос можно обновить при следующей выгрузке без ручного копирования формул.

Какие метрики пересечения использовать

Абсолютное пересечение показывает число общих профилей. Оно понятно, но зависит от размера аудиторий: 2 000 совпадений имеют разный смысл для баз по 3 000 и по 300 000 пользователей.

Доля от меньшей аудитории показывает, какая часть компактного источника уже покрыта крупным. Формула: пересечение ÷ размер меньшего множества × 100%. Метрика отвечает на вопрос, насколько меньший конкурент добавляет новую аудиторию.

Коэффициент Жаккара сравнивает пересечение с объединением. Формула: |A ∩ B| ÷ |A ∪ B| × 100%. Он симметричен и удобен для матрицы нескольких конкурентов.

МетрикаФормулаКогда применять
Общие профили|A ∩ B|Оценить размер сегмента
Доля меньшей базы|A ∩ B| / min(|A|, |B|)Оценить заменяемость источника
Жаккар|A ∩ B| / |A ∪ B|Сравнить пары разного размера
Новые профили|B − A|Оценить добавочную ценность

Пример расчёта для двух конкурентов

Пусть аудитория A содержит 8 000 уникальных username, B — 6 500, а общих профилей найдено 2 100. Объединение содержит 12 400 пользователей: 8 000 + 6 500 − 2 100.

Этот расчёт показывает четыре разных ответа из одних данных. Значения являются учебным примером от 30 августа 2026 года, а не статистикой клиентов или средней долей пересечения в InstaParser.

Как посчитать пересечение трёх конкурентов

Для трёх источников нужно отделить парные пересечения от тройного. Пользователь, присутствующий у A, B и C, попадёт сразу в три парные пары. Если просто сложить пары, один профиль будет посчитан несколько раз.

Учебный пример использует A = 8 000, B = 6 500 и C = 7 200 уникальных профилей. Пусть AB = 2 100, AC = 1 800, BC = 1 600, а ABC = 740. Объединение равно 16 940 профилям по формуле включений и исключений.

СегментКоличествоРасчёт
Во всех трёх740ABC
Ровно в двух3 280AB + AC + BC − 3 × ABC
Минимум в двух4 020AB + AC + BC − 2 × ABC
Только в одном12 920Объединение − минимум в двух
Объединение16 940A + B + C − AB − AC − BC + ABC

Проверка суммы защищает от двойного счёта. Сегменты «только один», «ровно два» и «все три» должны вместе дать размер объединения: 12 920 + 3 280 + 740 = 16 940.

Как построить матрицу пересечений конкурентов

Матрица размещает одинаковый список конкурентов по строкам и столбцам. В ячейке укажите коэффициент Жаккара или абсолютное число общих профилей. Диагональ содержит 100% либо размер собственной аудитории.

Одна матрица должна содержать одну метрику. Не смешивайте проценты и количество пользователей в соседних ячейках. Для управленческого отчёта сделайте две таблицы: абсолютные пересечения и относительную близость.

Как интерпретировать большое пересечение

Большое пересечение указывает на близость аудиторий, но не доказывает готовность к покупке. Пользователь мог подписаться из-за контента, розыгрыша, работы в отрасли или исследования рынка. Для усиления сигнала добавляйте тип активности и повторные действия.

Общие активные пользователи обычно информативнее общей массы подписчиков. Сегментируйте пересечение по лайкам, комментариям, числу источников и свежести действия. Подход к активности раскрыт в материале о поиске активных подписчиков.

Как использовать уникальные сегменты конкурентов

Уникальная аудитория показывает, чем источник дополняет уже собранную базу. Если новый конкурент даёт мало общих, но много релевантных уникальных профилей, он расширяет охват. Высокое пересечение, наоборот, может позволить отказаться от лишнего источника.

Уникальность нужно проверять на релевантность. Большой сегмент B − A бесполезен, если он состоит из другой страны или нецелевых типов профилей. Используйте правила из статьи о проверке качества базы Instagram.

Какие ошибки искажают пересечение аудиторий

Какие данные хранить в итоговой таблице

Итоговая таблица должна быть минимальной и проверяемой. Для анализа пересечения достаточно нормализованного username, исходного значения, списка источников, числа источников, типов действий и дат.

Открытые контакты отделяйте от аналитической таблицы. Принцип минимизации данных требует собирать только необходимое для заявленной цели; применимое право и срок хранения согласуйте до использования результата.

Чек-лист анализа пересечений Instagram

Практический следующий шаг — сравнить три источника на небольшой выборке. Соберите данные отдельно, создайте единый ключ и постройте список пользователей с `source_count ≥ 2`. После проверки логики можно масштабировать процесс на полные базы.

Соберите аудитории конкурентов отдельно

InstaParser позволяет запускать задачи по нескольким аккаунтам, фильтровать результат и выгружать базы в TXT или CSV. Бесплатный режим включает до двух задач с общим лимитом до 10 000 строк.

Попробовать бесплатно