Интересное · InstaParser
Как найти пересечение аудиторий нескольких конкурентов в Instagram
Пересечение аудиторий конкурентов находят по общему нормализованному username: данные каждого аккаунта собирают в отдельную выгрузку, внутри файлов удаляют технические повторы, затем объединяют таблицы и считают, в скольких источниках встречается каждый пользователь. Профили с двумя и более источниками образуют пересечение.

Короткий ответ: как сравнить аудитории конкурентов Instagram
Для сравнения нужен один технический ключ и отдельная метка источника. Обычно ключом служит username, приведённый к нижнему регистру без внешних пробелов и символа `@`. Источник хранится в отдельном столбце и не удаляется после объединения.
Главный результат — таблица «один пользователь — список конкурентов». Она показывает пользователей только одного источника, пары пересечений и профили, встречающиеся у трёх и более конкурентов. Простого удаления дублей недостаточно: оно уничтожает информацию о повторной встречаемости.
| Сегмент | Условие | Что показывает |
|---|---|---|
| Уникальный | Один источник | Специфическая аудитория конкурента |
| Парное пересечение | Два источника | Общий интерес к двум предложениям |
| Множественное пересечение | Три и более источника | Устойчивый интерес к категории |
| Повтор внутри источника | Один источник, несколько действий | Активность, а не пересечение конкурентов |
Какие аудитории можно сравнивать корректно
Сравнивать нужно одинаковые типы данных, собранные в сопоставимый период. Подписчиков одного аккаунта нельзя напрямую сопоставлять с авторами комментариев другого и называть разницу пересечением подписчиков. Тип действия меняет смысл результата.
- подписчики нескольких конкурентных аккаунтов;
- пользователи, поставившие лайки под сопоставимыми публикациями;
- авторы комментариев под постами или Reels одной тематики;
- пользователи из одинакового набора хэштегов;
- аудитории одинаковых географических источников.
Дата сбора должна быть записана для каждого файла. Аудитория меняется, поэтому выгрузки с разницей в несколько месяцев описывают разные состояния. Для разового анализа лучше запускать задачи в одном временном окне.
Как выбрать конкурентов для анализа пересечений
Конкурентов выбирают по одной задаче клиента, а не только по похожему названию продукта. Прямой конкурент, премиальный бренд и локальная альтернатива могут привлекать разные сегменты. Сравнение становится полезным, когда причина включения каждого аккаунта записана заранее.
Начните с трёх–пяти источников. Слишком большой список усложняет матрицу и увеличивает число слабых пересечений. Методика предварительной оценки раскрыта в статье о выборе аккаунтов-источников.
Что записать по каждому конкуренту
- название и username аккаунта;
- тип конкурента: прямой, косвенный или смежный;
- география и ценовой сегмент;
- тип собираемой аудитории;
- дата и параметры задачи;
- причина включения в анализ.
Как подготовить отдельные выгрузки
Каждый конкурент должен получить собственную задачу или однозначную метку в результате. Назовите файлы стабильно, например `followers_competitor_a_2026-08-30.csv`. Имя должно отвечать на три вопроса: что собрано, откуда и когда.
Минимальная схема включает username, source и collected_at. Для анализа активности добавьте тип действия и ссылку на публикацию. Открытые контакты не нужны для самого расчёта пересечений и не должны собираться «на всякий случай».
| Поле | Пример | Назначение |
|---|---|---|
| username_raw | @example_user | Исходное значение |
| username_key | example_user | Ключ сравнения |
| source | competitor_a | Метка конкурента |
| audience_type | followers | Тип данных |
| collected_at | 2026-08-30 | Дата состояния |
Как нормализовать username перед сравнением
Нормализация сводит технически одинаковые значения к одному ключу. Создайте рабочий столбец: удалите внешние пробелы, приведите символы к нижнему регистру и уберите ведущий `@`. Исходный username сохраните для проверки.
Полные ссылки нужно разобрать до имени профиля. Удалите домен, завершающий слеш и параметры после вопросительного знака. Не сравнивайте по отображаемому имени: оно не уникально и может меняться независимо от username.
Повторы внутри одного файла сворачивают до сравнения источников. При этом типы действий и публикации агрегируют в отдельные поля. Подробный процесс описан в инструкции по очистке базы от дублей.
Как собрать таблицу пересечений в CSV
Все нормализованные выгрузки объединяют вертикально в одну таблицу. Затем данные группируют по `username_key` и считают число уникальных значений `source`. Поле `source_count` показывает глубину пересечения.
- Добавьте одинаковые заголовки во все файлы.
- Создайте нормализованный ключ username.
- Удалите точные повторы внутри каждого источника.
- Объедините строки всех конкурентов.
- Сгруппируйте таблицу по username_key.
- Сохраните список уникальных источников пользователя.
- Посчитайте source_count.
- Отфильтруйте source_count ≥ 2.
Итоговую таблицу не нужно превращать только в список общих username. Оставьте столбцы `sources`, `source_count`, типы действий и дату. Они понадобятся для сегментации и повторной проверки.
Как найти пересечение двух аудиторий в Excel
Для двух небольших списков достаточно функции поиска совпадений. Разместите нормализованные username первого конкурента на листе A, второго — на листе B. На листе A добавьте признак наличия значения в столбце B, затем отфильтруйте совпадения.
Power Query удобнее для больших файлов и повторяемого процесса. Загрузите оба CSV, удалите дубли внутри запросов и выполните внутреннее объединение по `username_key`. Сохранённый запрос можно обновить при следующей выгрузке без ручного копирования формул.
Какие метрики пересечения использовать
Абсолютное пересечение показывает число общих профилей. Оно понятно, но зависит от размера аудиторий: 2 000 совпадений имеют разный смысл для баз по 3 000 и по 300 000 пользователей.
Доля от меньшей аудитории показывает, какая часть компактного источника уже покрыта крупным. Формула: пересечение ÷ размер меньшего множества × 100%. Метрика отвечает на вопрос, насколько меньший конкурент добавляет новую аудиторию.
Коэффициент Жаккара сравнивает пересечение с объединением. Формула: |A ∩ B| ÷ |A ∪ B| × 100%. Он симметричен и удобен для матрицы нескольких конкурентов.
| Метрика | Формула | Когда применять |
|---|---|---|
| Общие профили | |A ∩ B| | Оценить размер сегмента |
| Доля меньшей базы | |A ∩ B| / min(|A|, |B|) | Оценить заменяемость источника |
| Жаккар | |A ∩ B| / |A ∪ B| | Сравнить пары разного размера |
| Новые профили | |B − A| | Оценить добавочную ценность |
Пример расчёта для двух конкурентов
Пусть аудитория A содержит 8 000 уникальных username, B — 6 500, а общих профилей найдено 2 100. Объединение содержит 12 400 пользователей: 8 000 + 6 500 − 2 100.
- абсолютное пересечение — 2 100 профилей;
- доля от меньшей аудитории — 32,3%;
- коэффициент Жаккара — 16,9%;
- уникальная добавка B к A — 4 400 профилей.
Этот расчёт показывает четыре разных ответа из одних данных. Значения являются учебным примером от 30 августа 2026 года, а не статистикой клиентов или средней долей пересечения в InstaParser.
Как посчитать пересечение трёх конкурентов
Для трёх источников нужно отделить парные пересечения от тройного. Пользователь, присутствующий у A, B и C, попадёт сразу в три парные пары. Если просто сложить пары, один профиль будет посчитан несколько раз.
Учебный пример использует A = 8 000, B = 6 500 и C = 7 200 уникальных профилей. Пусть AB = 2 100, AC = 1 800, BC = 1 600, а ABC = 740. Объединение равно 16 940 профилям по формуле включений и исключений.
| Сегмент | Количество | Расчёт |
|---|---|---|
| Во всех трёх | 740 | ABC |
| Ровно в двух | 3 280 | AB + AC + BC − 3 × ABC |
| Минимум в двух | 4 020 | AB + AC + BC − 2 × ABC |
| Только в одном | 12 920 | Объединение − минимум в двух |
| Объединение | 16 940 | A + B + C − AB − AC − BC + ABC |
Проверка суммы защищает от двойного счёта. Сегменты «только один», «ровно два» и «все три» должны вместе дать размер объединения: 12 920 + 3 280 + 740 = 16 940.
Как построить матрицу пересечений конкурентов
Матрица размещает одинаковый список конкурентов по строкам и столбцам. В ячейке укажите коэффициент Жаккара или абсолютное число общих профилей. Диагональ содержит 100% либо размер собственной аудитории.
Одна матрица должна содержать одну метрику. Не смешивайте проценты и количество пользователей в соседних ячейках. Для управленческого отчёта сделайте две таблицы: абсолютные пересечения и относительную близость.
Как интерпретировать большое пересечение
Большое пересечение указывает на близость аудиторий, но не доказывает готовность к покупке. Пользователь мог подписаться из-за контента, розыгрыша, работы в отрасли или исследования рынка. Для усиления сигнала добавляйте тип активности и повторные действия.
Общие активные пользователи обычно информативнее общей массы подписчиков. Сегментируйте пересечение по лайкам, комментариям, числу источников и свежести действия. Подход к активности раскрыт в материале о поиске активных подписчиков.
Как использовать уникальные сегменты конкурентов
Уникальная аудитория показывает, чем источник дополняет уже собранную базу. Если новый конкурент даёт мало общих, но много релевантных уникальных профилей, он расширяет охват. Высокое пересечение, наоборот, может позволить отказаться от лишнего источника.
Уникальность нужно проверять на релевантность. Большой сегмент B − A бесполезен, если он состоит из другой страны или нецелевых типов профилей. Используйте правила из статьи о проверке качества базы Instagram.
Какие ошибки искажают пересечение аудиторий
- Смешивание разных типов данных. Подписчики и комментаторы отражают разные действия.
- Разные даты сбора. Сравнение описывает не одно состояние рынка.
- Отсутствие нормализации. `@User` и `user` ошибочно считаются разными профилями.
- Удаление источника после объединения. Глубину пересечения уже нельзя восстановить.
- Сложение пар без тройного пересечения. Общие профили считаются несколько раз.
- Оценка только абсолютным числом. Размер баз скрывает относительную близость.
- Сбор лишних персональных данных. Для расчёта достаточно идентификатора и источника.
Какие данные хранить в итоговой таблице
Итоговая таблица должна быть минимальной и проверяемой. Для анализа пересечения достаточно нормализованного username, исходного значения, списка источников, числа источников, типов действий и дат.
- username_key;
- username_raw;
- sources;
- source_count;
- audience_type;
- actions_count;
- first_collected_at и last_collected_at;
- quality_status.
Открытые контакты отделяйте от аналитической таблицы. Принцип минимизации данных требует собирать только необходимое для заявленной цели; применимое право и срок хранения согласуйте до использования результата.
Чек-лист анализа пересечений Instagram
- конкуренты решают сопоставимую задачу клиента;
- тип аудитории одинаков для всех источников;
- выгрузки выполнены в одном временном окне;
- username нормализован единым правилом;
- повторы внутри источника отделены от пересечений;
- для каждого профиля сохранён список источников;
- посчитаны абсолютное пересечение и относительная метрика;
- тройные пересечения не задвоены в сумме пар;
- уникальные сегменты проверены на релевантность;
- методика и дата записаны в отчёте.
Практический следующий шаг — сравнить три источника на небольшой выборке. Соберите данные отдельно, создайте единый ключ и постройте список пользователей с `source_count ≥ 2`. После проверки логики можно масштабировать процесс на полные базы.
Соберите аудитории конкурентов отдельно
InstaParser позволяет запускать задачи по нескольким аккаунтам, фильтровать результат и выгружать базы в TXT или CSV. Бесплатный режим включает до двух задач с общим лимитом до 10 000 строк.
Попробовать бесплатно