Рекламные брокеры. Индустрия которую никто не видит

Имя. Адрес. Доход. Здоровье. Политические взгляды. Сексуальная ориентация. Религия. Финансовые трудности. Семейные проблемы. Страхи. Желания. Слабости.

Часть первая — кто они такие

Но они знают о тебе всё.

Имя. Адрес. Доход. Здоровье. Политические взгляды. Сексуальная ориентация. Религия. Финансовые трудности. Семейные проблемы. Страхи. Желания. Слабости.

Они никогда не встречались с тобой. Ты никогда не давал им разрешения. Но твой профиль у них есть — детальный, точный, постоянно обновляемый. И он продаётся. Прямо сейчас. Пока ты читаешь этот текст.

Это рекламные брокеры данных. Data brokers. И это одна из крупнейших индустрий в мире о которой обычные люди не знают практически ничего.

Сегодня меняем это.

Начнём с вопроса который кажется простым.

Ты когда-нибудь задумывался откуда берётся таргетированная реклама?

Большинство людей думают примерно так. Google видит что я искал кроссовки — показывает рекламу кроссовок. Facebook видит что я подписан на страницы о путешествиях — показывает рекламу авиабилетов. Логично. Понятно. Один сервис, одна платформа, мои данные внутри неё.

Реальность устроена иначе. Принципиально иначе.

За каждым рекламным объявлением которое ты видишь — стоит целая экосистема. Десятки компаний которые никогда не взаимодействовали с тобой напрямую — но которые собрали, обработали, обогатили и продали информацию о тебе. Прежде чем ты увидел этот баннер.

Рекламные брокеры — это посредники в этой экосистеме. Невидимое звено между твоими данными и теми кто хочет до тебя достучаться.

Но называть их просто посредниками — значит сильно упрощать. Потому что они давно переросли роль посредника. Они стали независимой индустрией со своей логикой, своими продуктами, своими клиентами — и своей властью над жизнями миллиардов людей.

Acxiom. Компания которая знает тебя лучше чем ты думаешь.

Начнём с самого старого и самого крупного игрока.

Acxiom основана в 1969 году в американском штате Арканзас. Изначально — компания по прямой почтовой рассылке. Помогала бизнесам отправлять рекламные письма нужным людям. Обычный директ-маркетинг той эпохи.

Но у основателей было понимание которое оказалось пророческим. Ценность не в письмах — в списках. Не в рекламе — в данных о людях которым она адресована.

Следующие пятьдесят лет Acxiom строил самую большую в мире базу данных о потребителях.

Сегодня цифры такие.

Acxiom имеет данные примерно на 2.5 миллиарда человек по всему миру. Это треть населения планеты. На каждого человека в базе — в среднем 1500 отдельных характеристик. Компания обрабатывает около 50 триллионов транзакций данных в год. Её годовая выручка превышает 1.5 миллиарда долларов.

Что именно хранится в этих 1500 характеристиках?

Acxiom публично раскрывает часть своих категорий данных — потому что это требует закон в ряде юрисдикций. Список впечатляет.

Демография — возраст, пол, семейное положение, количество детей, их возраст, образование, профессия, доход, тип жилья, собственное или арендованное, стоимость недвижимости, наличие автомобилей и их марки.

Покупательское поведение — история покупок по категориям, предпочтения брендов, чувствительность к цене, склонность к импульсивным покупкам, участие в программах лояльности, использование купонов.

Интересы и увлечения — спорт, путешествия, книги, музыка, кулинария, садоводство, домашние животные, благотворительность, религиозная активность.

Финансовый профиль — кредитные карты, кредиты, инвестиции, страховки, финансовые трудности, история банкротств, судебные долговые решения.

Здоровье — хронические заболевания выводимые из покупок в аптеках и поисковых паттернов, беременность, наличие детей с особыми потребностями, пожилые родственники требующие ухода.

Психографика — ценности, убеждения, политические взгляды, отношение к риску, уровень тревожности, склонность к новому, привычному.

И это то что они раскрывают публично. Реальный список — шире.

Важная деталь которую мало кто знает. В 2013 году под давлением регуляторов Acxiom запустил сервис AboutTheData.com — где американцы могли посмотреть часть своего профиля. Люди которые зашли туда описывали это как шок. Данные были точными. Иногда — пугающе точными. Включая вещи о которых человек никому не рассказывал.

Сервис проработал несколько лет. Потом тихо закрылся.

Experian. Компания которая решает дадут ли тебе кредит.

Experian знают все — как кредитное бюро. Но большинство людей не знают что кредитное бюро — это только одна часть бизнеса.

Experian основан в Великобритании. Работает в 45 странах. Годовая выручка — около 6 миллиардов долларов. Это один из трёх крупнейших кредитных бюро мира — вместе с Equifax и TransUnion они контролируют глобальный рынок кредитного скоринга.

Что такое кредитный скоринг и почему это важно?

Каждый раз когда ты подаёшь заявку на кредит, ипотеку, кредитную карту, рассрочку — банк или финансовая организация запрашивает твой кредитный скор. Число от 300 до 850 в американской системе FICO, аналогичные шкалы в европейских системах. Это число определяет — дадут ли тебе кредит и под какой процент.

Скор рассчитывается на основе твоей кредитной истории. История хранится в бюро. Бюро собирает данные от всех финансовых организаций с которыми ты когда-либо работал.

Но вот что важно понять. Кредитная история — это только базовый продукт Experian. Дополнительный бизнес — гораздо интереснее.

Experian продаёт маркетинговые данные. Финансовые профили потребителей. Аналитику поведения. Предиктивные модели — кто вероятно возьмёт кредит в следующие три месяца, кто испытывает финансовые трудности, кто готов к крупной покупке.

Experian также продаёт данные страховым компаниям. Работодателям — в тех юрисдикциях где это разрешено. Государственным органам.

И вот что делает Experian особенно влиятельным. В отличие от Acxiom чьи данные используются преимущественно для рекламы — данные Experian напрямую влияют на финансовую жизнь человека. Скор который рассчитал алгоритм определяет получишь ли ты ипотеку. По какой ставке. Одобрят ли кредитную карту. Возьмут ли тебя на работу — потому что в ряде стран работодатели проверяют кредитную историю.

Ошибка в базе Experian — а они случаются — может стоить человеку годами испорченной финансовой репутации. Исследования в США показывают что около 25% кредитных отчётов содержат ошибки достаточно серьёзные чтобы повлиять на скор. Каждый четвёртый.

Люди об этих ошибках не знают — пока не получают отказ в кредите.

Oracle Data Cloud. Корпоративный монстр которого не видно.

Oracle — это название которое большинство людей ассоциирует с корпоративными базами данных и программным обеспечением для бизнеса. Скучная B2B компания. Что-то для IT-отделов крупных корпораций.

Это именно то впечатление которое Oracle хочет производить на обычных людей. Потому что Oracle Data Cloud — подразделение занимающееся данными о потребителях — является одним из крупнейших и наименее публичных игроков индустрии.

Oracle строил своё подразделение данных через серию поглощений. Приобрёл Datalogix — компанию которая специализировалась на связывании онлайн-поведения с офлайн-покупками. Купил BlueKai — крупнейшую платформу управления данными для рекламы. Поглотил AddThis — сервис кнопок «поделиться» который стоял на миллионах сайтов и незаметно собирал данные о посетителях.

Последнее особенно показательно. Кнопки «поделиться в Facebook», «поделиться в Twitter» которые стоят на новостных сайтах, блогах, интернет-магазинах — они не просто дают возможность поделиться контентом. Они трекеры. Каждый визит на страницу где стоит такая кнопка — фиксируется. Даже если ты на неё не нажимал.

AddThis стоял на двух миллионах сайтов. Oracle через это подразделение видел огромную долю всего интернет-трафика.

Что продаёт Oracle Data Cloud?

Аудиторные сегменты. Это готовые наборы профилей людей объединённых по какому-то признаку. «Люди планирующие покупку автомобиля в следующие 90 дней». «Родители детей от 3 до 6 лет». «Люди с доходом выше среднего интересующиеся инвестициями». «Люди испытывающие финансовые трудности».

Рекламодатель покупает доступ к нужному сегменту — и его реклама показывается именно этим людям. На любых сайтах и платформах где Oracle имеет партнёрство. А партнёрство у Oracle — везде.

Ты видишь рекламу. Ты не видишь Oracle. Oracle видит тебя.

Quantcast. Тот самый который я нашёл в трафике.

Помнишь разбор сайта Ehituse ABC? 1448 запросов к трём доменам Quantcast одновременно. Компания не упомянутая в политике конфиденциальности магазина. Компания которая не отвечает на официальные GDPR-запросы уже больше 30 дней.

Это не случайный пример. Это типичная картина.

Quantcast основан в 2006 году в Сан-Франциско. Специализируется на измерении аудитории и таргетированной рекламе. Технология компании — так называемый direct measurement, прямое измерение — означает что Quantcast устанавливает свой код непосредственно на сайты партнёров и собирает данные напрямую, без посредников.

Это даёт Quantcast очень детальную картину поведения пользователей — не агрегированную статистику, а индивидуальные паттерны.

Quantcast утверждает что охватывает более 100 миллионов сайтов и приложений. Что видит более 100 миллионов уникальных пользователей ежемесячно только в США. Глобальный охват — на порядок больше.

Три домена одновременно на сайте строительного магазина в Эстонии — это стандартная конфигурация Quantcast. Один домен для сбора данных о поведении. Второй для статических ресурсов. Третий для синхронизации идентификаторов с другими рекламными платформами.

Синхронизация идентификаторов — это отдельная тема которую стоит объяснить.

У каждой рекламной платформы есть свой идентификатор для каждого пользователя. У Quantcast — один. У Google — другой. У Trade Desk — третий. Чтобы эти платформы могли работать вместе — им нужно сопоставить свои идентификаторы. Узнать что quantcast_id_12345 это тот же человек что google_id_67890.

Это называется cookie syncing или ID syncing. Происходит автоматически, незаметно, постоянно. В момент загрузки любой страницы с рекламой.

Результат — твой профиль объединяется across всех платформ. Quantcast знает что ты делал на сайтах где стоит его код. Google знает что ты искал. Trade Desk знает что ты смотрел на других сайтах. Через синхронизацию — это всё соединяется в единый профиль.

И ни один из этих обменов данными ты не видишь. Ни на один не давал отдельного согласия.

Почему они не упомянуты в политиках конфиденциальности.

Это вопрос который я слышу постоянно. Если это законная деятельность — почему они прячутся?

Ответ неудобный. Потому что если написать правду — никто не нажмёт «принять».

Представь политику конфиденциальности которая честно говорит следующее. «Когда вы заходите на наш сайт, ваши данные автоматически передаются 47 компаниям. Вот их полный список. Каждая из них строит ваш профиль. Профили продаются другим компаниям. Мы не контролируем что происходит с данными после передачи. Некоторые из этих компаний находятся в США и не имеют действующего правового основания для получения данных европейских пользователей.»

Такую политику никто не напишет. Потому что тогда придётся либо получать реальное информированное согласие — которое большинство людей не даст — либо признавать нарушения.

Вместо этого пишут. «Мы работаем с доверенными партнёрами для улучшения вашего опыта и показа релевантной рекламы.»

Доверенные партнёры. Улучшение опыта. Релевантная реклама. Три фразы которые юридически ничего не говорят — но звучат безобидно.

GDPR требует раскрывать список получателей данных. Большинство компаний либо указывают категории — «рекламные партнёры» — вместо конкретных имён. Либо дают ссылку на список который обновляется каждые несколько недель и в котором несколько сотен позиций. Формально — требование выполнено. Фактически — информация недоступна обычному человеку.

Это не случайность. Это дизайн.

Масштаб который сложно представить.

Давай попробую дать ощущение масштаба через конкретные цифры.

Глобальный рынок брокеров данных оценивается примерно в 300 миллиардов долларов в год. Для сравнения — это больше чем ВВП многих европейских стран.

В США насчитывается более 4000 компаний которые можно отнести к категории брокеров данных. В Европе — меньше из-за GDPR, но тоже сотни.

Среднестатистический американец фигурирует в базах примерно 2500 брокеров данных. Европеец — меньше, но тоже в сотнях.

Данные о среднем человеке продаются в среднем 376 раз в год. Это примерно раз в день. Каждый день — кто-то покупает информацию о тебе у кого-то другого.

Стоимость полного профиля человека — от нескольких центов до нескольких долларов. Звучит как мало. Но умножь на миллиарды людей и сотни транзакций в год — получишь те самые 300 миллиардов.

И вот что самое важное в этих цифрах.

Ни цента из этих денег не достаётся тебе. Твои данные — твоя жизнь, твои решения, твои привычки, твои слабости — продаются снова и снова. Ты не получаешь ничего. Ты не давал согласия. Ты не знаешь кто покупает. Ты не знаешь для чего.

Это индустрия построенная на ресурсе который принадлежит тебе — но который у тебя никто не спрашивал.

Откуда они берут данные. Полная картина.

Последнее что нужно понять в этом посте — откуда вообще берётся то что они продают.

Источников много. И они работают одновременно.

Публичные реестры. В большинстве стран огромное количество информации о гражданах является публичной по закону. Реестры недвижимости — кто чем владеет. Судебные решения — долги, банкротства, уголовные дела. Реестры компаний — кто является директором и учредителем. Избирательные списки — в ряде стран они публичны и содержат имена и адреса. Брокеры систематически собирают всё это.

Программы лояльности. Карта скидок в супермаркете. Бонусная программа в аптеке. Накопительные мили авиакомпании. За каждой из них — база данных о покупках. Эти данные продаются. Именно поэтому программы лояльности существуют — не чтобы сделать тебя лояльным, а чтобы получить данные о твоих покупках взамен на небольшую скидку.

Сайты и приложения. Огромная часть интернета работает на рекламной модели. Каждый визит — это данные которые сайт может продать. Каждое приложение которое ты устанавливаешь и которому даёшь разрешения — потенциальный источник данных для брокеров.

Другие брокеры. Брокеры покупают данные друг у друга. Один специализируется на финансовых профилях. Другой — на поведенческих данных. Третий — на демографии. Обмениваясь и покупая друг у друга — они обогащают собственные базы.

Утечки. Это никто не говорит вслух — но часть данных в базах брокеров имеет сомнительное происхождение. Утёкшие базы оказываются на форумах даркнета. Оттуда они попадают к посредникам. Посредники продают их брокерам — не всегда с полным пониманием источника.

Социальные сети. Публичные профили, публичные посты, публичные фото — всё это парсится автоматически. Алгоритмы обходят публичную часть соцсетей и собирают то что люди сами сделали публичным — не всегда понимая что это означает.

В результате — профиль который формируется о тебе складывается из десятков источников. Ты никогда не взаимодействовал ни с одним брокером напрямую. Но каждый раз когда ты делал что-то в физическом или цифровом мире — где-то ставилась ещё одна галочка в твоём досье.

Что дальше.

В следующем посте — как именно выглядит твой профиль в базе брокера. Какие категории. Какие метки. Что означают эти метки на практике — какие решения принимаются на их основе.

И кое-что о чём брокеры предпочитают не говорить. Категории данных которые они собирают но официально отрицают. Метки которые ставятся на людей — и которые те никогда не видят.

Потому что то что ты не знаешь о своём профиле — это и есть их главное конкурентное преимущество.

Рекламные брокеры. Часть вторая — как выглядит твой профиль изнутри

В прошлый раз мы познакомились с игроками. Acxiom, Experian, Oracle, Quantcast. Кто они, откуда берут данные, какой масштаб у этой индустрии.

Сегодня открываем досье. Смотрим что именно там написано. Какими словами. Какими категориями. Что означают эти категории на практике — и почему некоторые из них меняют жизнь человека способами которые он никогда не ожидал.

Потому что профиль в базе брокера — это не просто набор фактов о тебе. Это интерпретация. Это выводы. Это метки которые кто-то поставил — и которые теперь следуют за тобой.

Начнём с того как профиль выглядит технически.

Представь таблицу. Строки — люди. Столбцы — характеристики. Тысячи столбцов. В каждой ячейке — значение. Число, категория, флаг — да или нет.

Это упрощённое представление. На самом деле профиль — это граф. Связанная структура где каждый элемент данных связан с другими. Покупка связана с локацией. Локация связана с временем. Время связано с паттерном поведения. Паттерн поведения связан с психографическим выводом.

Но для понимания — думай о таблице.

Первый слой — то что ты сам сообщал.

Имя. Дата рождения. Адрес — текущий и предыдущие. Email — часто несколько. Телефон. Семейное положение. Количество детей. Образование. Профессия. Работодатель.

Это базовый слой. Он формируется из регистраций на сайтах, анкет программ лояльности, публичных реестров. Кажется безобидным — это же просто факты.

Но это только фундамент. Дальше начинается настоящее.

Второй слой — то что наблюдали.

История покупок. Не просто «покупал в супермаркете». Детально — какие категории товаров, какие бренды, в какое время суток, насколько регулярно, средний чек, чувствительность к скидкам, импульсивность покупок.

История поиска и браузинга — для тех брокеров у которых есть партнёрство с поисковиками и сайтами. Что искал. Как долго читал. Что открывал и закрывал не дочитав. На чём останавливался.

Геолокация. Где бывает регулярно. Маршруты. Время в разных местах. Частота посещений медицинских учреждений — это выводится из геолокации без единого медицинского документа.

Финансовые транзакции — агрегированные данные от банков и платёжных систем. Не конкретные суммы всегда — но паттерны. Регулярные платежи. Нерегулярные крупные расходы. Задержки платежей.

Третий слой — то что вывели.

И вот здесь начинается самое интересное. И самое опасное.

Брокеры не просто хранят факты. Они делают выводы. Строят модели. Присваивают категории которых человек сам себе никогда бы не присвоил.

Эти выводы называются по-разному. Инференции. Предикции. Скоры. Сегменты. Но суть одна — алгоритм решил что ты относишься к определённой категории. И эта категория теперь часть твоего профиля.

Категории которые существуют. И которые ты никогда не видел.

В 2019 году исследователи из Университета Брауна и ряда других организаций провели масштабный анализ категорий данных которые используют крупнейшие брокеры. Они изучили публично доступные таксономии — классификационные системы которые брокеры раскрывают рекламодателям чтобы те могли выбрать нужную аудиторию.

Результаты были опубликованы. И они показали кое-что важное.

Вот реальные категории которые существуют в системах брокеров данных. Не выдуманные — задокументированные.

Категории связанные со здоровьем.

«Вероятно страдает диабетом» — выводится из покупок в аптеке, поисковых запросов, покупок продуктов питания, геолокации рядом с медицинскими учреждениями. Без единого медицинского документа.

«Вероятно беременна» — классический пример который мы упоминали раньше. Изменение покупательского паттерна, определённые поисковые запросы, покупка специфических товаров.

«Проблемы с психическим здоровьем» — выводится из поисковых запросов, активности в соцсетях в ночное время, покупок определённых категорий медикаментов в аптеке, паттернов потребления контента.

«Борется с зависимостью» — комбинация поведенческих сигналов, геолокации, поисковых запросов.

«Онкологическое заболевание» — частые визиты в медицинские учреждения определённого профиля, поисковые запросы, покупки.

Категории связанные с финансами.

«Финансово уязвимый» — задержки платежей, определённые поисковые запросы, паттерн расходов указывающий на нехватку средств к концу месяца.

«Склонен к азартным играм» — поведенческие паттерны, история посещения определённых сайтов, геолокация.

«Высокий риск дефолта» — предиктивная модель на основе десятков переменных.

«Недавно потерял работу» — изменение паттерна расходов, определённые поисковые запросы, изменение геолокации.

Категории связанные с личной жизнью.

«Недавний развод» — изменение семейного адреса, определённые юридические поисковые запросы, паттерн покупок.

«Переживает горе» — поведенческие сигналы, поисковые запросы, геолокация рядом с похоронными службами или кладбищами.

«Одинок» — паттерн геолокации, активность в определённое время суток, покупки.

Категории политические и религиозные

«Консервативные политические взгляды». «Либеральные политические взгляды». «Религиозно активен». «Посещает церковь». «Поддерживает определённые политические движения».

Всё это — реальные категории. Реальные метки. Которые реально продаются реальным покупателям.

Теперь остановись на секунду.

Подумай о человеке который борется с онкологическим заболеванием. Он никому не говорил об этом кроме самых близких. Это его личное. Его право решать кому говорить.

Но в базе брокера стоит метка. И эта метка продаётся. Страховым компаниям которые пересчитывают его тариф. Работодателям которые используют данные при найме. Финансовым организациям которые оценивают риски.

Человек не говорил. Алгоритм решил. Метка стоит. Последствия есть.

Или человек который переживает развод. Тяжёлый период. Уязвимый момент. В базе брокера — флаг «недавний развод» и «финансово уязвимый». Этот профиль покупают юридические компании специализирующиеся на разводах, финансовые консультанты предлагающие сомнительные продукты, компании занимающиеся быстрыми кредитами.

Система видит уязвимость. И продаёт доступ к уязвимому человеку тем кто хочет на этом заработать.

Это не гипотетические сценарии. Это задокументированные практики.

Скоры которые ты не знаешь о себе.

Помимо категорий — в профилях существуют скоры. Числовые оценки по разным параметрам. Их десятки. Иногда сотни.

Вот несколько реальных типов скоров которые продаются брокерами.

Покупательский скор. Вероятность что ты купишь определённую категорию товаров в следующие 30, 60, 90 дней. Рассчитывается отдельно для каждой категории. Автомобили, недвижимость, электроника, одежда, путешествия.

Скор отклика. Насколько ты склонен реагировать на рекламу — кликать, переходить, покупать. Люди с высоким скором отклика стоят дороже на рекламном аукционе.

Скор лояльности бренду. Насколько ты привержен к определённым брендам. Компании готовы платить больше за людей которых можно переманить от конкурента.

Скор финансового риска. Вероятность дефолта, задержки платежей, финансовых трудностей. Используется не только банками — страховыми компаниями, арендодателями, работодателями.

Скор здоровья. Предсказываемые медицинские расходы на следующий год. Страховые компании очень интересуются этим числом.

Скор влияния. Насколько ты влияешь на покупательские решения других людей — через соцсети, через рекомендации, через социальные связи. Инфлюенсеры( человек, мнение которого является важным для большого числа людей) с высоким скором влияния стоят дороже.

Скор уязвимости. Это самый тёмный продукт. Насколько человек уязвим к определённым типам рекламных воздействий. Люди в сложных жизненных ситуациях — с высоким долговым давлением, переживающие личные трагедии, борющиеся с зависимостями — имеют высокий скор уязвимости. И этот скор покупают компании которые специализируются именно на таких людях.

Это не предположение. В 2014 году сенат США провёл расследование рынка брокеров данных. В официальном докладе зафиксировано что ряд брокеров продавал списки людей с метками типа «финансово уязвимые», «отчаянно нуждающиеся в деньгах», «жертвы мошенничества» — компаниям занимающимся хищническим кредитованием и мошенническими схемами.

Люди в самые трудные моменты жизни — продавались тем кто хотел сделать эти моменты ещё труднее.

Как данные обогащаются. Процесс который происходит постоянно.

Профиль не статичен. Он живой. Обновляется постоянно — иногда в реальном времени.

Есть процесс который называется data enrichment — обогащение данных. Когда один брокер соединяет свои данные с данными другого брокера — и получает более полный профиль.

Вот как это работает на практике.

Брокер А имеет демографические данные и историю покупок в офлайн-магазинах. Брокер Б имеет данные о поведении в интернете. Брокер В имеет финансовые данные из кредитного бюро.

Все три брокера продают и покупают данные друг у друга. Через синхронизацию идентификаторов — о которой мы говорили в прошлый раз — профили соединяются. Результат — профиль который содержит данные всех трёх источников.

Этот обогащённый профиль стоит дороже. Продаётся дороже. Используется для более точного таргетинга.

И вот что важно. Когда ты дал данные брокеру А — ты не знал что они попадут к брокеру Б и В. Ты не знал что будет происходить обогащение. Ты не давал на это согласия.

В рамках GDPR каждая такая передача данных требует правового основания. Согласие или законный интерес. На практике — большинство таких передач происходят на основании «законного интереса» который трактуется максимально широко.

Именно поэтому я веду дела против брокеров. Не потому что хочу закрыть индустрию. Потому что индустрия работает в серой зоне — и эту зону нужно освещать.

Специальные категории данных. Красная линия которую пересекают.

GDPR выделяет особую категорию — специальные категории персональных данных. Статья 9. Это данные которые требуют повышенной защиты потому что их утечка или неправомерное использование может причинить серьёзный вред.

Что входит в специальные категории?

Расовое или этническое происхождение. Политические взгляды. Религиозные или философские убеждения. Членство в профсоюзе. Генетические данные. Биометрические данные используемые для идентификации. Данные о здоровье. Данные о сексуальной жизни или сексуальной ориентации.

Обработка специальных категорий — запрещена по умолчанию. Разрешена только при наличии явного согласия или в строго определённых законом случаях.

Теперь посмотри на список категорий которые мы разобрали выше.

«Вероятно страдает диабетом» — это данные о здоровье. Специальная категория.

«Проблемы с психическим здоровьем» — данные о здоровье. Специальная категория.

«Консервативные или либеральные политические взгляды» — политические взгляды. Специальная категория.

«Религиозно активен» — религиозные убеждения. Специальная категория.

Брокеры обрабатывают специальные категории. Не напрямую — они никогда не скажут «мы обрабатываем данные о здоровье». Они скажут «мы делаем предиктивные инференции на основе поведенческих данных».

Инференция — вывод. Технически это не данные о здоровье. Это предположение о здоровье на основе поведения.

Суды в разных странах постепенно начинают признавать что такое разграничение — юридическая фикция. Если вывод касается здоровья — он является данными о здоровье вне зависимости от того как его назвать.

Но пока эти дела идут через суды — брокеры продолжают работать.

Что происходит когда профиль ошибается.

Алгоритмы ошибаются. Это факт. И когда алгоритм ошибается в профиле — последствия несёт человек.

Несколько типов ошибок которые задокументированы.

Ошибка идентификации. Данные разных людей с одинаковым именем смешиваются в один профиль. Отец и сын с одинаковыми именами. Однофамильцы в одном городе. Результат — один человек получает в профиль данные другого. Долги чужого человека. Судимость чужого человека. Медицинская история чужого человека.

Ошибка вывода. Алгоритм делает неверный вывод из правильных данных. Человек регулярно покупает детское питание — не потому что у него ребёнок, а потому что ухаживает за пожилым родственником. Алгоритм присваивает метку «родитель маленького ребёнка» — и человек начинает получать рекламу подгузников и детских товаров. Это безобидный пример. Бывают не безобидные.

Ошибка устаревших данных. Человек десять лет назад имел финансовые трудности. Давно всё решил. Но в базе брокера — старая метка. Которая до сих пор влияет на решения о нём.

Ошибка предвзятости. Алгоритм обучен на исторических данных которые отражают существующее неравенство. Результат — он воспроизводит и усиливает это неравенство. Люди из определённых районов получают более высокий скор финансового риска не потому что они лично ненадёжны — а потому что исторически из этих районов было больше дефолтов. Круг замкнулся.

Что объединяет все эти ошибки?

Человек о них не знает. Он не видит свой профиль. Он не знает какие метки стоят. Он узнаёт об ошибке только когда она материализуется — в виде отказа в кредите, в виде завышенного страхового тарифа, в виде отказа в найме.

И тогда начинается долгий путь доказывания что алгоритм ошибся.

Момент который нужно понять про власть этих данных.

Есть концепция которую я хочу объяснить потому что она меняет отношение к теме.

Называется information asymmetry — информационная асимметрия.

Это ситуация когда одна сторона в отношениях знает значительно больше другой. И использует это знание в своих интересах.

Классический пример — продавец подержанных автомобилей знает о машине всё. Покупатель — почти ничего. Продавец использует это преимущество.

В отношениях человека с рекламными брокерами — асимметрия абсолютная.

Брокер знает о тебе 1500 характеристик. Десятки скоров. Сотни меток. Историю за годы. Предсказания о будущем.

Ты не знаешь о брокере ничего. Ты не знаешь что он существует. Не знаешь что у него есть твой профиль. Не знаешь что в профиле написано. Не знаешь кому он его продаёт.

Эта асимметрия — основа бизнес-модели. Она не случайна. Она намеренна. Потому что если ты увидишь свой профиль — ты захочешь его изменить. Или удалить. Или подать жалобу.

Пока ты не видишь — система работает без помех.

GDPR — это инструмент который уменьшает эту асимметрию. Право на доступ, право на удаление, право на возражение — это инструменты которые дают тебе информацию о том что о тебе знают.

Но инструмент работает только когда им пользуются.

Что дальше.

В следующем посте — самый практический из трёх. Как выйти из баз брокеров. Что реально работает. Что не работает несмотря на красивые обещания. Почему это сложнее чем кажется — и почему всё равно стоит пробовать.

И кое-что о чём я знаю из личного опыта — что происходит когда ты начинаешь требовать своих прав от компании которая привыкла что её никто не беспокоит.

Потому что их реакция — очень показательна.

Рекламные брокеры. Часть третья — как выйти из баз. И почему они не хотят тебя отпускать

Два поста назад мы познакомились с игроками этой индустрии. В прошлый раз — открыли досье и увидели что внутри. Сегодня — самый важный разговор.

Что делать с этим знанием.

Я не буду обещать простых решений. Потому что простых решений нет. Индустрия стоимостью 300 миллиардов долларов не построила бизнес-модель с удобной кнопкой «удалить меня». Каждый шаг к выходу из их баз встречает сопротивление — иногда пассивное, иногда активное.

Но это не значит что делать нечего. Это значит — нужно знать что реально работает. И что является иллюзией контроля.

Начнём с честного разговора о том почему выйти сложно.

Проблема которую мало кто понимает до конца

Когда люди узнают о брокерах данных — первый импульс понятен. Удалить всё. Выйти из всех баз. Стать невидимым.

Звучит как план. На практике — это как пытаться собрать воду в решето.

Вот почему.

Ты не знаешь из каких конкретно баз нужно выходить. Мы говорили о четырёх крупных брокерах. Реальное число компаний которые имеют данные о среднем европейце — сотни. Возможно тысячи. У каждой — свой процесс opt-out. Свои требования. Своя форма. Свои сроки.

Даже если ты прошёл весь процесс и данные удалили — они появятся снова. Потому что источники которые питают базы брокеров — публичные реестры, программы лояльности, сайты с трекерами — продолжают работать. Брокер удалил твои данные сегодня. Через три месяца купил обновлённую базу у партнёра — и ты снова там.

Процессы opt-out спроектированы так чтобы быть максимально неудобными. Это не паранойя — это задокументированный факт. Исследование Федеральной торговой комиссии США показало что большинство брокеров требуют для удаления данных предоставить больше личных данных. Имя, адрес, дату рождения, копию документа. Чтобы удалить данные о себе — нужно дать ещё данные о себе.

Оцени иронию.

Некоторые брокеры делают opt-out возможным только через почтовое письмо. В 2024 году. Физическое письмо на бумаге. Это не техническая необходимость. Это барьер.

Некоторые принимают запрос — но не удаляют данные, а только помечают профиль флагом «не использовать для рекламы». Данные остаются. Продаются для других целей.

Понимание этого не должно демотивировать. Оно должно сформировать реалистичные ожидания. Цель не полное исчезновение — это недостижимо. Цель — значительное уменьшение следа и использование законных инструментов давления на систему.

Что реально работает. Уровень первый — профилактика

Самое эффективное — не пускать данные в базы с самого начала. Это дешевле чем лечение.

Браузер и поиск.

Смени поисковик. Google — это машина сбора данных с поисковым интерфейсом. DuckDuckGo не отслеживает запросы и не строит профиль. Brave Search — аналогично. Startpage показывает результаты Google но без передачи данных о тебе.

Это одно изменение которое мгновенно убирает один из самых информативных потоков данных о тебе.

Установи браузер Firefox с расширением uBlock Origin. Это блокировщик рекламы и трекеров. Бесплатный. Эффективный. После установки — зайди на любой сайт и посмотри сколько трекеров заблокировано. На среднем новостном сайте — от 20 до 50. Это 20-50 компаний которые больше не получают данные о твоём визите.

Браузер Brave — альтернатива. Встроенная блокировка трекеров и рекламы без дополнительных настроек. Показывает счётчик заблокированных трекеров — очень отрезвляет когда видишь цифры.

Cookie-баннеры.

Всегда нажимай «отклонить всё» или «только необходимые». Всегда. Даже если кнопка спрятана и нужно нажать три раза чтобы до неё добраться.

Расширение I don’t care about cookies — автоматически отклоняет cookie-баннеры на большинстве сайтов. Устанавливается за минуту. Работает в фоне.

Расширение Consent-O-Matic — аналогично, разработано датскими исследователями. Открытый код. Проверяемое поведение.

Email.

Не используй основной email для регистраций на сайтах. Заведи отдельный адрес для всего что не является важным. Или используй сервисы временных адресов — SimpleLogin, AnonAddy. Они создают псевдонимы которые пересылают почту на твой настоящий адрес. Сайт получает псевдоним — не твой реальный email.

Когда псевдоним начинает получать спам — ты знаешь кто продал данные. Псевдоним отключается за один клик.

Телефон.

Проверь разрешения всех приложений. Зайди в настройки — приложения — разрешения. Геолокация, микрофон, камера, контакты, календарь. Отзови всё что не является функционально необходимым для работы приложения.

Карты и навигация — геолокация нужна. Фонарик — геолокация не нужна. Калькулятор — микрофон не нужен. Логика простая.

Программы лояльности.

Это сложный выбор — и я не буду говорить что правильно для тебя. Но ты должен знать цену которую платишь за скидку.

Карта лояльности супермаркета — это обмен. Ты получаешь скидку 2-5%. Магазин получает детальную историю всех твоих покупок. Которую продаёт. Многократно.

Если участвуешь в программах лояльности — используй отдельный email. По возможности — минимум личных данных при регистрации.

Что реально работает. Уровень второй — GDPR-запросы

Это инструмент который у тебя есть прямо сейчас. Юридически обязывающий. Бесплатный. И неожиданно эффективный — потому что компании которые привыкли к тишине реагируют на официальные запросы иначе.

Шаг первый. Найди брокеров у которых есть твои данные.

Начни с крупных. Acxiom, Experian, Oracle Data Cloud, Quantcast, Epsilon, Equifax, TransUnion, LexisNexis, CoreLogic.

Зайди на сайт каждого. Найди раздел Privacy или Data Privacy или GDPR. Там должен быть процесс подачи запроса субъекта данных — Data Subject Request или DSR.

Если такого раздела нет — ищи email адрес DPO, Data Protection Officer. По GDPR каждая компания обрабатывающая значительные объёмы данных обязана иметь такого офицера и его контакты должны быть публично доступны.

Шаг второй. Отправь правильный запрос.

Здесь важна деталь которую большинство людей не знают — и которая принципиально меняет качество ответа.

Когда ты пишешь запрос и указываешь только имя и email — система тебя не узнаёт. Не потому что не хочет. Потому что система знает тебя не по имени. Она знает тебя по коду.

Длинному цифровому коду. Строке символов. Именно под ним ты существуешь в их базе. Имя для алгоритма вторично. Код — первичен.

Вот как выглядят эти коды в реальности — чтобы ты мог узнать их когда встретишь.

Cookie ID — самый распространённый идентификатор. Хранится в браузере. Присваивается при первом визите:

_ga=GA1.2.1234567890.1698765432

_fbp=fb.1.1698765432123.1234567890

mc=8f3a2b1c-4d5e-6f7a-8b9c-0d1e2f3a4b5c

uuid=550e8400-e29b-41d4-a716-446655440000

Device Fingerprint — вычисляется из характеристик твоего устройства и браузера. Очистка cookie его не удаляет — он пересчитывается и каждый раз совпадает:

fp=a1b2c3d4e5f6789012345678901234567890abcd

Advertising ID на смартфоне — постоянный идентификатор который видят все приложения с разрешением на отслеживание:

GAID: 38400000-8cf0-11bd-b23e-10b96e40000d (Android)

IDFA: A1B2C3D4-E5F6-7890-ABCD-EF1234567890 (iPhone)

Third-party Cookie ID — устанавливается рекламными платформами для межсайтового отслеживания:

IDE=AHWqTUmKjL3n5XvP8wZ2qR9sY4kM7pN1oE6tB0cF (Doubleclick)

TDID=7a8b9c0d-1e2f-3a4b-5c6d-7e8f9a0b1c2d (Trade Desk)

uid=McqThZRPGpz8AAAA (Criteo)

localStorage идентификаторы — хранятся не в cookie а в локальном хранилище браузера. Очистка cookie их не удаляет. Это намеренно:

tt_chain_token: AbCdEfGhIjKlMnOpQrStUvWxYz1234567890==

line_user_id: U1a2b3c4d5e6f7a8b9c0d1e2f3a4b5c6d

_pxvid: 1a2b3c4d-5e6f-7a8b-9c0d-1e2f3a4b5c6d

Внутренние ID брокеров — хранятся на их серверах, ты их не видишь в браузере, но именно их нужно требовать в запросе:

AbiliTec_ID: ACX-7834521-US-20190847362 (Acxiom)

BlueKai_ID: bk-uid-8f3a2b1c4d5e6f7a (Oracle)

RampID: Rm1a2b3c4d5e6f7a8b9c0d1e2f3a4b5c (LiveRamp)

ConsumerView_ID: EXP-C-1234567890-EU (Experian)

Где найти свои коды прямо сейчас. Открой браузер. Зайди на любой крупный сайт. Нажми F12 или Ctrl+Shift+I .. Вкладка Application. Слева — Cookies, Local Storage, Session Storage. Там — десятки строк. Непонятные ключи. Длинные значения. Это и есть коды по которым тебя знает система. Не по имени. Вот по этому.

Теперь — запрос который показывает что ты понимаешь систему изнутри:

На основании статьи 15 GDPR прошу предоставить доступ ко всем персональным данным которые вы обрабатываете в отношении меня. В частности прошу раскрыть все технические идентификаторы под которыми я обрабатываюсь в ваших системах, включая но не ограничиваясь:

— Cookie ID и все связанные идентификаторы

— Device fingerprint или его хэш

— Advertising ID (GAID/IDFA) если применимо

— Внутренние пользовательские ID вашей системы

— Идентификаторы полученные через cookie syncing или ID syncing с партнёрами

— Идентификаторы в localStorage или sessionStorage

— Любые иные технические идентификаторы связанные с моим устройством, браузером или поведением. Также прошу указать всех получателей которым эти идентификаторы были переданы и правовое основание для каждой такой передачи.

Разница между этим запросом и стандартным — принципиальная.

Стандартный запрос — «дайте мои данные» — компания может ответить именем и email. Формально выполнила требование.

Этот запрос — ты явно называешь что именно хочешь видеть. Cookie ID, fingerprint, внутренние идентификаторы, список получателей с правовым основанием для каждой передачи. Теперь компания обязана ответить по каждому пункту — или объяснить почему не может.

Это не агрессия. Это грамотность. Именно так выглядит разговор на равных с системой которая привыкла к тишине.

Шаг третий. Жди. Фиксируй.

Компания обязана ответить в течение одного месяца. Статья 12(3) GDPR. Если запрос сложный — могут попросить продление ещё на два месяца. Но обязаны уведомить об этом в течение первого месяца.

Если месяц прошёл — ответа нет — это нарушение. Зафиксированное, задокументированное нарушение.

Шаг четвёртый. Используй что получил.

Если пришёл ответ с данными — изучи внимательно. Что именно хранят. Какие категории. Откуда получили. Кому передавали.

Если данные неточные — отправляй запрос на исправление. Статья 16. Если хочешь удалить — отправляй запрос на удаление. Статья 17. Если хочешь остановить обработку для рекламных целей — отправляй возражение. Статья 21.

Каждый из этих запросов — отдельное письмо. Отдельный срок ответа. Отдельная фиксация.

Что происходит когда они молчат. Из личного опыта

Я веду 15 активных дел против рекламных брокеров. Расскажу что происходит на практике.

Когда отправляешь первый запрос — чаще всего тишина. Компании рассчитывают что человек отправил письмо и забыл. Или устанет ждать. Или не знает что делать дальше.

Большинство людей действительно устают. Именно на это расчёт.

Когда отправляешь напоминание с указанием что срок ответа истёк и ты фиксируешь нарушение статьи 12(3) — реакция меняется. Не всегда. Но часто. Потому что слова «фиксирую нарушение» означают что человек знает о чём говорит.

Quantcast не ответил мне более 30 дней. Это задокументировано. Дата отправки запроса зафиксирована. Дата истечения срока зафиксирована. Это готовый материал для жалобы.

Когда подаёшь жалобу в AKI — Инспекцию по защите данных Эстонии — компания которая молчала три месяца вдруг находит возможность ответить. Удивительное совпадение. Потому что отвечать регулятору сложнее чем молчать обычному человеку.

Это и есть механизм. Не каждый человек должен идти до конца. Но когда достаточно людей начинают использовать этот инструмент — система меняется. Регулятор видит паттерн. Компания получает репутационные и финансовые риски. Меняет практики.

Каждая жалоба — это не просто твоё личное дело. Это данные для системы которая должна работать в интересах людей.

Сервисы которые помогают. И их ограничения

Существуют сервисы которые автоматизируют процесс удаления данных из баз брокеров. DeleteMe, Kanary, Incogni, Privacy Bee. Платные — от 10 до 15 евро в месяц.

Они работают так. Ты даёшь им свои данные. Они от твоего имени отправляют opt-out запросы в базы брокеров с которыми имеют партнёрство или отработанный процесс. Мониторят появление твоих данных. Периодически повторяют запросы.

Это реально помогает — в рамках своих возможностей.

Ограничения о которых нужно знать

Эти сервисы работают с ограниченным списком брокеров. DeleteMe например работает с несколькими десятками крупных американских брокеров. Но брокеров — тысячи. Те которые не в списке — не охвачены.

Европейский рынок покрыт значительно хуже американского. Большинство этих сервисов сфокусированы на США. Для жителей Эстонии, Латвии, Литвы, Финляндии — охват меньше.

Данные возвращаются. Сервисы об этом честно говорят — именно поэтому они берут ежемесячную подписку а не разовый платёж. Это не решение — это постоянное обслуживание.

Ты даёшь этим сервисам свои данные. Чтобы они удалили твои данные из других баз. Ирония в том что теперь у них есть твои данные. Нужно читать их политику конфиденциальности внимательно — что они делают с информацией которую ты им предоставил.

Мой вывод. Эти сервисы полезны как дополнение к собственным действиям — особенно для крупных американских брокеров. Но не как замена пониманию и активным GDPR-запросам.

Специфика европейского рынка. Что работает здесь

Для жителей ЕС и в частности Эстонии — GDPR даёт реальные инструменты которых нет у американцев. Используй их.

Первое. Право на доступ работает здесь лучше чем где-либо. Европейские компании знают что регулятор существует и штрафы реальны. Ответ на GDPR-запрос в Эстонии получить проще чем opt-out от американского брокера.

Второе. AKI — Andmekaitse Inspektsioon — реально работающий регулятор. Не просто организация с красивым сайтом. Они рассматривают жалобы. Выдают предписания. Штрафуют.

Подать жалобу — aki.ee. Онлайн форма. На эстонском или английском. Бесплатно. Нужно описать ситуацию, приложить переписку, указать какое право нарушено и как.

Третье. Для брокеров работающих на эстонском рынке — включая тех которых я нашёл в трафике местных сайтов — именно AKI является компетентным органом. Quantcast работает на эстонских сайтах — значит AKI может заниматься нарушениями связанными с эстонскими пользователями.

Четвёртое. Если брокер находится в другой стране ЕС — жалобу можно подать либо в AKI, либо напрямую в надзорный орган страны где зарегистрирована компания. Регуляторы ЕС взаимодействуют между собой.

Пятое. Если компания находится вне ЕС — например американский брокер без европейского офиса — ситуация сложнее. GDPR формально применяется если компания обрабатывает данные европейских жителей. Но принудить американскую компанию без европейского присутствия — технически сложно. Здесь важна работа регуляторов на межгосударственном уровне.

Реалистичная картина. Что можно достичь

Я хочу быть честным. Потому что завышенные ожидания хуже чем реализм.

Полностью исчезнуть из баз данных — невозможно. Пока существуют публичные реестры, программы лояльности, рекламные трекеры на сайтах — данные будут появляться снова. Это не повод опустить руки. Это повод понимать реальную цель.

Реальная цель — это не невидимость. Это контроль

Контроль над тем что уходит в базы — через изменение браузера, поисковика, разрешений приложений. Контроль над тем что хранится — через GDPR-запросы и право на удаление. Контроль над тем как используется — через право на возражение против рекламной обработки.

И контроль информационный — ты знаешь что происходит. Ты не живёшь в иллюзии что всё это тебя не касается.

Это уже другая позиция. Принципиально другая.

Человек который понимает что происходит — принимает другие решения. Он не нажимает автоматически «принять всё». Он не отправляет скан паспорта сервису которому не доверяет. Он не устанавливает приложение не глядя на разрешения. Он отправляет запрос когда компания нарушает его права — вместо того чтобы молча проглотить.

Таких людей становится больше. И система это чувствует.

Что происходит когда людей становится много

Я хочу закончить этим. Потому что это важнее технических советов.

GDPR был принят потому что достаточно людей — журналисты, активисты, юристы, обычные граждане — начали говорить вслух о том что происходит. Cambridge Analytica стала публичным скандалом потому что люди которые об этом знали — рассказали. Штрафы против Meta, Google, Amazon стали возможными потому что кто-то подал первую жалобу. Потом вторую. Потом тысячную.

Система не меняется когда один человек что-то делает. Система меняется когда критическое число людей начинает делать это регулярно.

Каждый GDPR-запрос который ты отправляешь — это не просто твоё личное дело. Это сигнал. Компания получает запрос — и понимает что люди начали смотреть. Регулятор получает жалобу — и видит паттерн. Паттерн становится расследованием. Расследование становится штрафом. Штраф становится прецедентом. Прецедент меняет практику индустрии.

Это медленно. Это неочевидно. Это не даёт мгновенного результата.

Но это единственное что работает на системном уровне.

Я веду 15 дел не потому что рассчитываю лично победить индустрию стоимостью 300 миллиардов долларов. Я веду их потому что каждое дело — это задокументированный факт. Каждый задокументированный факт — это кирпич в фундаменте изменений которые происходят медленно но неизбежно.

Потому что индустрия которая работает в темноте — меняется когда в неё начинают светить фонариком.

Этот текст — один из таких фонариков.

Следующий — в твоих руках.

← Все материалы журнала