Данные россиян для нейросетей: АБД добивается упрощённого доступа через PETs
Яндекс, Сбер и VK хотят учить нейросети на наших данных без спроса В начале августа Ассоциация больших данных (АБД) – в неё входят Сбер, Яндекс, VK, Авито, HeadHunter и другие – отправила письмо в Минцифры. И просит разрешить компаниям использовать обезличенные данные людей для обучения ИИ без отдельного согласия. Компании говорят, что будут применять специальные технологии, которые превращают личные данные в обезличенную информацию – так, чтобы понять, чьи это данные, было невозможно. В мире такие технологии называют PETs (Privacy Enhancing Technologies). По утверждению АБД, при корректном использовании такие технологии полностью исключают риск установить личность владельца данных. Проблема в том, что действующее законодательство не выделяет PETs в отдельную категорию. Сейчас по закону любое обезличивание считается одинаковым – независимо от того, насколько надёжно защищены данные. Представители же АБД хотят, чтобы надёжные технологии с нулевым или почти нулевым риском идентификации получили отдельный статус для доступа к этим массивам данных. Чтобы это было реализуемо, компании предлагают несколько условий: риск раскрытия личности должен быть равен нулю или составлять доли процента, данные можно использовать только для ИИ-задач, обрабатывать их должны в России российские компании. Почему они этого хотят? Дело в том, что внутренних данных для обучения современных нейросетей уже не хватает. Компании использовали то, что у них было, но этих массивов становится мало. Без доступа к качественным данным российские модели рискуют отстать от мировых аналогов. Если этот закон примут, то компании получат ускорение разработки ИИ и меньше бюрократии. А вот пользователи получат риск потерять контроль над своими данными. Даже если технически идентифицировать человека нельзя, вопрос в том, кто и как это будет проверять. Механизмов контроля в законе пока не прописано. Доверие к технологиям – штука хрупкая. Если люди узнают, что их данные используют без спроса, это может вызывать недовольство конкретной технологией или компанией, даже если данные обезличены. И в конечном счёте вопрос даже не в том, действительно ли обезличенные данные безопасны для отдельно взятого человека, а в том, соблюдаются ли нормы по защите этих данных. Если нет, любые юридические запреты и ограничения автоматически теряют всякий смысл, а у разработчиков появляется соблазн использовать данные «в тёмную». [Официальный канал Ильи Кравцова](https://t.me/+lpTDhSRdH6gxYjZi) Данный материал носит информационный характер и не является индивидуальной инвестиционной рекомендацией или предложением о покупке или продаже указанной ценной бумаги.
Пост взят с международного финтех-медиа ресурса
ДЛЯ ЛЮДЕЙ