Блог им. investwhales

Яндекс, Сбер и VK хотят учить нейросети на наших данных без спроса

Яндекс, Сбер и VK хотят учить нейросети на наших данных без спроса
📥 В начале августа Ассоциация больших данных (АБД) – в неё входят Сбер, Яндекс, VK, Авито, HeadHunter и другие – отправила письмо в Минцифры. И просит разрешить компаниям использовать обезличенные данные людей для обучения ИИ без отдельного согласия.

Компании говорят, что будут применять специальные технологии, которые превращают личные данные в обезличенную информацию – так, чтобы понять, чьи это данные, было невозможно. В мире такие технологии называют PETs (Privacy Enhancing Technologies).

По утверждению АБД, при корректном использовании такие технологии полностью исключают риск установить личность владельца данных.

🏛 Проблема в том, что действующее законодательство не выделяет PETs в отдельную категорию. Сейчас по закону любое обезличивание считается одинаковым – независимо от того, насколько надёжно защищены данные.

Представители же АБД хотят, чтобы надёжные технологии с нулевым или почти нулевым риском идентификации получили отдельный статус для доступа к этим массивам данных.

🛡 Чтобы это было реализуемо, компании предлагают несколько условий: риск раскрытия личности должен быть равен нулю или составлять доли процента, данные можно использовать только для ИИ-задач, обрабатывать их должны в России российские компании.

Почему они этого хотят?

Дело в том, что внутренних данных для обучения современных нейросетей уже не хватает. Компании использовали то, что у них было, но этих массивов становится мало. Без доступа к качественным данным российские модели рискуют отстать от мировых аналогов.

Если этот закон примут, то компании получат ускорение разработки ИИ и меньше бюрократии. А вот пользователи получат риск потерять контроль над своими данными. Даже если технически идентифицировать человека нельзя, вопрос в том, кто и как это будет проверять. Механизмов контроля в законе пока не прописано.

🔒 Доверие к технологиям – штука хрупкая. Если люди узнают, что их данные используют без спроса, это может вызывать недовольство конкретной технологией или компанией, даже если данные обезличены.

И в конечном счёте вопрос даже не в том, действительно ли обезличенные данные безопасны для отдельно взятого человека — а в том, соблюдаются ли нормы по защите этих данных. Если нет — любые юридические запреты и ограничения автоматически теряют всякий смысл, а у разработчиков появляется соблазн использовать данные “в тёмную”.

Коллеги, приглашаю на свой канал для погружения в инвестиции через призму IT и цифровизацию бизнеса, где еще больше актуальных новостей и моих разборов — t.me/+-a0sqZD702Y5MDQy и канал в МАХ max.ru/join/zufD-8BN8LHpjz788qsRV8AEpBjj2imDf6_uksr89tU

Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
196
#91 по плюсам

Читайте на SMART-LAB:
Экономия или жизнь «на всю катушку»: как меняются траты летом? 🤑
Какое время года обходится людям дороже: зима или лето? Займер узнал ответ на этот вопрос, а также выяснил, на что опрошенные тратятся и на чем...
🧠 SOFL с помощью ИИ автоматизировал внутреннюю техподдержку
Софтлайн автоматизировал внутреннюю техподдержку с помощью ИИ-сервиса SEVA собственной разработки. Теперь заявки сотрудников обрабатываются и...
Фото
EUR/USD: евро вновь обрел силу и предъявил пару козырей
Евро перешел от консолидации у локального минимума к быстрому росту на фоне переоценки макроэкономических и монетарных ожиданий. Европейская...
Фото
Позитив: сильный 2й квартал. Где "безопасная" цена акции?
2 квартал выглядит сильно 8,3 млрд руб — рекордные квартальные отгрузки для всех кварталов кроме 4-го Выручка +39%г/г за 2 квартал и +41% за...

теги блога investwhales

....все тэги



UPDONW
Новый дизайн