Google обновила политику данных для обучения ИИ-моделей

Корпорация Google объявила о масштабных изменениях в политике обработки пользовательской информации, введя новую настройку под названием «История поисковых сервисов». Согласно официальному заявлению, компания намерена сохранять изображения, аудиофайлы и видеоматериалы, полученные через различные службы, для совершенствования своих алгоритмов и глубокого обучения нейросетей.

Какие данные попадут в обучающие выборки

Нововведения затрагивают широкий спектр мультимедийного контента, который ранее обрабатывался локально или удалялся после завершения сессии. В рамках новой системы Google будет архивировать:

  • Визуальный контент, загружаемый через сервис Google Lens;
  • Аудиозаписи, созданные в процессе использования функции Search Live;
  • Голосовые запросы и фразы, вводимые пользователями в мобильных и веб-приложениях для перевода;
  • Файлы, передаваемые в ходе взаимодействия с поисковой экосистемой.

Предполагается, что расширение базы данных позволит существенно повысить точность распознавания объектов и естественность синтеза речи в будущих итерациях ИИ.

Цели обработки и инструменты контроля

Представители технологического гиганта подчеркивают, что сбор информации преследует три основные цели: обучение нейросетевых моделей, общая оптимизация сервисов и предоставление персонализированных рекомендаций. Если у пользователя активирована функция показа таргетированной рекламы, накопленные медиаданные также могут влиять на рекламные предложения.

История поисковых сервисов поможет нам сделать ИИ более адаптивным к индивидуальным потребностям каждого пользователя и улучшить качество работы лингвистических моделей

Несмотря на расширение сбора данных, Google сохраняет механизмы приватности. Пользователи имеют возможность в любой момент деактивировать опцию «Сохранять медиа» в настройках своего аккаунта, что прекратит накопление новых файлов для обучения систем.

Внедрение подобных изменений подчеркивает растущую потребность ИТ-индустрии в качественных наборах данных для развития генеративного искусственного интеллекта. Для рядовых пользователей это означает компромисс между конфиденциальностью и повышением функциональности сервисов, при этом возможность ручного управления настройками приватности остается ключевым инструментом защиты личной информации.

Материал соответствует редакционной политике Techimo Все публикации проходят проверку фактов и соответствуют стандартам независимой журналистики.
Подробнее

Techimo в Telegram

Самые свежие новости технологий, инсайды и обзоры гаджетов раньше, чем на сайте. Без спама.

Подписаться на канал