Скелет тиранозавра на ім'я Стен, який розташований в штаб-квартирі Googleplex в Маунтін-В'ю, штат Каліфорнія. Джерело: Google
Нова політика Google: медіафайли стануть паливом для ІІ
Google тихо оновила умови використання своїх пошукових сервісів, відкривши двері для застосування контенту користувача в навчанні штучного інтелекту. Згідно з повідомленням TechCrunch, компанія тепер може використовувати зображення, відео, аудіо та інші медіафайли, які люди завантажують під час роботи з Google Search для тренування своїх ІІ-моделей.
Який контент тепер може бути використаний
До числа порушених даних входять:
- Фотографії, завантажені в Google Lens для візуального пошуку;
- Аудіозапис голосових пошукових запитів;
- Файли, завантажені у Google Translate;
- Інші медіафайли, які використовуються у пошукових сервісах Google.
Важливо, що зміни не поширюються на приватний контент, що зберігається у Google Photos. Йдеться лише про файли, які користувачі завантажують безпосередньо у пошукові інструменти.
Увімкнено за замовчуванням, але можна вимкнути
Як часто буває в Silicon Valley, нова функція активована автоматично для всіх користувачів. Проте Google передбачила можливість відмовитися від участі у програмі. Щоб запобігти використанню своїх медіафайлів для навчання ІІ, потрібно:

Налаштування історії пошукових служб Google. Ілюстрація: Google
- Відкрити сторінку Search Services History;
- Вимкнути опцію Save Media;
- Додатково перевірити установки на сторінці Search Services Personalization, щоб переконатися, що сервіс не зберігає відповідні дані.
Частина глобального тренду чи виклик конфіденційності?
Рішення Google відображає загальну стратегію технологічних гігантів, які розширюють доступ до даних користувачів для навчання генеративних моделей ІІ. Це дозволяє компаніям створювати більш просунуті алгоритми, але одночасно порушує питання про конфіденційність та згоду користувачів на використання їх контенту в комерційних цілях.
Користувачам, стурбованим тим, як їх дані використовуються в епоху штучного інтелекту, рекомендується регулярно перевіряти конфіденційність і контролювати, який контент компанії можуть використовувати для навчання своїх систем.
Джерело: TechCrunch