Cómo evitar que Google use tus fotos, audios y videos para entrenar su IA


Ahora Google puede usar los archivos que subes a Google Search para entrenar IA.

Cada vez que recibo un mensaje en el que se explica cómo otra empresa tiene previsto utilizar los datos personales de formas cada vez más invasivas para el entrenamiento de la IA, una pequeña parte de mi alma se marchita. Hace varias semanas recibí uno de esos correos electrónicos de Google, con el asunto: “Nuevos ajustes de privacidad para los servicios de Búsqueda”.

Cualquier tipo de contenido multimedia, desde las fotos que subes para búsquedas inversas de imágenes hasta el audio de tus conversaciones con Google Translator, podría conservarse en tu cuenta y utilizarse para mejorar los modelos de IA de Google.

Esta opción en la configuración de la cuenta de Google, denominada “Historial de los servicios de búsqueda”, ya estaba activada cuando visité la página por primera vez. (Si un usuario hubiera desactivado previamente las opciones de “Actividad en la web y en aplicaciones” y “Personalización de la búsqueda” de Google, entonces estaría desactivada).

Además, la casilla para guardar todos mis archivos multimedia subidos desde la Búsqueda de Google para el entrenamiento de la IA ya estaba marcada.

Cuando esta función se implemente en tu cuenta, puedes visitar la página «Mi actividad» de Google y seleccionar la pestaña “Historial de servicios de búsqueda” para desactivarla. Esta página te ofrece una idea clara de lo que Google guarda de tu historial de búsqueda. También es donde puedes desactivar toda la configuración y eliminar tu actividad. Es fundamental desmarcar la casilla situada junto a “Guardar contenido multimedia” si no quieres que tus imágenes subidas se utilicen para el entrenamiento de la IA.

Actuar pronto es lo ideal

Vale la pena realizar este cambio ahora mismo, en lugar de dejarlo para más adelante. No hay mucho que puedas hacer una vez que tus datos multimedia se hayan introducido en la “licuadora” de la IA. “Si tus archivos multimedia guardados se utilizan para entrenar nuestros modelos de IA, se desvinculan de tu cuenta de Google. Estos datos de entrenamiento se conservarán hasta 4 años, incluso si eliminas la actividad original”, decía la ventana emergente cuando desactivé esta función. Es mucho tiempo para que mis imágenes subidas al azar a la Búsqueda sigan flotando en el éter digital.

“Esta configuración ayuda a los usuarios a obtener resultados más relevantes y a volver a consultar sus búsquedas (incluidas las búsquedas visuales y por voz) y se puede activar o desactivar en cualquier momento”, asegura Davis Thompson, portavoz de Google, en un correo electrónico al ser contactado para comentar el tema. No respondió a la pregunta de WIRED sobre el hecho de que esta función esté activada por defecto.

¿Qué es lo que realmente se guarda aquí?

Google deja claro que está empezando a almacenar mucho más que lo que escribes en la Búsqueda. “Tus archivos multimedia guardados incluyen tus imágenes, archivos y grabaciones de audio y video procedentes de tus interacciones con los servicios de Búsqueda”, reza la descripción de la página. “Esto incluye elementos como imágenes de Google Lens, grabaciones de Search Live o de los ejercicios de pronunciación de Translate, contenido que subes y búsquedas por voz”.

Esto se debe a que los modelos de IA no solo necesitan datos de texto para mejorar; requieren entradas diversas en otros formatos, como audio o video. Si Google puede recopilar más datos (y más tipos de datos) de su amplia gama de usuarios, tal vez podría innovar más rápido que sus competidores.

La enorme base de usuarios de Google se distribuye entre múltiples servicios, lo que le da una ventaja en la recopilación de datos. “Google se encuentra en una posición única en comparación con muchas otras empresas en este aspecto”, explica Thorin Klosowski, activista sénior en materia de seguridad y privacidad de la Electronic Frontier Foundation. “Porque ofrecen tantos servicios que la gente lleva utilizando desde hace tanto tiempo que se ha acostumbrado y se ha vuelto bastante complaciente con la cantidad de datos que se recopilan”. Las aplicaciones que la gente utiliza a diario tienen una especie de inercia inherente, por lo que los cambios que no gustan a los usuarios pueden no ser suficientes para empujarlos hacia servicios alternativos.

Activado por defecto

Verse obligado a excluirse del entrenamiento de la IA parece ser la norma en todos los sitios web y plataformas. No tiene por qué ser así. “Creo que la opción de ‘aceptar’ es realmente lo mínimo que se puede pedir a estas empresas”, señala Klosowski. “Pedir a sus usuarios que elijan conscientemente activar estas funciones es lo mínimo que pueden hacer”. Google tendría que explicar mejor a los usuarios por qué estas funciones podrían resultar útiles si no se activaran automáticamente, señala Klosowski.

En el correo electrónico que Google envió a mi cuenta de pruebas, la primera frase presentaba este cambio como una forma de ofrecerme “aún más control sobre el historial guardado”. A continuación, Google proporcionaba ejemplos en el mensaje que mostraban cómo guardar este contenido multimedia podría resultar útil. «Por ejemplo, esto te permite volver a consultar tus búsquedas visuales anteriores con Lens o continuar una conversación de Search Live sobre una canción que hayas escuchado». En cambio, llama la atención que Google no ofreciera ejemplos similares tras indicar, casi al final del correo electrónico, que este contenido multimedia guardado se utilizará para el entrenamiento de modelos de IA. En su lugar, el mensaje simplemente pasó al siguiente detalle.

Previous Perú: un accidente de tráfico deja al menos 13 muertos en el sur del país
Next Punta Cana: el futuro se construye entre todos (3 de 3)