Inteligencia Artificial

SynthID de Google no detecta IA de otros; así funciona su herramienta

SynthID de Google no detecta IA de otros; así funciona su herramienta

Google acaba de abrir al público SynthID, su tecnología para identificar si una imagen, video o audio fue creado por inteligencia artificial. El problema es que solo funciona cuando la IA detrás del contenido es de Google o sus socios directos — lo que elimina de la ecuación a buena parte del mundo tecnológico.

La herramienta que la división DeepMind de Google lanzó en 2023 ya estaba siendo usada internamente. Ahora, cualquiera puede acceder a ella a través de la web oficial de SynthID o dentro de Gemini subiendo un archivo. La idea es simple: ante la avalancha de desinformación impulsada por contenido generado con IA, ofrecer un método para validar qué es real y qué es artificial.

Pero la realidad es más complicada.

Índice
  1. Cómo funciona SynthID
  2. El problema real: es un estándar privado
  3. Alternativas que emergen
  4. ¿Cuánto confiar en esto?

Cómo funciona SynthID

Técnicamente, SynthID no es un detector que analiza pixeles o características de una imagen. Es más sofisticado: funciona mediante marcas de agua imperceptibles que se incrustan en el contenido en el momento en que se genera. Estas marcas son invisibles al ojo humano pero resistentes a compresión, recortes, cambios de fotogramas (en video) e incluso ruido agresivo (en audio).

Google sostiene haber marcado un volumen muy elevado de imágenes, videos y audio con esta tecnología. Estos números ilustran la escala del problema: la cantidad de contenido generado por IA crece más rápido de lo que muchos suponen.

El servicio tiene limitaciones prácticas. Hay restricciones en la cantidad de consultas permitidas por día, los videos no pueden exceder una duración específica y hay límites de tamaño de archivo. Google debe limitar su uso porque cada análisis consume recursos computacionales; es lógico que no regale acceso ilimitado.

El problema real: es un estándar privado

Aquí viene el detalle que invalida la utilidad de SynthID en la mayoría de los casos. La herramienta solo puede leer las marcas de agua que ella misma, Gemini y los socios integrados de Google insertan en el contenido. Si una imagen fue generada con modelos de OpenAI, Midjourney, Stable Diffusion, Runway o cualquier otra plataforma que no sea Google o sus colaboradores, SynthID no verá nada.

Eso significa que cuando subes una imagen generada con ChatGPT o DALL-E, SynthID dirá que no puede determinar si es IA o no. Y cuando alguien usa software de otra compañía — incluso si ese software sí intenta insertar identificadores propios — el detector de Google seguirá sin poder leerlos.

El equipo de OpenAI reconoce que su detector de contenido tiene un alcance limitado. Existe la posibilidad de que contenido generado por IA no sea identificado si los metadatos se manipulan, la marca de agua se degrada, proviene de un modelo más antiguo o fue creado antes de que existieran estos sistemas de autenticación.

Un trabajador de Meta compartió una imagen claramente artificial creada con una herramienta no identificada. Cuando fue sometida a SynthID, la herramienta no pudo determinar su origen. Es el ejemplo perfecto de por qué esta solución, aunque técnicamente impresionante, es un placebo en la práctica.

Alternativas que emergen

La ironía es que las mismas empresas que desarrollan modelos de IA cada vez más sofisticados son las que intentan crear herramientas para detectarlos. Es un ciclo de carrera armamentista: mientras Google refina SynthID, otras compañías trabajan en formas de eliminar marcas de agua o eludir sistemas de detección.

La propuesta más seria es el estándar C2PA (Coalition for Content Provenance and Authenticity), que gestiona especificaciones como Content Credentials para etiquetar contenido generado por IA. Varias grandes empresas del sector respaldan este enfoque, aunque su adopción sigue siendo fragmentada.

Se han aprobado iniciativas legislativas que consideran infracción no etiquetar contenido generado por IA. Sin embargo, la cantidad de contenido falso sin etiquetar ha aumentado, incluyendo influencers sintéticos con mensajes potencialmente dañinos. La legislación no es suficiente si las herramientas técnicas para cumplirla carecen de estándares reales.

¿Cuánto confiar en esto?

SynthID es un adelanto genuino en detección de contenido artificial, pero posicionarla como una solución confiable es engañoso. Es funcional dentro de su ecosistema cerrado — Google, Gemini, y empresas que decidieron integrar sus marcadores — pero ese ecosistema no cubre ni de lejos la mayoría de las herramientas de IA que generan contenido falso.

Mientras no exista un estándar abierto y adoptado por la industria completa, cualquier herramienta individual seguirá siendo un parche. Y los usuarios que buscan validar contenido seguirán navegando en la incertidumbre.

Con información de Xataka.

Imagen: The wub / Wikimedia Commons (CC BY-SA 4.0)

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *