Cómo funciona la marca de agua de IA
Updated September 1, 2026 · first published September 1, 2026
Hay una señal invisible en el texto que generan los modelos Claude compatibles. Ni tú ni tus usuarios podéis verla, no cambia el significado ni la calidad y no aparece en la factura. Aun así está ahí, y conviene entenderla, porque lo que la rompe es justo lo que tu propia canalización hace a diario.
Cómo funciona en el texto
Un modelo de lenguaje no elige el token más probable: muestrea de una distribución usando aleatoriedad. La técnica de marca de agua — siguiendo el enfoque SynthID-Text — sesga esa aleatoriedad. Ciertos tokens se vuelven ligeramente más probables según un patrón que solo conoce el detector.
Cada palabra por separado es irrelevante: siempre había una alternativa plausible. A lo largo de cientos de tokens, el patrón se acumula en una señal estadística que un detector mide y un lector no percibe. De ahí dos consecuencias: es estadística, no un sello, y necesita longitud. Una salida del tamaño de un tuit lleva mucha menos señal que una página entera.
Las imágenes funcionan al revés
Los archivos .svg, .png y .jpg generados llevan metadatos C2PA: un manifiesto firmado criptográficamente. No es estadístico ni oculto, es un bloque de datos verificable con exactitud. El intercambio es previsible: los metadatos firmados dan certeza y se borran con un comando; la marca estadística no se borra limpiamente pero se degrada al editar, parafrasear o traducir. Ninguna es un candado; ambas son pruebas.
Qué significa para tus sistemas
Las salidas cortas llevan señal débil. El posprocesado intenso — parafrasear, resumir, traducir o pasar el texto por un segundo modelo — erosiona la señal. Y tu canalización de imágenes puede destruir los metadatos C2PA sin querer, que es la forma más común de perder la procedencia en producción.
Related
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →